ApiMonth API 接入说明
使用生效中的美元积分和你自己的 API 密钥,把兼容客户端接到模型网关。
1. 账户与密钥
先登录、兑换美元积分包,再在控制台「API 密钥」页创建密钥。创建时请立即复制完整密钥,之后不再展示。
- Base URL:
https://api.apimonth.com/v1 - 鉴权:
Authorization: Bearer YOUR_APIMONTH_API_KEY - 选择当前余额支持的已开放模型。网站登录 Cookie 不是模型 API 密钥。
SDK 或桌面客户端里填写 Base URL,不要再拼 /chat/completions。兼容性取决于接口和客户端;只改 Base URL 并不能让所有厂商专用客户端都能用。
2. 发送 Chat Completions 请求
下面示例按 Grok 订阅。请换成你自己的密钥,不要把真实密钥写进源码或前端。
curl https://api.apimonth.com/v1/chat/completions \
-H 'Content-Type: application/json' \
-H 'Authorization: Bearer YOUR_APIMONTH_API_KEY' \
-d '{"model":"grok-4.6","messages":[{"role":"user","content":"Explain binary search briefly."}]}'使用 openai SDK 的 Python(pip install openai):
import os
from openai import OpenAI
client = OpenAI(
base_url="https://api.apimonth.com/v1",
api_key=os.environ["APIMONTH_API_KEY"],
)
response = client.chat.completions.create(
model="grok-4.6",
messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)已开放的 Grok、GPT、Gemini 路由支持 JSON 与流式 SSE。客户端支持流式时设置 stream: true。
3. 使用 Responses 与 WebSocket
当前已开放的对话模型均可使用 Responses(纯生图模型除外)。HTTP 为 POST /v1/responses。推理字段是 reasoning.effort;Chat Completions 用 reasoning_effort。GPT-5.5 与 Spark 接受 none/low/medium/high/xhigh(max 会被拒绝)。GPT-5.6 与 Astra 还可使用 max。Grok 4.6 接受 low/medium/high/xhigh。
WebSocket 为 wss://api.apimonth.com/v1/responses,不是 realtime 音频。握手时带 Authorization: Bearer YOUR_API_KEY,不要放进 URL。发送 response.create,等待 response.completed,再用 previous_response_id 续写。每个 socket 同时只能有一个 in-flight create。不支持 response.cancel。
为 ApiMonth 配置 OpenAI 兼容客户端。
HTTP Responses(当前月卡已开放的对话模型均可)
- Base URL: https://api.apimonth.com/v1
- API Key: YOUR_API_KEY
- 鉴权头: Authorization: Bearer YOUR_API_KEY
- 接口: POST https://api.apimonth.com/v1/responses
- 模型名(不要加厂商前缀): 用 GET /v1/models 返回的对话路由。例如 gpt-5.5、grok-4.6、gemini-3.8-flash-high、deepseek-flash、claude-sonnet-4-6、claude-opus-4-6。纯生图模型不能走 Responses。
- 推理字段: reasoning.effort(例如 {"reasoning":{"effort":"high"}})。Chat Completions 用 reasoning_effort。
- GPT-5.5 与 gpt-5.3-codex-spark: none / low / medium / high / xhigh(max 会被拒绝)
- GPT-5.6-* 与 gpt-6-astra: 以上再加上 max
- Grok 4.6: low / medium / high / xhigh(也接受 none/max,但 none 仍可能产生思考 token)
- 请求体上限 32MiB
curl:
curl https://api.apimonth.com/v1/responses \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"gpt-5.5","input":"hello","reasoning":{"effort":"high"}}'
Python:
from openai import OpenAI
client = OpenAI(base_url="https://api.apimonth.com/v1", api_key="YOUR_API_KEY")
r = client.responses.create(model="gpt-5.5", input="hello", reasoning={"effort":"high"})
print(r.output_text)
WebSocket(Responses WS,不是 realtime 音频)
- URL: wss://api.apimonth.com/v1/responses?model=gpt-5.5
- 只在握手头带 Authorization: Bearer YOUR_API_KEY(不要把密钥放进 URL)
- 可选 ?model=;查询参数与 JSON 同时有 model 时必须一致
- model 必须是当前月卡已开放的对话路由(与 HTTP Responses 相同)
- 发送一条文本 JSON:
{"type":"response.create","model":"gpt-5.5","input":[{"role":"user","content":"hello"}],"reasoning":{"effort":"high"}}
- 等 {"type":"response.completed",...} 后再在同一连接发下一轮
- 续写上下文用 previous_response_id = completed response.id
- 不要发送 response.cancel 或 session.update
- 每个 socket 同时只能有一个 in-flight create;并行请另开连接
- 空闲或一轮响应: 5 分钟;1024 轮后请重连
- WS 消息大小 128KiB
4. Codex / OpenCode / Pi / Claude Code
把 YOUR_API_KEY 换成控制台密钥。模型用 GET /v1/models 返回的当前已开放对话路由。Responses 与 Responses WebSocket 对已开放对话模型均可用。
为 ApiMonth 配置常见编程代理(OpenAI 兼容)。
共用
- Base URL: https://api.apimonth.com/v1
- API Key: YOUR_API_KEY(控制台密钥;不要放进 URL)
- 模型: 用 GET /v1/models 返回的当前月卡路由标识(不要加厂商前缀)。对话模型支持 Chat Completions、Responses、Responses WebSocket;纯生图模型不行。
- 示例: gpt-5.5、gpt-5.6-sol、grok-4.6、gemini-3.8-flash-high、deepseek-flash、claude-sonnet-4-6、claude-opus-4-6
Codex CLI / Codex App(~/.codex/config.toml)
# ~/.codex/config.toml — ApiMonth (Responses + WebSocket)
model = "gpt-5.5" # Or any admitted chat model on your active card from GET /v1/models
model_provider = "apimonth"
model_reasoning_effort = "high"
# plan_mode_reasoning_effort = "xhigh"
# Dangerous for beginners — leave commented unless you understand the risk:
# approval_policy = "never"
# sandbox_mode = "danger-full-access"
[model_providers.apimonth]
name = "ApiMonth"
base_url = "https://api.apimonth.com/v1"
experimental_bearer_token = "YOUR_API_KEY"
wire_api = "responses"
requires_openai_auth = true
supports_websockets = true
OpenCode(~/.config/opencode/opencode.json)
{
"$schema": "https://opencode.ai/config.json",
"provider": {
"openai": {
"options": {
"baseURL": "https://api.apimonth.com/v1",
"apiKey": "YOUR_API_KEY"
}
}
},
"model": "gpt-5.5"
}
Pi(~/.pi/agent/models.json)
{
"providers": {
"apimonth": {
"baseUrl": "https://api.apimonth.com/v1",
"api": "openai-responses",
"apiKey": "YOUR_API_KEY",
"models": [
{ "id": "gpt-5.5", "reasoning": true },
{ "id": "gpt-5.6-sol", "reasoning": true },
{ "id": "grok-4.6", "reasoning": true },
{ "id": "gemini-3.8-flash-high", "reasoning": true },
{ "id": "deepseek-flash", "reasoning": true },
{ "id": "claude-sonnet-4-6", "reasoning": true },
{ "id": "claude-opus-4-6", "reasoning": true }
]
}
}
}
然后在 Pi 里用 /model 选择 apimonth 下的模型。若客户端走 Responses WebSocket,建议在 /settings 把 Transport 设为 websocket-cached。
Claude Code
# Claude Code talks Anthropic Messages. Base URL is the host root, not /v1.
export ANTHROPIC_BASE_URL=https://api.apimonth.com
export ANTHROPIC_AUTH_TOKEN=YOUR_API_KEY
# Optional equivalent: export ANTHROPIC_API_KEY=YOUR_API_KEY
# Chat models: Claude, GPT, Grok (e.g. claude-sonnet-4-6, gpt-5.5, grok-4.6). Gemini is not available in Claude Code.
- 只走 Anthropic Messages:POST /v1/messages。可用 Claude、GPT、Grok 对话路由(claude-sonnet-4-6、gpt-5.5、grok-4.6 等),不要加厂商前缀。
- Gemini、DeepSeek 和纯生图模型仍走 OpenAI Chat Completions / Responses,Claude Code 不会列出或调用它们。
Codex CLI / Codex App
编辑 ~/.codex/config.toml。建议 wire_api = "responses",并开启 supports_websockets = true。密钥放进 experimental_bearer_token。除非清楚风险,否则不要打开 never-approve / 全开沙箱。ApiMonth 不支持语音 / realtime WebRTC。
# ~/.codex/config.toml — ApiMonth (Responses + WebSocket) model = "gpt-5.5" # Or any admitted chat model on your active card from GET /v1/models model_provider = "apimonth" model_reasoning_effort = "high" # plan_mode_reasoning_effort = "xhigh" # Dangerous for beginners — leave commented unless you understand the risk: # approval_policy = "never" # sandbox_mode = "danger-full-access" [model_providers.apimonth] name = "ApiMonth" base_url = "https://api.apimonth.com/v1" experimental_bearer_token = "YOUR_API_KEY" wire_api = "responses" requires_openai_auth = true supports_websockets = true
OpenCode
创建或编辑 ~/.config/opencode/opencode.json。
{
"$schema": "https://opencode.ai/config.json",
"provider": {
"openai": {
"options": {
"baseURL": "https://api.apimonth.com/v1",
"apiKey": "YOUR_API_KEY"
}
}
},
"model": "gpt-5.5"
}
Pi
在 ~/.pi/agent/models.json 增加 openai-responses 供应商(不要对 ApiMonth 使用 CLIProxyAPI 专用 npm 插件)。再用 /model 选择。若支持 Responses WebSocket,可在 /settings 把 Transport 设为 websocket-cached。
{
"providers": {
"apimonth": {
"baseUrl": "https://api.apimonth.com/v1",
"api": "openai-responses",
"apiKey": "YOUR_API_KEY",
"models": [
{ "id": "gpt-5.5", "reasoning": true },
{ "id": "gpt-5.6-sol", "reasoning": true },
{ "id": "grok-4.6", "reasoning": true },
{ "id": "gemini-3.8-flash-high", "reasoning": true },
{ "id": "deepseek-flash", "reasoning": true },
{ "id": "claude-sonnet-4-6", "reasoning": true },
{ "id": "claude-opus-4-6", "reasoning": true }
]
}
}
}
Claude Code
设置 ANTHROPIC_BASE_URL=https://api.apimonth.com(根域名,不要加 /v1)和 ANTHROPIC_AUTH_TOKEN。可用 Claude、GPT、Grok 对话模型,例如 claude-sonnet-4-6、gpt-5.5、grok-4.6。Gemini、DeepSeek 和纯生图不能走 Claude Code,请继续用 Chat Completions / Responses。
# Claude Code talks Anthropic Messages. Base URL is the host root, not /v1. export ANTHROPIC_BASE_URL=https://api.apimonth.com export ANTHROPIC_AUTH_TOKEN=YOUR_API_KEY # Optional equivalent: export ANTHROPIC_API_KEY=YOUR_API_KEY # Chat models: Claude, GPT, Grok (e.g. claude-sonnet-4-6, gpt-5.5, grok-4.6). Gemini is not available in Claude Code.
5. 查看当前套餐的模型列表
已开放路由标识示例:
- Grok:
grok-4.6、grok-4.5、grok-composer-2.5-fast(对话 / Responses / Anthropic Messages;Composer 2.5 Fast 是 xAI 的快速编码模型,上游返回名为 grok-4.5);生图:grok-imagine-image、grok-imagine-image-2.0、grok-imagine-image-quality - GPT:
gpt-6-astra、gpt-5.6-sol、gpt-5.6-terra、gpt-5.6-luna、gpt-5.5、gpt-5.3-codex-spark(对话 / Responses / Anthropic Messages);生图:gpt-image-1.5、gpt-image-2 - Grok Fast(xAI Priority Processing,
service_tier: priority):grok-4.6-fast、grok-4.5-fast。同一模型、优先调度,单价为普通路由的 2 倍。xAI 官方说明:只要请求带了 priority 就按 2 倍计费,与响应返回的 tier 无关,本站同样按 2 倍结算。 - GPT Fast(Codex 快速通道,
service_tier: priority):gpt-5.6-sol-fast、gpt-5.6-terra-fast、gpt-5.6-luna-fast、gpt-5.5-fast。同一模型、更快返回,上游按 2 倍额度计费,因此单价是普通路由的 2 倍。快速通道只由路由决定:普通路由里手写的service_tier会被网关移除,Fast 路由会自动带上priority。 - Gemini:
gemini-pro-agent、gemini-3.1-pro-high、gemini-3.1-pro-low、gemini-3.5-flash、gemini-3.6-flash、gemini-3.7-flash、gemini-3.8-flash-high(对话 / Responses)。gemini-3.1-pro-high是 Agent 别名。Gemini 生图未开放。 - DeepSeek:
deepseek-flash(DeepSeek V4.1 Flash,对话 / Responses)。生图未开放。 - Claude:
claude-sonnet-4-6、claude-opus-4-6(对话 / Responses / Anthropic Messages)。不要加 anthropic/ 前缀。生图未开放。Claude Code 列出 Claude、GPT、Grok 对话模型,不支持 Gemini。
这不是完整或永久列表。不要加厂商前缀,也不要用展示名代替路由标识。公开 模型目录 以及 GPT、Grok、Gemini、DeepSeek、Claude 模型页可对照。查询当前可用模型:
curl https://api.apimonth.com/v1/models \ -H 'Authorization: Bearer YOUR_APIMONTH_API_KEY'
6. 生图与改图(Grok 与 GPT)
Grok Imagine 与 GPT Image 使用 POST /v1/images/generations 和 POST /v1/images/edits,不能走 Chat Completions。每次一张。size 与 quality 会转发但不保证;实测 GPT Image 1024x1024 返回 1254×1254。改图使用 data: 图片,不能用远程 http 图链。Gemini 生图未开放。生图按目录「每张」计价(默认三折,当前折扣以官网实时模型价为准),不按上下文 token。已开始的请求保留当时快照。宣传范围不含缓存写入。
curl https://api.apimonth.com/v1/images/generations \
-H 'Content-Type: application/json' \
-H 'Authorization: Bearer YOUR_APIMONTH_API_KEY' \
-d '{"model":"gpt-image-1.5","prompt":"A red circle on white"}'改已有 PNG(JSON)。Grok Imagine 要求源图至少 8×8。
curl https://api.apimonth.com/v1/images/edits \
-H 'Content-Type: application/json' \
-H 'Authorization: Bearer YOUR_APIMONTH_API_KEY' \
-d '{"model":"gpt-image-1.5","prompt":"Make the circle blue","images":[{"image_url":"data:image/png;base64,SOURCE_PNG_BASE64"}]}'Python 先生成,再用本地文件改图:
import base64, os
from openai import OpenAI
client = OpenAI(
base_url="https://api.apimonth.com/v1",
api_key=os.environ["APIMONTH_API_KEY"],
)
image = client.images.generate(
model="grok-imagine-image",
prompt="A red circle on white",
)
print(image.data[0].b64_json is not None)
with open("source.png", "rb") as f:
png = base64.b64encode(f.read()).decode()
edited = client.post(
"/images/edits",
body={
"model": "gpt-image-1.5",
"prompt": "Make the circle blue",
"images": [{"image_url": f"data:image/png;base64,{png}"}],
},
cast_to=object,
)7. 余额与失败
用量默认三折,Gemini 与 GPT-5.6 Luna 八折,Grok 对话五折,生图统一 $0.10 / 张,当前折扣以官网实时模型价为准,从美元面值扣费,不一定等于上游发票单价。新积分包兑换后 30 天有效;历史卡转为不可提现的永久余额。请在账户中查看美元余额与扣费流水。
到账规则:余额与模型价用同一个 $ 单位,¥1 = $1 额度。微信/支付宝 1:1 到账(¥220 → $220);PayPal 收美元,按 1 美元 = ¥6.8 折算(钱包 $10 → $68;¥40 积分包收 $5.88)。汇率在下单时锁定。
- 鉴权或模型权限错误:检查密钥、账户状态、余额是否有效,以及所选模型。
- HTTP 429:阅读错误信息。可能是余额、并发或速率限制;减少并行或稍后再试。
- 上游错误:保留错误详情与请求时间再排查,避免无控制重试。
断开客户端不一定会取消上游计算。已完成的上游用量仍可能写入扣费流水。
8. 购卡与退款
- 可在商店用微信/支付宝,或在控制台用 PayPal 购买美元积分包,再到本站兑换。新包 30 天自兑换起算。
- 未兑换的微信/支付宝积分包按商店原支付路径退款。
- 已兑换不能退款,积分不可提现。