ApiMonth API 接入说明

使用生效中的美元积分和你自己的 API 密钥,把兼容客户端接到模型网关。

1. 账户与密钥

先登录、兑换美元积分包,再在控制台「API 密钥」页创建密钥。创建时请立即复制完整密钥,之后不再展示。

  • Base URL:https://api.apimonth.com/v1
  • 鉴权:Authorization: Bearer YOUR_APIMONTH_API_KEY
  • 选择当前余额支持的已开放模型。网站登录 Cookie 不是模型 API 密钥。

SDK 或桌面客户端里填写 Base URL,不要再拼 /chat/completions。兼容性取决于接口和客户端;只改 Base URL 并不能让所有厂商专用客户端都能用。

2. 发送 Chat Completions 请求

下面示例按 Grok 订阅。请换成你自己的密钥,不要把真实密钥写进源码或前端。

curl
curl https://api.apimonth.com/v1/chat/completions \
  -H 'Content-Type: application/json' \
  -H 'Authorization: Bearer YOUR_APIMONTH_API_KEY' \
  -d '{"model":"grok-4.6","messages":[{"role":"user","content":"Explain binary search briefly."}]}'

使用 openai SDK 的 Python(pip install openai):

Python
import os
from openai import OpenAI

client = OpenAI(
    base_url="https://api.apimonth.com/v1",
    api_key=os.environ["APIMONTH_API_KEY"],
)
response = client.chat.completions.create(
    model="grok-4.6",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

已开放的 Grok、GPT、Gemini 路由支持 JSON 与流式 SSE。客户端支持流式时设置 stream: true

3. 使用 Responses 与 WebSocket

当前已开放的对话模型均可使用 Responses(纯生图模型除外)。HTTP 为 POST /v1/responses。推理字段是 reasoning.effort;Chat Completions 用 reasoning_effort。GPT-5.5 与 Spark 接受 none/low/medium/high/xhigh(max 会被拒绝)。GPT-5.6 与 Astra 还可使用 max。Grok 4.6 接受 low/medium/high/xhigh。

WebSocket 为 wss://api.apimonth.com/v1/responses,不是 realtime 音频。握手时带 Authorization: Bearer YOUR_API_KEY,不要放进 URL。发送 response.create,等待 response.completed,再用 previous_response_id 续写。每个 socket 同时只能有一个 in-flight create。不支持 response.cancel

复制给 AI(Responses / WebSocket)
为 ApiMonth 配置 OpenAI 兼容客户端。

HTTP Responses(当前月卡已开放的对话模型均可)
- Base URL: https://api.apimonth.com/v1
- API Key: YOUR_API_KEY
- 鉴权头: Authorization: Bearer YOUR_API_KEY
- 接口: POST https://api.apimonth.com/v1/responses
- 模型名(不要加厂商前缀): 用 GET /v1/models 返回的对话路由。例如 gpt-5.5、grok-4.6、gemini-3.8-flash-high、deepseek-flash、claude-sonnet-4-6、claude-opus-4-6。纯生图模型不能走 Responses。
- 推理字段: reasoning.effort(例如 {"reasoning":{"effort":"high"}})。Chat Completions 用 reasoning_effort。
- GPT-5.5 与 gpt-5.3-codex-spark: none / low / medium / high / xhigh(max 会被拒绝)
- GPT-5.6-* 与 gpt-6-astra: 以上再加上 max
- Grok 4.6: low / medium / high / xhigh(也接受 none/max,但 none 仍可能产生思考 token)
- 请求体上限 32MiB

curl:
curl https://api.apimonth.com/v1/responses \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"gpt-5.5","input":"hello","reasoning":{"effort":"high"}}'

Python:
from openai import OpenAI
client = OpenAI(base_url="https://api.apimonth.com/v1", api_key="YOUR_API_KEY")
r = client.responses.create(model="gpt-5.5", input="hello", reasoning={"effort":"high"})
print(r.output_text)

WebSocket(Responses WS,不是 realtime 音频)
- URL: wss://api.apimonth.com/v1/responses?model=gpt-5.5
- 只在握手头带 Authorization: Bearer YOUR_API_KEY(不要把密钥放进 URL)
- 可选 ?model=;查询参数与 JSON 同时有 model 时必须一致
- model 必须是当前月卡已开放的对话路由(与 HTTP Responses 相同)
- 发送一条文本 JSON:
{"type":"response.create","model":"gpt-5.5","input":[{"role":"user","content":"hello"}],"reasoning":{"effort":"high"}}
- 等 {"type":"response.completed",...} 后再在同一连接发下一轮
- 续写上下文用 previous_response_id = completed response.id
- 不要发送 response.cancel 或 session.update
- 每个 socket 同时只能有一个 in-flight create;并行请另开连接
- 空闲或一轮响应: 5 分钟;1024 轮后请重连
- WS 消息大小 128KiB

4. Codex / OpenCode / Pi / Claude Code

YOUR_API_KEY 换成控制台密钥。模型用 GET /v1/models 返回的当前已开放对话路由。Responses 与 Responses WebSocket 对已开放对话模型均可用。

复制给 AI(全部客户端说明)
为 ApiMonth 配置常见编程代理(OpenAI 兼容)。

共用
- Base URL: https://api.apimonth.com/v1
- API Key: YOUR_API_KEY(控制台密钥;不要放进 URL)
- 模型: 用 GET /v1/models 返回的当前月卡路由标识(不要加厂商前缀)。对话模型支持 Chat Completions、Responses、Responses WebSocket;纯生图模型不行。
- 示例: gpt-5.5、gpt-5.6-sol、grok-4.6、gemini-3.8-flash-high、deepseek-flash、claude-sonnet-4-6、claude-opus-4-6

Codex CLI / Codex App(~/.codex/config.toml)
# ~/.codex/config.toml — ApiMonth (Responses + WebSocket)
model = "gpt-5.5" # Or any admitted chat model on your active card from GET /v1/models
model_provider = "apimonth"
model_reasoning_effort = "high"
# plan_mode_reasoning_effort = "xhigh"

# Dangerous for beginners — leave commented unless you understand the risk:
# approval_policy = "never"
# sandbox_mode = "danger-full-access"

[model_providers.apimonth]
name = "ApiMonth"
base_url = "https://api.apimonth.com/v1"
experimental_bearer_token = "YOUR_API_KEY"
wire_api = "responses"
requires_openai_auth = true
supports_websockets = true

OpenCode(~/.config/opencode/opencode.json)
{
  "$schema": "https://opencode.ai/config.json",
  "provider": {
    "openai": {
      "options": {
        "baseURL": "https://api.apimonth.com/v1",
        "apiKey": "YOUR_API_KEY"
      }
    }
  },
  "model": "gpt-5.5"
}

Pi(~/.pi/agent/models.json)
{
  "providers": {
    "apimonth": {
      "baseUrl": "https://api.apimonth.com/v1",
      "api": "openai-responses",
      "apiKey": "YOUR_API_KEY",
      "models": [
        { "id": "gpt-5.5", "reasoning": true },
        { "id": "gpt-5.6-sol", "reasoning": true },
        { "id": "grok-4.6", "reasoning": true },
        { "id": "gemini-3.8-flash-high", "reasoning": true },
        { "id": "deepseek-flash", "reasoning": true },
        { "id": "claude-sonnet-4-6", "reasoning": true },
        { "id": "claude-opus-4-6", "reasoning": true }
      ]
    }
  }
}
然后在 Pi 里用 /model 选择 apimonth 下的模型。若客户端走 Responses WebSocket,建议在 /settings 把 Transport 设为 websocket-cached。

Claude Code
# Claude Code talks Anthropic Messages. Base URL is the host root, not /v1.
export ANTHROPIC_BASE_URL=https://api.apimonth.com
export ANTHROPIC_AUTH_TOKEN=YOUR_API_KEY
# Optional equivalent: export ANTHROPIC_API_KEY=YOUR_API_KEY
# Chat models: Claude, GPT, Grok (e.g. claude-sonnet-4-6, gpt-5.5, grok-4.6). Gemini is not available in Claude Code.
- 只走 Anthropic Messages:POST /v1/messages。可用 Claude、GPT、Grok 对话路由(claude-sonnet-4-6、gpt-5.5、grok-4.6 等),不要加厂商前缀。
- Gemini、DeepSeek 和纯生图模型仍走 OpenAI Chat Completions / Responses,Claude Code 不会列出或调用它们。

Codex CLI / Codex App

编辑 ~/.codex/config.toml。建议 wire_api = "responses",并开启 supports_websockets = true。密钥放进 experimental_bearer_token。除非清楚风险,否则不要打开 never-approve / 全开沙箱。ApiMonth 不支持语音 / realtime WebRTC。

~/.codex/config.toml
# ~/.codex/config.toml — ApiMonth (Responses + WebSocket)
model = "gpt-5.5" # Or any admitted chat model on your active card from GET /v1/models
model_provider = "apimonth"
model_reasoning_effort = "high"
# plan_mode_reasoning_effort = "xhigh"

# Dangerous for beginners — leave commented unless you understand the risk:
# approval_policy = "never"
# sandbox_mode = "danger-full-access"

[model_providers.apimonth]
name = "ApiMonth"
base_url = "https://api.apimonth.com/v1"
experimental_bearer_token = "YOUR_API_KEY"
wire_api = "responses"
requires_openai_auth = true
supports_websockets = true

OpenCode

创建或编辑 ~/.config/opencode/opencode.json

~/.config/opencode/opencode.json
{
  "$schema": "https://opencode.ai/config.json",
  "provider": {
    "openai": {
      "options": {
        "baseURL": "https://api.apimonth.com/v1",
        "apiKey": "YOUR_API_KEY"
      }
    }
  },
  "model": "gpt-5.5"
}

Pi

~/.pi/agent/models.json 增加 openai-responses 供应商(不要对 ApiMonth 使用 CLIProxyAPI 专用 npm 插件)。再用 /model 选择。若支持 Responses WebSocket,可在 /settings 把 Transport 设为 websocket-cached

~/.pi/agent/models.json
{
  "providers": {
    "apimonth": {
      "baseUrl": "https://api.apimonth.com/v1",
      "api": "openai-responses",
      "apiKey": "YOUR_API_KEY",
      "models": [
        { "id": "gpt-5.5", "reasoning": true },
        { "id": "gpt-5.6-sol", "reasoning": true },
        { "id": "grok-4.6", "reasoning": true },
        { "id": "gemini-3.8-flash-high", "reasoning": true },
        { "id": "deepseek-flash", "reasoning": true },
        { "id": "claude-sonnet-4-6", "reasoning": true },
        { "id": "claude-opus-4-6", "reasoning": true }
      ]
    }
  }
}

Claude Code

设置 ANTHROPIC_BASE_URL=https://api.apimonth.com(根域名,不要加 /v1)和 ANTHROPIC_AUTH_TOKEN。可用 Claude、GPT、Grok 对话模型,例如 claude-sonnet-4-6gpt-5.5grok-4.6。Gemini、DeepSeek 和纯生图不能走 Claude Code,请继续用 Chat Completions / Responses。

Claude Code 环境变量
# Claude Code talks Anthropic Messages. Base URL is the host root, not /v1.
export ANTHROPIC_BASE_URL=https://api.apimonth.com
export ANTHROPIC_AUTH_TOKEN=YOUR_API_KEY
# Optional equivalent: export ANTHROPIC_API_KEY=YOUR_API_KEY
# Chat models: Claude, GPT, Grok (e.g. claude-sonnet-4-6, gpt-5.5, grok-4.6). Gemini is not available in Claude Code.

5. 查看当前套餐的模型列表

已开放路由标识示例:

  • Grok:grok-4.6grok-4.5grok-composer-2.5-fast(对话 / Responses / Anthropic Messages;Composer 2.5 Fast 是 xAI 的快速编码模型,上游返回名为 grok-4.5);生图:grok-imagine-imagegrok-imagine-image-2.0grok-imagine-image-quality
  • GPT:gpt-6-astragpt-5.6-solgpt-5.6-terragpt-5.6-lunagpt-5.5gpt-5.3-codex-spark(对话 / Responses / Anthropic Messages);生图:gpt-image-1.5gpt-image-2
  • Grok Fast(xAI Priority Processing,service_tier: priority):grok-4.6-fastgrok-4.5-fast。同一模型、优先调度,单价为普通路由的 2 倍。xAI 官方说明:只要请求带了 priority 就按 2 倍计费,与响应返回的 tier 无关,本站同样按 2 倍结算。
  • GPT Fast(Codex 快速通道,service_tier: priority):gpt-5.6-sol-fastgpt-5.6-terra-fastgpt-5.6-luna-fastgpt-5.5-fast。同一模型、更快返回,上游按 2 倍额度计费,因此单价是普通路由的 2 倍。快速通道只由路由决定:普通路由里手写的 service_tier 会被网关移除,Fast 路由会自动带上 priority
  • Gemini:gemini-pro-agentgemini-3.1-pro-highgemini-3.1-pro-lowgemini-3.5-flashgemini-3.6-flashgemini-3.7-flashgemini-3.8-flash-high(对话 / Responses)。gemini-3.1-pro-high 是 Agent 别名。Gemini 生图未开放。
  • DeepSeek:deepseek-flash(DeepSeek V4.1 Flash,对话 / Responses)。生图未开放。
  • Claude:claude-sonnet-4-6claude-opus-4-6(对话 / Responses / Anthropic Messages)。不要加 anthropic/ 前缀。生图未开放。Claude Code 列出 Claude、GPT、Grok 对话模型,不支持 Gemini。

这不是完整或永久列表。不要加厂商前缀,也不要用展示名代替路由标识。公开 模型目录 以及 GPTGrokGeminiDeepSeekClaude 模型页可对照。查询当前可用模型:

curl
curl https://api.apimonth.com/v1/models \
  -H 'Authorization: Bearer YOUR_APIMONTH_API_KEY'

6. 生图与改图(Grok 与 GPT)

Grok Imagine 与 GPT Image 使用 POST /v1/images/generationsPOST /v1/images/edits,不能走 Chat Completions。每次一张。sizequality 会转发但不保证;实测 GPT Image 1024x1024 返回 1254×1254。改图使用 data: 图片,不能用远程 http 图链。Gemini 生图未开放。生图按目录「每张」计价(默认三折,当前折扣以官网实时模型价为准),不按上下文 token。已开始的请求保留当时快照。宣传范围不含缓存写入。

images/generations
curl https://api.apimonth.com/v1/images/generations \
  -H 'Content-Type: application/json' \
  -H 'Authorization: Bearer YOUR_APIMONTH_API_KEY' \
  -d '{"model":"gpt-image-1.5","prompt":"A red circle on white"}'

改已有 PNG(JSON)。Grok Imagine 要求源图至少 8×8。

images/edits
curl https://api.apimonth.com/v1/images/edits \
  -H 'Content-Type: application/json' \
  -H 'Authorization: Bearer YOUR_APIMONTH_API_KEY' \
  -d '{"model":"gpt-image-1.5","prompt":"Make the circle blue","images":[{"image_url":"data:image/png;base64,SOURCE_PNG_BASE64"}]}'

Python 先生成,再用本地文件改图:

Python
import base64, os
from openai import OpenAI

client = OpenAI(
    base_url="https://api.apimonth.com/v1",
    api_key=os.environ["APIMONTH_API_KEY"],
)
image = client.images.generate(
    model="grok-imagine-image",
    prompt="A red circle on white",
)
print(image.data[0].b64_json is not None)

with open("source.png", "rb") as f:
    png = base64.b64encode(f.read()).decode()
edited = client.post(
    "/images/edits",
    body={
        "model": "gpt-image-1.5",
        "prompt": "Make the circle blue",
        "images": [{"image_url": f"data:image/png;base64,{png}"}],
    },
    cast_to=object,
)

7. 余额与失败

用量默认三折,Gemini 与 GPT-5.6 Luna 八折,Grok 对话五折,生图统一 $0.10 / 张,当前折扣以官网实时模型价为准,从美元面值扣费,不一定等于上游发票单价。新积分包兑换后 30 天有效;历史卡转为不可提现的永久余额。请在账户中查看美元余额与扣费流水。

到账规则:余额与模型价用同一个 $ 单位,¥1 = $1 额度。微信/支付宝 1:1 到账(¥220 → $220);PayPal 收美元,按 1 美元 = ¥6.8 折算(钱包 $10 → $68;¥40 积分包收 $5.88)。汇率在下单时锁定。

  • 鉴权或模型权限错误:检查密钥、账户状态、余额是否有效,以及所选模型。
  • HTTP 429:阅读错误信息。可能是余额、并发或速率限制;减少并行或稍后再试。
  • 上游错误:保留错误详情与请求时间再排查,避免无控制重试。

断开客户端不一定会取消上游计算。已完成的上游用量仍可能写入扣费流水。

8. 购卡与退款

  • 可在商店用微信/支付宝,或在控制台用 PayPal 购买美元积分包,再到本站兑换。新包 30 天自兑换起算。
  • 未兑换的微信/支付宝积分包按商店原支付路径退款。
  • 已兑换不能退款,积分不可提现。

打开控制台