/models
模型与端点
OpenToken 支持的协议端点、如何用 /v1/models 查询实时模型列表、模型 ID 填在哪里。
查询你能用哪些模型
模型清单取决于你的套餐和当前上游状态,会变。不要依赖任何文档里写死的模型名——本站示例里的 ID 也只是占位。用这条命令拿实时列表:
终端curl -H "Authorization: Bearer sk-YOUR-API-KEY" https://otokapi.com/v1/models返回的 data 数组里每个 id 就是可以填进配置的模型 ID。
想直接看得清楚点,管道给 jq:
终端curl -s -H "Authorization: Bearer sk-YOUR-API-KEY" \
https://otokapi.com/v1/models | jq -r '.data[].id'模型 ID 填在哪
| 客户端 | 位置 | 是否必填 |
|---|---|---|
| Claude Code | ~/.claude/settings.json 的 ANTHROPIC_MODEL | 可选 |
| Codex CLI | ~/.codex/config.toml 的 model | 必填 |
Claude Code 可以不填。 不配置时它用自己的默认模型名,由 OpenToken 转发到上游,一般直接可用。想固定某个模型再去配,写法见 Claude Code 的指定模型。
Codex 必须填。 它没有默认模型,model 缺失会启动失败。
支持的协议端点
OpenToken 在同一个域名下同时说三种协议。用哪个取决于客户端,不用你选。
| 协议 | 路径 | 谁在用 |
|---|---|---|
| Anthropic Messages | /v1/messages | Claude Code |
| OpenAI Responses | /v1/responses | Codex CLI |
| OpenAI Chat Completions | /v1/chat/completions | 多数第三方客户端 |
| OpenAI Models | /v1/models | 查询可用模型列表 |
| Gemini 原生 | /v1beta/models/{model}:generateContent | Gemini 系客户端 |
不支持(请求这些路径会得到 404): /v1/embeddings、 /v1/images/generations、 /v1/completions、 /v1/messages/count_tokens
三种鉴权头都能用,效果一样:
任选其一Authorization: Bearer sk-YOUR-API-KEY
x-api-key: sk-YOUR-API-KEY
x-goog-api-key: sk-YOUR-API-KEY本站所有示例统一用 Authorization: Bearer——它最通用,Claude Code 和 Codex 默认也都发这个头。
base URL 对照
这是同时配两个客户端时最容易搞错的地方,单独列一次:
| 客户端 | 配置里填 | 客户端自己拼接 | 最终请求 |
|---|---|---|---|
| Claude Code | https://otokapi.com | /v1/messages | https://otokapi.com/v1/messages |
| Codex CLI | https://otokapi.com/v1 | /responses | https://otokapi.com/v1/responses |
记法:**Claude Code 不带 /v1,Codex 带。**填反了会得到 404。
用不了的能力
下面这些路径会返回 404,OpenToken 不提供:
/v1/embeddings—— 文本向量化/v1/images/generations—— 图像生成/v1/completions—— 旧版补全接口/v1/messages/count_tokens—— token 计数
依赖这些能力的工具需要另外找服务,Claude Code 和 Codex 的正常使用不涉及它们。
速率限制
| 项目 | 默认值 |
|---|---|
| 每分钟请求数(RPM) | 60 |
| 突发(burst) | 10 |
| 并发连接数 | 5 |
额度按美元等价值计量,实际扣减按上游模型的官方每千 token 定价乘以套餐速率倍率折算。碰到 429 见排错手册。