支持的模型
Token101 API 当前可用的所有模型,包含定价、能力和选型建议。
概览
Token101 目前提供来自四家模型服务商的 20 余个模型,覆盖文本生成与图片生成:
- Anthropic — Claude Fable 5、Claude Opus 4.8、Claude Sonnet 4.6、Claude Haiku 4.5 等
- OpenAI — GPT 5.x 系列 + Codex 系列 + 图片生成(13 个模型)
- Google — Gemini 2.5 / 3 系列(4 个模型)
- Qwen — Qwen Max、Qwen Plus(2 个模型)
下表展示各模型的按 Token 定价(单位:USD / 1M tokens),与 API 返回的价格一致。
模型目录
| Provider | Model ID | Input $/1M | Output $/1M | Prompt Caching |
|---|---|---|---|---|
| Anthropic | claude-fable-5 | $15.00 | $75.00 | Yes |
| claude-haiku-4-5-20251001 | $1.50 | $7.50 | Yes | |
| claude-opus-4-6 | $7.50 | $37.50 | Yes | |
| claude-opus-4-7 | $15.00 | $75.00 | Yes | |
| claude-opus-4-8 | $7.50 | $37.50 | Yes | |
| claude-sonnet-4-5-20250929 | $4.50 | $22.50 | Yes | |
| claude-sonnet-4-6 | $4.50 | $22.50 | Yes | |
| OpenAI | gpt-5 | $1.875 | $15.00 | Yes |
| gpt-5.1 | $1.875 | $15.00 | Yes | |
| gpt-5.1-codex | $1.875 | $15.00 | Yes | |
| gpt-5.1-codex-max | $1.875 | $15.00 | Yes | |
| gpt-5.1-codex-mini | $1.875 | $15.00 | Yes | |
| gpt-5.2 | $2.625 | $21.00 | Yes | |
| gpt-5.2-codex | $2.625 | $21.00 | Yes | |
| gpt-5.3-codex | $2.625 | $21.00 | Yes | |
| gpt-5.3-codex-spark | $2.625 | $21.00 | Yes | |
| gpt-5.4 | $3.75 | $22.50 | Yes | |
| gpt-image-1 | $7.50 | $60.00 | No | |
| Google Gemini | gemini-2.5-flash-lite | $0.15 | $0.60 | No |
| gemini-2.5-pro | $1.875 | $15.00 | No | |
| gemini-3-flash-preview | $0.75 | $4.50 | No | |
| Qwen | qwen-max | $3.60 | $14.40 | No |
| qwen-plus | $1.20 | $3.00 | No |
如需直观浏览所有模型的能力与定价,也可以访问 模型页面。
查询可用模型
Token101 提供两个模型查询端点:
| 端点 | 认证 | 说明 |
|---|---|---|
GET /api/v1/public/models | 无需认证 | 返回所有模型及定价 |
GET /api/v1/me/models | 登录会话(Dashboard) | 为 Dashboard 模型列表提供数据;额外包含 available 字段,指示该模型当前是否可用(运行态) |
所有活跃模型对所有套餐开放(包括 Free)。me/models Dashboard 响应中的 available 字段只反映临时运行状态(例如模型维护中),不代表套餐限制。
如需可用 API Key 调用的版本,见下方 程序化获取模型列表。
程序化获取模型列表
用你的 API Key 程序化获取模型列表。GET /api/v1/models 返回 OpenAI 兼容的结构,因此已经在调用 /v1/models 的 OpenAI SDK 和工具无需改动即可使用:
curl https://token.ppthub.shop/api/v1/models \
-H "Authorization: Bearer sk-xxxx...your-api-key"响应遵循 OpenAI 的 list 结构。token101 对象是 Token101 的扩展字段,携带每个模型的服务信息:
{
"object": "list",
"data": [
{
"id": "claude-sonnet-4-5-20250929",
"object": "model",
"created": 0,
"owned_by": "anthropic",
"root": "claude-sonnet-4-5-20250929",
"permission": [],
"token101": {
"provider": "anthropic",
"display_name": "Claude Sonnet 4.5",
"status": "active",
"context_window_tokens": 200000
}
}
]
}列表只返回当前可用(活跃且运行正常)的模型——维护中的模型会从列表中省略,直到恢复。这里没有 available 字段可查:模型不在列表中,就代表它当前不可用。
长上下文定价
部分模型在请求 Token 总量超过某个较大阈值(例如 200,000 tokens)后会切换到更高的定价档位。在当前可用的模型中,没有任何模型对长上下文收取更高费率:大上下文模型(claude-opus-4-7、claude-sonnet-4-6、gpt-5.4、gpt-5.3-codex、gpt-5.2)无论提示词长短都采用统一的按 Token 定价。
每个模型的按 Token 价格(单位 USD / 1M tokens)展示在 模型页面,也可通过 GET /api/v1/models 获取。如果你的客户端会在发送大提示词前做成本估算,请从这些来源读取当前价格,而不要假设一张固定的价格表。
对 GPT-5.4,计费的输入 Token 会包含一段固定的上游服务开销,量级约为每次请求 ~4k tokens。其中大部分按折扣后的缓存读取费率计费,因此成本影响很小——但请不要假设计费输入 Token 恰好等于你实际发送的 Token 数。
Prompt Caching
支持 prompt caching 的模型可以将重复内容缓存,大幅降低后续请求的输入成本。缓存读取折扣通常为 80–90%(即缓存命中时只收取 10–20% 的输入费用)。
当前支持 prompt caching 的模型服务商:
- Anthropic — 全系列支持(Claude Opus / Sonnet / Haiku)
- OpenAI — GPT 5.x 系列(
gpt-5.4、gpt-5.3-codex、gpt-5.2)
首次写入缓存的新内容会有少量加价(输入价的 1.25 倍)——完整计价规则见 计费 → 提示缓存计费。
在 用量概览 中可以查看缓存为你节约的费用。
Reasoning Token 折扣
部分模型在推理过程中会产生 reasoning tokens(推理 token),Token101 对这些 token 提供折扣,降低推理密集型任务的成本:
| 模型系列 | 折扣比例 | 说明 |
|---|---|---|
Codex 系列(gpt-5.x-codex*) | 50% | 推理 token 只收取输出价格的一半 |
非 Codex GPT 系列(gpt-5.x) | 25% | 推理 token 收取输出价格的 75% |
| Claude / Gemini / Qwen | 无折扣 | 按标准输出价格计费 |
Reasoning tokens 是 output tokens 的子集,不会额外叠加计费。折扣从输出费率中直接扣除。
如何选型
根据使用场景选择合适的模型:
日常编程与通用任务
claude-sonnet-4-5-20250929— 代码与长上下文助手的均衡选择,支持 prompt cachinggpt-5.2— OpenAI 通用推理主力,适合需要 prompt caching 的场景
复杂推理与深度分析
claude-opus-4-8— 最强推理能力,适合能够承担更高 Token 成本的复杂分析任务gpt-5.4— OpenAI 旗舰推理模型
代码专项
gpt-5.3-codex— 代码生成专项优化,享受 50% reasoning token 折扣claude-opus-4-7— 强代码能力,具备 100 万 Token 上下文窗口,适合大型代码库
轻量与后台任务
claude-haiku-4-5-20251001— 轻量快速,免费套餐可用qwen-plus— 成本低,适合分类、抽取和后台自动化
中文对话
qwen-plus— 中文场景首选,成本较低qwen-max— 中文高质量输出
图片生成
图片生成暂不可用。集成图片端点前,请在 模型页面 查看当前状态。