Responses API
通过 Token101 使用 OpenAI Responses API 端点,支持 Agent 工作流和结构化输出。
概述
Token101 支持 OpenAI Responses API(/api/v1/responses),这是 OpenAI Codex CLI 和其他 Agent 导向工具使用的同一协议。Responses API 专为多步骤工作流设计——模型可以在一次请求-响应周期内推理、调用工具并生成结构化输出。
Responses API 是透传端点——Token101 负责认证、计费和限流,然后将请求原样转发给上游服务商。你选择的模型所支持的所有 Responses API 功能(工具调用、结构化输出、推理)都可以通过 Token101 直接使用,无需任何修改。
端点
POST https://token.ppthub.shop/api/v1/responses认证
在 Authorization header 中携带你的 Token101 API key:
Authorization: Bearer sk-your-token101-api-key快速示例
curl
curl https://token.ppthub.shop/api/v1/responses \
--request POST \
--header "Content-Type: application/json" \
--header "Authorization: Bearer $TOKEN101_API_KEY" \
--data '{
"model": "gpt-5.2",
"input": "机器人三定律是什么?"
}'Python (OpenAI SDK)
import os
from openai import OpenAI
client = OpenAI(
api_key=os.environ["TOKEN101_API_KEY"],
base_url="https://token.ppthub.shop/api/v1",
)
response = client.responses.create(
model="gpt-5.2",
input="机器人三定律是什么?",
)
print(response.output_text)Node.js / TypeScript (OpenAI SDK)
import OpenAI from 'openai';
const client = new OpenAI({
apiKey: process.env.TOKEN101_API_KEY!,
baseURL: 'https://token.ppthub.shop/api/v1',
});
const response = await client.responses.create({
model: 'gpt-5.2',
input: '机器人三定律是什么?',
});
console.log(response.output_text);请求字段
Responses API 接受标准 OpenAI Responses API 请求格式。关键字段:
| 字段 | 类型 | 说明 |
|---|---|---|
model | string | 必填。模型 ID(如 gpt-5.2、gpt-5.3-codex) |
input | string 或 array | 必填。用户输入——简单字符串或结构化消息数组 |
instructions | string | 可选。系统级指令 |
max_output_tokens | integer | 可选。响应最大 token 数(默认:4096) |
stream | boolean | 可选。启用流式传输(默认:false) |
tools | array | 可选。模型可调用的工具定义 |
temperature | number | 可选。采样温度 |
top_p | number | 可选。核采样参数 |
完整字段参考请见 API Reference。
流式传输
设置 stream: true 以 Server-Sent Events (SSE) 方式接收生成中的响应:
response = client.responses.create(
model="gpt-5.2",
input="用简单的话解释量子计算。",
stream=True,
)
for event in response:
if event.type == "response.output_text.delta":
print(event.delta, end="", flush=True)流式事件遵循 OpenAI Responses API 格式——response.created、response.output_item.added、response.output_text.delta、response.completed 等。
支持的模型
以下模型支持 Responses API 端点:
| 模型 | 模型 ID | 适用场景 |
|---|---|---|
| GPT-5.4 | gpt-5.4 | 通用推理,支持 prompt caching |
| GPT-5.2 | gpt-5.2 | 均衡性能 |
| GPT-5.3 Codex | gpt-5.3-codex | 代码生成与编辑 |
完整列表(含非 OpenAI 模型)请见 Supported Models。
工作原理
当你向 /api/v1/responses 发送请求时:
- Token101 验证你的 API key,检查限流和计费状态
- 请求体由 Token101 的路由层原样转发给上游模型服务商
- 上游服务商原生处理 Responses API 请求
- 响应(流式或非流式)通过 Token101 回传给你的客户端
Token101 完整保留 Responses API 契约——工具调用、结构化输出、推理 token 和流式传输在支持的模型上均可正常使用。
与其他端点的对比
| 功能 | /api/v1/messages | /api/v1/chat/completions | /api/v1/responses |
|---|---|---|---|
| 协议 | Anthropic Messages | OpenAI Chat Completions | OpenAI Responses |
| SDK | Anthropic SDK | OpenAI SDK | OpenAI SDK |
| Base URL | https://token.ppthub.shop/api | https://token.ppthub.shop/api/v1 | https://token.ppthub.shop/api/v1 |
| 适用场景 | Anthropic 生态 | 对话应用 | Agent 工作流、Codex CLI |
| 工具调用 | ✅ Anthropic 格式 | ✅ OpenAI 格式 | ✅ OpenAI 格式 |
| 流式传输 | ✅ | ✅ | ✅ |
已知限制
- 服务端工具执行:Token101 的 Responses API 是透传适配器。服务端工具(如网页搜索、文件搜索)依赖上游服务商的原生支持。
- 模型可用性:目前仅 OpenAI 模型原生支持 Responses API。其他模型(Claude、Gemini、Qwen)请使用 Messages 或 Chat Completions 端点。
- 推理 token 计费:通过 Responses API 产生的推理 token 与其他端点一样享受自动折扣(Codex 系列 50% 折扣,非 Codex 的 GPT 25% 折扣,均作用于输出费率)。详见 计费。
故障排除
401 Unauthorized
检查 API key 是否已设置且有效。详见 Authentication。
/api/v1/responses 返回 404 Not Found
确认 base URL 正确:
# 正确
export OPENAI_BASE_URL="https://token.ppthub.shop/api/v1"
# 错误 — 不要在 base URL 中包含 /responses
export OPENAI_BASE_URL="https://token.ppthub.shop/api/v1/responses"400 Invalid model
指定的模型可能不支持 Responses API。请使用上方"支持的模型"表格中列出的模型 ID。
模型返回意外格式
部分旧版 OpenAI 模型可能不完全支持 Responses API 格式。尝试使用较新的模型,如 gpt-5.2 或 gpt-5.3-codex。
下一步
- Codex CLI 接入 — 通过 Token101 使用 Codex CLI
- Supported Models — 完整可用模型列表
- 流式传输 — 所有端点的流式传输指南
- API Reference — 完整端点文档