文档
Responses API
更新于 2026-07-21
/v1/responses 是 OpenAI 的原生主力端点之一。官方推荐新项目优先评估 Responses;若你的客户端或框架默认走 Chat Completions,请用 OpenAI 兼容调用。
Base URL 仍为 https://api.rokoapi.com/v1。
端点
POST /v1/responses
快速开始
curl https://api.rokoapi.com/v1/responses \
-H "Content-Type: application/json" \
-H "Authorization: Bearer YOUR_API_KEY" \
-d '{
"model": "gpt-4o",
"input": "用一句话介绍你自己",
"instructions": "你是一个简洁的助手"
}'
from openai import OpenAI
client = OpenAI(
api_key="YOUR_API_KEY",
base_url="https://api.rokoapi.com/v1",
)
response = client.responses.create(
model="gpt-4o",
input="用一句话介绍你自己",
instructions="你是一个简洁的助手",
)
print(response.output_text)
取文本优先用 SDK 的 output_text;手工遍历 output 时注意首项可能是 reasoning 而非 message。
常用参数
| 参数 | 说明 |
|---|---|
model | 已上线且支持 Responses 的模型 ID |
input | 字符串或消息数组 |
instructions | 系统指令(类似 system prompt) |
max_output_tokens | 最大输出 token |
stream | 语义化事件流 |
tools / tool_choice | 函数与内置工具(视上游支持) |
多轮对话
请在客户端自行维护历史,把完整上下文放入 input 数组。不要依赖网关侧长期会话状态;具体字段是否透传以上游与渠道配置为准。
流式输出
Responses 流式是语义化事件(如 response.output_text.delta),与 Chat Completions 的 choices[0].delta 不同。设置 stream: true 后按事件类型处理。
与 Chat Completions 对照
| Chat Completions | Responses |
|---|---|
messages | input |
| system 消息 | instructions |
max_tokens | max_output_tokens |
choices[0].message.content | output_text |
注意
- 请先在 模型页 或已上线模型文档确认目标模型是否支持 Responses
- 内置工具、后台任务等能力依赖上游;网关透传结果以实测为准