文档

Responses API

更新于 2026-07-21

/v1/responses 是 OpenAI 的原生主力端点之一。官方推荐新项目优先评估 Responses;若你的客户端或框架默认走 Chat Completions,请用 OpenAI 兼容调用

Base URL 仍为 https://api.rokoapi.com/v1

端点

POST /v1/responses

快速开始

curl https://api.rokoapi.com/v1/responses \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -d '{
    "model": "gpt-4o",
    "input": "用一句话介绍你自己",
    "instructions": "你是一个简洁的助手"
  }'
from openai import OpenAI

client = OpenAI(
    api_key="YOUR_API_KEY",
    base_url="https://api.rokoapi.com/v1",
)

response = client.responses.create(
    model="gpt-4o",
    input="用一句话介绍你自己",
    instructions="你是一个简洁的助手",
)
print(response.output_text)

取文本优先用 SDK 的 output_text;手工遍历 output 时注意首项可能是 reasoning 而非 message

常用参数

参数说明
model已上线且支持 Responses 的模型 ID
input字符串或消息数组
instructions系统指令(类似 system prompt)
max_output_tokens最大输出 token
stream语义化事件流
tools / tool_choice函数与内置工具(视上游支持)

多轮对话

请在客户端自行维护历史,把完整上下文放入 input 数组。不要依赖网关侧长期会话状态;具体字段是否透传以上游与渠道配置为准。

流式输出

Responses 流式是语义化事件(如 response.output_text.delta),与 Chat Completions 的 choices[0].delta 不同。设置 stream: true 后按事件类型处理。

与 Chat Completions 对照

Chat CompletionsResponses
messagesinput
system 消息instructions
max_tokensmax_output_tokens
choices[0].message.contentoutput_text

注意

  • 请先在 模型页 或已上线模型文档确认目标模型是否支持 Responses
  • 内置工具、后台任务等能力依赖上游;网关透传结果以实测为准

相关链接