Документация
Responses API
Обновлено: 2026-08-29
/v1/responses является одним из основных нативных эндпоинтов OpenAI. Официально рекомендуется для новых проектов. Если ваш клиент или фреймворк по умолчанию использует Chat Completions, используйте OpenAI-совместимый вызов.
Base URL остается https://api.rokoapi.com/v1.
Эндпоинты
POST /v1/responses
Быстрый старт
curl https://api.rokoapi.com/v1/responses \
-H "Content-Type: application/json" \
-H "Authorization: Bearer YOUR_API_KEY" \
-d '{
"model": "gpt-4o",
"input": "Представьтесь одним предложением",
"instructions": "Вы — лаконичный помощник"
}'
from openai import OpenAI
client = OpenAI(
api_key="YOUR_API_KEY",
base_url="https://api.rokoapi.com/v1",
)
response = client.responses.create(
model="gpt-4o",
input="Представьтесь одним предложением",
instructions="Вы — лаконичный помощник",
)
print(response.output_text)
Для получения текста рекомендуется использовать output_text из SDK; при ручном переборе output_textобращайте внимание на то, что первым элементом может быть output а не reasoning а не message.
Часто используемые параметры
| Параметр | Описание |
|---|---|
model | ID доступной модели, поддерживающей Responses |
input | Строка или массив сообщений |
instructions | Системная инструкция (аналог system prompt) |
max_output_tokens | Максимальное количество выходных токенов |
stream | Семантический поток событий |
tools / tool_choice | Функции и встроенные инструменты (в зависимости от поддержки провайдера) |
Метки возможностей модели
На странице модели отображаются возможности Responses, настроенные в панели администратора. Перед запросом проверьте следующие метки:
| Метка | Значение |
|---|---|
responses-native | Провайдер нативно поддерживает протокол Responses |
responses-compatible | Шлюз преобразует запрос в другой протокол провайдера; гарантируются только заявленные возможности |
structured-outputs | Поддерживается структурированный вывод по JSON Schema |
previous-response-id | Поддерживается продолжение ответа через previous_response_id |
conversation-state | Поддерживается состояние диалога, управляемое провайдером |
responses-compact | Поддерживается POST /v1/responses/compact |
stored-responses | Поддерживается параметр store |
parallel-tool-calls | Поддерживаются параллельные вызовы инструментов |
max-tool-calls | Поддерживается ограничение max_tool_calls |
Клиент не должен считать доступными возможности, которые не указаны на странице. Модели с преобразованием протокола не заявляют функции, зависящие от жизненного цикла ресурсов провайдера, включая состояние диалога, хранение ответов и compaction.
Текущие модели с преобразованием совместимости
| Модель | Преобразование | Поддерживаемое поведение |
|---|---|---|
deepseek-v4-flash | Двустороннее преобразование Responses и DeepSeek Chat Completions | Текст, функции, результаты инструментов и потоковые события |
deepseek-v4-pro | Двустороннее преобразование Responses и DeepSeek Chat Completions | Текст, функции, результаты инструментов и потоковые события |
glm-5.3 | Двустороннее преобразование Responses и Zhipu V4 Chat Completions | Текст, функции, результаты инструментов и потоковые события |
glm-5.3-flash | Двустороннее преобразование Responses и Zhipu V4 Chat Completions | Текст, функции, результаты инструментов и потоковые события |
Эти модели используют преобразование без состояния. Храните полную историю диалога и вызовов инструментов на стороне клиента и повторно передавайте ее в следующем input. Они не поддерживают previous_response_id, conversation, compact и хранение ответов.
Многоходовый диалог
По умолчанию храните историю на стороне клиента и передавайте полный контекст в массиве input. Используйте параметры с состоянием только тогда, когда на странице модели явно указана метка previous-response-id или conversation-state.
Потоковая передача
Потоковая передача в Responses представляет собой семантические события (например, response.output_text.delta), в отличие от поведения Chat Completions для choices[0].delta в Chat Completions. После установки stream: true обработывайте данные по типу события.
Сравнение с Chat Completions
| Chat Completions | Responses |
|---|---|
messages | input |
| Системное сообщение | instructions |
max_tokens | max_output_tokens |
choices[0].message.content | output_text |
Примечание
- Сначала проверьте на странице моделей или в документации доступных моделей, поддерживает ли целевая модель Responses.
- Встроенные инструменты и фоновые задачи зависят от провайдера; возможности, не заявленные на странице модели, не входят в договор совместимости.