Документация

Responses API

Обновлено: 2026-08-29

/v1/responses является одним из основных нативных эндпоинтов OpenAI. Официально рекомендуется для новых проектов. Если ваш клиент или фреймворк по умолчанию использует Chat Completions, используйте OpenAI-совместимый вызов.

Base URL остается https://api.rokoapi.com/v1.

Эндпоинты

POST /v1/responses

Быстрый старт

curl https://api.rokoapi.com/v1/responses \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -d '{
    "model": "gpt-4o",
    "input": "Представьтесь одним предложением",
    "instructions": "Вы — лаконичный помощник"
  }'
from openai import OpenAI

client = OpenAI(
    api_key="YOUR_API_KEY",
    base_url="https://api.rokoapi.com/v1",
)

response = client.responses.create(
    model="gpt-4o",
    input="Представьтесь одним предложением",
    instructions="Вы — лаконичный помощник",
)
print(response.output_text)

Для получения текста рекомендуется использовать output_text из SDK; при ручном переборе output_textобращайте внимание на то, что первым элементом может быть output а не reasoning а не message.

Часто используемые параметры

ПараметрОписание
modelID доступной модели, поддерживающей Responses
inputСтрока или массив сообщений
instructionsСистемная инструкция (аналог system prompt)
max_output_tokensМаксимальное количество выходных токенов
streamСемантический поток событий
tools / tool_choiceФункции и встроенные инструменты (в зависимости от поддержки провайдера)

Метки возможностей модели

На странице модели отображаются возможности Responses, настроенные в панели администратора. Перед запросом проверьте следующие метки:

МеткаЗначение
responses-nativeПровайдер нативно поддерживает протокол Responses
responses-compatibleШлюз преобразует запрос в другой протокол провайдера; гарантируются только заявленные возможности
structured-outputsПоддерживается структурированный вывод по JSON Schema
previous-response-idПоддерживается продолжение ответа через previous_response_id
conversation-stateПоддерживается состояние диалога, управляемое провайдером
responses-compactПоддерживается POST /v1/responses/compact
stored-responsesПоддерживается параметр store
parallel-tool-callsПоддерживаются параллельные вызовы инструментов
max-tool-callsПоддерживается ограничение max_tool_calls

Клиент не должен считать доступными возможности, которые не указаны на странице. Модели с преобразованием протокола не заявляют функции, зависящие от жизненного цикла ресурсов провайдера, включая состояние диалога, хранение ответов и compaction.

Текущие модели с преобразованием совместимости

МодельПреобразованиеПоддерживаемое поведение
deepseek-v4-flashДвустороннее преобразование Responses и DeepSeek Chat CompletionsТекст, функции, результаты инструментов и потоковые события
deepseek-v4-proДвустороннее преобразование Responses и DeepSeek Chat CompletionsТекст, функции, результаты инструментов и потоковые события
glm-5.3Двустороннее преобразование Responses и Zhipu V4 Chat CompletionsТекст, функции, результаты инструментов и потоковые события
glm-5.3-flashДвустороннее преобразование Responses и Zhipu V4 Chat CompletionsТекст, функции, результаты инструментов и потоковые события

Эти модели используют преобразование без состояния. Храните полную историю диалога и вызовов инструментов на стороне клиента и повторно передавайте ее в следующем input. Они не поддерживают previous_response_id, conversation, compact и хранение ответов.

Многоходовый диалог

По умолчанию храните историю на стороне клиента и передавайте полный контекст в массиве input. Используйте параметры с состоянием только тогда, когда на странице модели явно указана метка previous-response-id или conversation-state.

Потоковая передача

Потоковая передача в Responses представляет собой семантические события (например, response.output_text.delta), в отличие от поведения Chat Completions для choices[0].delta в Chat Completions. После установки stream: true обработывайте данные по типу события.

Сравнение с Chat Completions

Chat CompletionsResponses
messagesinput
Системное сообщениеinstructions
max_tokensmax_output_tokens
choices[0].message.contentoutput_text

Примечание

  • Сначала проверьте на странице моделей или в документации доступных моделей, поддерживает ли целевая модель Responses.
  • Встроенные инструменты и фоновые задачи зависят от провайдера; возможности, не заявленные на странице модели, не входят в договор совместимости.

Полезные ссылки