Documentation

Responses API

Mis à jour le 2026-08-29

/v1/responses est l’un des principaux points de terminaison natifs d’OpenAI. Il est recommandé d’évaluer en priorité Responses pour les nouveaux projets ; si votre client ou votre cadre utilise par défaut Chat Completions, utilisez l’appel compatible OpenAI.

Le Base URL reste https://api.rokoapi.com/v1.

Point de terminaison

POST /v1/responses

Démarrage rapide

curl https://api.rokoapi.com/v1/responses \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -d '{
    "model": "gpt-4o",
    "input": "Présentez-vous en une phrase",
    "instructions": "Vous êtes un assistant concis"
  }'
from openai import OpenAI

client = OpenAI(
    api_key="YOUR_API_KEY",
    base_url="https://api.rokoapi.com/v1",
)

response = client.responses.create(
    model="gpt-4o",
    input="Présentez-vous en une phrase",
    instructions="Vous êtes un assistant concis",
)
print(response.output_text)

Pour extraire le texte, privilégiez output_text ; lors de l’itération manuelle sur output , notez que le premier élément peut être reasoning plutôt que message.

Paramètres courants

ParamètreDescription
modelIdentifiant du modèle disponible et compatible avec Responses
inputChaîne de caractères ou tableau de messages
instructionsInstructions système (équivalent du system prompt)
max_output_tokensNombre maximal de tokens en sortie
streamFlux d’événements sémantiques
tools / tool_choiceFonctions et outils intégrés (selon le support amont)

Indicateurs de capacité du modèle

La page de chaque modèle affiche les capacités Responses configurées dans la console d’administration. Vérifiez ces indicateurs avant tout appel :

IndicateurSignification
responses-nativeLe fournisseur amont prend nativement en charge le protocole Responses
responses-compatibleLa passerelle convertit la requête vers un autre protocole amont ; seules les capacités déclarées sont garanties
structured-outputsLes sorties structurées JSON Schema sont prises en charge
previous-response-idprevious_response_id permet de poursuivre une réponse
conversation-stateL’état de conversation géré par le fournisseur amont est pris en charge
responses-compactPOST /v1/responses/compact est pris en charge
stored-responsesL’option store est prise en charge
parallel-tool-callsLes appels d’outils en parallèle sont pris en charge
max-tool-callsLa limite max_tool_calls est prise en charge

Le client ne doit pas présumer qu’une capacité absente est disponible. Les modèles en compatibilité convertie ne déclarent pas les fonctions dépendant du cycle de vie des ressources amont, comme l’état de conversation, le stockage des réponses ou la compaction.

Modèles actuellement compatibles par conversion

ModèleConversionComportements pris en charge
deepseek-v4-flashConversion bidirectionnelle entre Responses et DeepSeek Chat CompletionsTexte, fonctions, résultats d’outils et événements en streaming
deepseek-v4-proConversion bidirectionnelle entre Responses et DeepSeek Chat CompletionsTexte, fonctions, résultats d’outils et événements en streaming
glm-5.3Conversion bidirectionnelle entre Responses et Zhipu V4 Chat CompletionsTexte, fonctions, résultats d’outils et événements en streaming
glm-5.3-flashConversion bidirectionnelle entre Responses et Zhipu V4 Chat CompletionsTexte, fonctions, résultats d’outils et événements en streaming

Ces modèles utilisent une conversion de compatibilité sans état. Conservez côté client l’historique complet de la conversation et des appels d’outils, puis renvoyez-le dans le prochain input. Ils ne prennent pas en charge previous_response_id, conversation, compact ni le stockage des réponses.

Conversations multi-tours

Par défaut, gérez l’historique côté client et placez le contexte complet dans le tableau input. N’utilisez les paramètres avec état que si la page du modèle affiche explicitement previous-response-id ou conversation-state.

Sortie en flux continu

Le flux de Responses est composé d’événements sémantiques (par ex. response.output_text.delta), contrairement au comportement de Chat Completions pour choices[0].delta de Chat Completions. Après avoir défini stream: true , traitez les événements selon leur type.

Comparaison avec Chat Completions

Chat CompletionsResponses
messagesinput
Message systeminstructions
max_tokensmax_output_tokens
choices[0].message.contentoutput_text

Remarques

  • Vérifiez d’abord sur la page des modèles ou dans la documentation des modèles disponibles si le modèle cible prend en charge Responses
  • Les outils intégrés et les tâches en arrière-plan dépendent de l’amont ; une capacité non déclarée sur la page du modèle ne fait pas partie du contrat de compatibilité

Liens associés