Skip to main content
POST
Créer une complétion de conversation

Autorisations

Authorization
string
header
requis

Bearer authentication header of the form Bearer <token>, where <token> is your auth token.

Corps

application/json
model
string
requis
Exemple:

"gpt-5.4"

messages
object[]
requis
temperature
number

Température d'échantillonnage.

Plage requise: 0 <= x <= 2
top_p
number

Masse de probabilité cumulée pour l'échantillonnage nucleus.

Plage requise: 0 <= x <= 1
max_tokens
integer
obsolète

Alias de compatibilité obsolète de max_completion_tokens. Kimi K3 accepte les deux formes et utilise max_completion_tokens.

Plage requise: x >= 1
max_completion_tokens
integer

Nombre maximal de tokens de raisonnement et de réponse finale cumulés. Les limites dépendent du modèle ; un budget épuisé peut laisser la réponse incomplète. Kimi K3: 131072 (default), 1048576 (max).

Plage requise: 1 <= x <= 1048576
reasoning_effort
enum<string>

Intensité du raisonnement. Cette liste indique les valeurs syntaxiquement valides, sans garantir leur prise en charge par tous les modèles. Les valeurs non prises en charge renvoient 400. Kimi K3 accepte low, high et max (par défaut max) ; GPT-5.4/5.5 acceptent none, low, medium, high, xhigh. Limites Claude et Gemini : /fr/models/chat-models. En l’absence de valeur, le comportement par défaut du modèle est conservé. Les valeurs acceptées, la valeur par défaut et la possibilité de désactiver le raisonnement sont publiées dans GET /v1/models sous capability_metadata.reasoning.

Options disponibles:
none,
minimal,
low,
medium,
high,
xhigh,
max
stop

Jusqu'à 4 séquences d'arrêt.

n
integer

Nombre de complétions à générer.

Plage requise: x >= 1
frequency_penalty
number
Plage requise: -2 <= x <= 2
presence_penalty
number
Plage requise: -2 <= x <= 2
seed
integer

Graine d'échantillonnage déterministe au mieux.

response_format
object

Force une sortie au format objet JSON ou JSON Schema, par ex. { "type": "json_object" }.

tools
object[]

Déclarations d'outils/fonctions que le modèle peut appeler.

tool_choice

Sélection d'outil : 'auto' | 'none' | 'required' | { type: 'function', function: { name } }.

logprobs
boolean
top_logprobs
integer
Plage requise: 0 <= x <= 20
logit_bias
object
user
string

Identifiant de l'utilisateur final, pour la surveillance des abus.

stream
boolean

Si true, les deltas partiels sont diffusés via des server-sent events (OpenAI chat.completion.chunk), terminés par 'data: [DONE]'.

reasoning
object

Alias de compatibilité de reasoning_effort. Si les deux formes sont présentes, leurs valeurs doivent être identiques ; sinon, la requête renvoie 400.

Réponse

Réponse de complétion de conversation compatible OpenAI.

id
string
requis
object
string
requis
Exemple:

"chat.completion"

created
integer
requis
model
string
requis
choices
object[]
requis
usage
object