Créer une complétion de conversation
Endpoint Chat Completions compatible OpenAI. Les appels en mode non streaming sont privilégiés actuellement.
Autorisations
Bearer authentication header of the form Bearer <token>, where <token> is your auth token.
Corps
"gpt-5.4"
Température d'échantillonnage.
0 <= x <= 2Masse de probabilité cumulée pour l'échantillonnage nucleus.
0 <= x <= 1Ancien alias de compatibilité de max_completion_tokens. APIAny le convertit uniquement lorsque le canal amont sélectionné exige le nouveau champ.
x >= 1Nombre maximal de tokens pour le raisonnement et la réponse finale. Kimi K3 utilise 131072 par défaut et accepte jusqu’à 1048576.
1 <= x <= 1048576Effort de raisonnement de Kimi K3. K3 raisonne toujours et ne prend actuellement en charge que max.
max Jusqu'à 4 séquences d'arrêt.
Nombre de complétions à générer.
x >= 1-2 <= x <= 2-2 <= x <= 2Graine d'échantillonnage déterministe au mieux.
Force une sortie au format objet JSON ou JSON Schema, par ex. { "type": "json_object" }.
Déclarations d'outils/fonctions que le modèle peut appeler.
Sélection d'outil : 'auto' | 'none' | 'required' | { type: 'function', function: { name } }.
0 <= x <= 20Identifiant de l'utilisateur final, pour la surveillance des abus.
Si true, les deltas partiels sont diffusés via des server-sent events (OpenAI chat.completion.chunk), terminés par 'data: [DONE]'.