Chat-Completion erstellen
OpenAI-kompatibler Chat-Completions-Endpunkt. Derzeit überwiegend für nicht-streamende Aufrufe vorgesehen.
Autorisierungen
Bearer authentication header of the form Bearer <token>, where <token> is your auth token.
Body
"gpt-5.4"
Sampling-Temperatur.
0 <= x <= 2Kumulierte Wahrscheinlichkeitsmasse für Nucleus-Sampling.
0 <= x <= 1Veralteter Kompatibilitätsalias für max_completion_tokens. APIAny konvertiert ihn nur, wenn der gewählte Upstream das neue Feld benötigt.
x >= 1Maximale Tokenzahl für Denkprozess und finale Antwort. Kimi K3 nutzt standardmäßig 131072 und unterstützt bis zu 1048576.
1 <= x <= 1048576Denkintensität für Kimi K3. K3 denkt immer und unterstützt derzeit nur max.
max Bis zu 4 Stoppsequenzen.
Anzahl der zu generierenden Antwortvarianten.
x >= 1-2 <= x <= 2-2 <= x <= 2Möglichst reproduzierbarer Sampling-Seed.
Erzwingt eine JSON-Objekt- oder JSON-Schema-Ausgabe, z. B. { "type": "json_object" }.
Tool-/Funktionsdeklarationen, die das Modell aufrufen kann.
Tool-Auswahl: 'auto' | 'none' | 'required' | { type: 'function', function: { name } }.
0 <= x <= 20Endnutzerkennung zur Risikoüberwachung.
Bei true werden Inkremente über SSE gestreamt (OpenAI chat.completion.chunk), abgeschlossen durch 'data: [DONE]'.