Skip to main content
POST
Chat-Completion erstellen

Autorisierungen

Authorization
string
header
erforderlich

Bearer authentication header of the form Bearer <token>, where <token> is your auth token.

Body

application/json
model
string
erforderlich
Beispiel:

"gpt-5.4"

messages
object[]
erforderlich
temperature
number

Sampling-Temperatur.

Erforderlicher Bereich: 0 <= x <= 2
top_p
number

Kumulierte Wahrscheinlichkeitsmasse für Nucleus-Sampling.

Erforderlicher Bereich: 0 <= x <= 1
max_tokens
integer
veraltet

Veralteter Kompatibilitätsalias für max_completion_tokens. Kimi K3 akzeptiert beide Formen und verwendet max_completion_tokens.

Erforderlicher Bereich: x >= 1
max_completion_tokens
integer

Maximale Tokenzahl für Reasoning und endgültige Antwort zusammen. Modellabhängige Grenzen gelten; bei erschöpftem Budget kann die Antwort unvollständig sein. Kimi K3: 131072 (default), 1048576 (max).

Erforderlicher Bereich: 1 <= x <= 1048576
reasoning_effort
enum<string>

Reasoning-Stärke. Die Aufzählung enthält syntaktisch gültige Werte, garantiert aber keine Unterstützung durch jedes Modell. Nicht unterstützte Werte ergeben 400. Kimi K3 unterstützt low, high und max (Standard: max); GPT-5.4/5.5 unterstützen none, low, medium, high, xhigh. Claude- und Gemini-Grenzen: /de/models/chat-models. Ohne Angabe bleibt der Modellstandard erhalten. Die unterstützten Werte, der Standard und die Abschaltbarkeit je Modell stehen in GET /v1/models unter capability_metadata.reasoning.

Verfügbare Optionen:
none,
minimal,
low,
medium,
high,
xhigh,
max
stop

Bis zu 4 Stoppsequenzen.

n
integer

Anzahl der zu generierenden Antwortvarianten.

Erforderlicher Bereich: x >= 1
frequency_penalty
number
Erforderlicher Bereich: -2 <= x <= 2
presence_penalty
number
Erforderlicher Bereich: -2 <= x <= 2
seed
integer

Möglichst reproduzierbarer Sampling-Seed.

response_format
object

Erzwingt eine JSON-Objekt- oder JSON-Schema-Ausgabe, z. B. { "type": "json_object" }.

tools
object[]

Tool-/Funktionsdeklarationen, die das Modell aufrufen kann.

tool_choice

Tool-Auswahl: 'auto' | 'none' | 'required' | { type: 'function', function: { name } }.

logprobs
boolean
top_logprobs
integer
Erforderlicher Bereich: 0 <= x <= 20
logit_bias
object
user
string

Endnutzerkennung zur Risikoüberwachung.

stream
boolean

Bei true werden Inkremente über SSE gestreamt (OpenAI chat.completion.chunk), abgeschlossen durch 'data: [DONE]'.

reasoning
object

Kompatibilitätsalias für reasoning_effort. Werden beide Formen angegeben, müssen die Werte übereinstimmen; Konflikte ergeben 400.

Antwort

OpenAI-kompatible Chat-Completion-Antwort.

id
string
erforderlich
object
string
erforderlich
Beispiel:

"chat.completion"

created
integer
erforderlich
model
string
erforderlich
choices
object[]
erforderlich
usage
object