Crear una compleción de conversación
Endpoint de Chat Completions compatible con OpenAI. Actualmente se utiliza principalmente con llamadas sin streaming.
Autorizaciones
Bearer authentication header of the form Bearer <token>, where <token> is your auth token.
Cuerpo
"gpt-5.4"
Temperatura de muestreo.
0 <= x <= 2Masa de probabilidad acumulada del muestreo por núcleo (nucleus).
0 <= x <= 1Alias de compatibilidad obsoleto de max_completion_tokens. APIAny solo lo convierte cuando el upstream seleccionado requiere el campo nuevo.
x >= 1Máximo de tokens de razonamiento y respuesta final. Kimi K3 usa 131072 por defecto y admite hasta 1048576.
1 <= x <= 1048576Esfuerzo de razonamiento de Kimi K3. K3 siempre razona y actualmente solo admite max.
max Hasta 4 secuencias de parada.
Número de candidatos a generar.
x >= 1-2 <= x <= 2-2 <= x <= 2Semilla de muestreo lo más reproducible posible.
Fuerza la salida como objeto JSON o JSON Schema, p. ej. { "type": "json_object" }.
Declaraciones de herramientas/funciones que el modelo puede invocar.
Selección de herramienta: 'auto' | 'none' | 'required' | { type: 'function', function: { name } }.
0 <= x <= 20Identificador del usuario final, para auditoría de riesgos.
Cuando es true, los incrementos se devuelven en streaming mediante SSE (OpenAI chat.completion.chunk) y terminan con 'data: [DONE]'.