Skip to main content
POST
Crear una compleción de conversación

Autorizaciones

Authorization
string
header
requerido

Bearer authentication header of the form Bearer <token>, where <token> is your auth token.

Cuerpo

application/json
model
string
requerido
Ejemplo:

"gpt-5.4"

messages
object[]
requerido
temperature
number

Temperatura de muestreo.

Rango requerido: 0 <= x <= 2
top_p
number

Masa de probabilidad acumulada del muestreo por núcleo (nucleus).

Rango requerido: 0 <= x <= 1
max_tokens
integer
obsoleto

Alias de compatibilidad obsoleto de max_completion_tokens. Kimi K3 acepta ambas formas y utiliza max_completion_tokens.

Rango requerido: x >= 1
max_completion_tokens
integer

Máximo de tokens de razonamiento y respuesta final combinados. Se aplican límites por modelo; agotar el presupuesto puede dejar la respuesta incompleta. Kimi K3: 131072 (default), 1048576 (max).

Rango requerido: 1 <= x <= 1048576
reasoning_effort
enum<string>

Intensidad del razonamiento. La enumeración indica valores sintácticamente válidos, no compatibilidad con todos los modelos. Los valores no admitidos devuelven 400. Kimi K3 admite low, high y max (por defecto max); GPT-5.4/5.5 admiten none, low, medium, high, xhigh. Límites de Claude y Gemini: /es/models/chat-models. Si se omite, se mantiene el comportamiento predeterminado del modelo. Los niveles aceptados, el valor predeterminado y si el razonamiento se puede desactivar se publican en GET /v1/models dentro de capability_metadata.reasoning.

Opciones disponibles:
none,
minimal,
low,
medium,
high,
xhigh,
max
stop

Hasta 4 secuencias de parada.

n
integer

Número de candidatos a generar.

Rango requerido: x >= 1
frequency_penalty
number
Rango requerido: -2 <= x <= 2
presence_penalty
number
Rango requerido: -2 <= x <= 2
seed
integer

Semilla de muestreo lo más reproducible posible.

response_format
object

Fuerza la salida como objeto JSON o JSON Schema, p. ej. { "type": "json_object" }.

tools
object[]

Declaraciones de herramientas/funciones que el modelo puede invocar.

tool_choice

Selección de herramienta: 'auto' | 'none' | 'required' | { type: 'function', function: { name } }.

logprobs
boolean
top_logprobs
integer
Rango requerido: 0 <= x <= 20
logit_bias
object
user
string

Identificador del usuario final, para auditoría de riesgos.

stream
boolean

Cuando es true, los incrementos se devuelven en streaming mediante SSE (OpenAI chat.completion.chunk) y terminan con 'data: [DONE]'.

reasoning
object

Alias de compatibilidad de reasoning_effort. Si se indican ambas formas, los valores deben coincidir; los conflictos devuelven 400.

Respuesta

Respuesta de compleción de conversación compatible con OpenAI.

id
string
requerido
object
string
requerido
Ejemplo:

"chat.completion"

created
integer
requerido
model
string
requerido
choices
object[]
requerido
usage
object