채팅 완성 생성
OpenAI 호환 Chat Completions 엔드포인트입니다. 현재는 비스트리밍 호출을 중심으로 합니다.
인증
Bearer authentication header of the form Bearer <token>, where <token> is your auth token.
본문
"gpt-5.4"
샘플링 온도입니다.
0 <= x <= 2뉴클리어스 샘플링 누적 확률입니다.
0 <= x <= 1max_completion_tokens의 더 이상 권장되지 않는 호환 별칭입니다. APIAny는 선택한 업스트림이 새 필드를 요구할 때만 변환합니다.
x >= 1추론 과정과 최종 답변을 합친 최대 토큰 수입니다. Kimi K3 기본값은 131072이며 최대 1048576까지 지원합니다.
1 <= x <= 1048576Kimi K3 추론 강도입니다. K3는 항상 추론하며 현재 max만 지원합니다.
max 최대 4개의 정지 시퀀스입니다.
생성할 후보 응답 수입니다.
x >= 1-2 <= x <= 2-2 <= x <= 2가능한 한 재현 가능한 샘플링 시드입니다.
JSON 객체 또는 JSON Schema 출력을 강제합니다. 예: { "type": "json_object" }.
모델이 호출할 수 있는 도구/함수 선언입니다.
도구 선택: 'auto' | 'none' | 'required' | { type: 'function', function: { name } }.
0 <= x <= 20오남용 모니터링을 위한 최종 사용자 식별자입니다.
true이면 SSE로 증분 델타를 스트리밍하며(OpenAI chat.completion.chunk), 'data: [DONE]'로 종료됩니다.