Skip to main content
POST
채팅 완성 생성

인증

Authorization
string
header
필수

Bearer authentication header of the form Bearer <token>, where <token> is your auth token.

본문

application/json
model
string
필수
예시:

"gpt-5.4"

messages
object[]
필수
temperature
number

샘플링 온도입니다.

필수 범위: 0 <= x <= 2
top_p
number

뉴클리어스 샘플링 누적 확률입니다.

필수 범위: 0 <= x <= 1
max_tokens
integer
지원 중단

max_completion_tokens의 사용 중단된 호환 별칭입니다. Kimi K3는 두 형식을 모두 받고 max_completion_tokens를 사용합니다.

필수 범위: x >= 1
max_completion_tokens
integer

추론과 최종 답변을 합친 최대 토큰 수입니다. 모델별 제한이 적용되며 예산 소진 시 답변이 불완전할 수 있습니다. Kimi K3: 131072 (default), 1048576 (max).

필수 범위: 1 <= x <= 1048576
reasoning_effort
enum<string>

추론 강도입니다. 이 열거형은 문법상 허용 값이며 모든 모델의 지원을 보장하지 않습니다. 미지원 값은 400을 반환합니다. Kimi K3는 low, high, max를, GPT-5.4/5.5는 none, low, medium, high, xhigh를 지원합니다. Claude와 Gemini 제한은 /ko/models/chat-models를 참고하세요. 생략하면 모델 기본 동작을 유지합니다. 모델별 지원 값, 기본값, 추론 비활성화 가능 여부는 GET /v1/models의 capability_metadata.reasoning에 공개됩니다.

사용 가능한 옵션:
none,
minimal,
low,
medium,
high,
xhigh,
max
stop

최대 4개의 정지 시퀀스입니다.

n
integer

생성할 후보 응답 수입니다.

필수 범위: x >= 1
frequency_penalty
number
필수 범위: -2 <= x <= 2
presence_penalty
number
필수 범위: -2 <= x <= 2
seed
integer

가능한 한 재현 가능한 샘플링 시드입니다.

response_format
object

JSON 객체 또는 JSON Schema 출력을 강제합니다. 예: { "type": "json_object" }.

tools
object[]

모델이 호출할 수 있는 도구/함수 선언입니다.

tool_choice

도구 선택: 'auto' | 'none' | 'required' | { type: 'function', function: { name } }.

logprobs
boolean
top_logprobs
integer
필수 범위: 0 <= x <= 20
logit_bias
object
user
string

오남용 모니터링을 위한 최종 사용자 식별자입니다.

stream
boolean

true이면 SSE로 증분 델타를 스트리밍하며(OpenAI chat.completion.chunk), 'data: [DONE]'로 종료됩니다.

reasoning
object

reasoning_effort의 호환 별칭입니다. 두 형식을 함께 지정하면 값이 같아야 하며, 충돌 시 400을 반환합니다.

응답

OpenAI 호환 채팅 완성 응답입니다.

id
string
필수
object
string
필수
예시:

"chat.completion"

created
integer
필수
model
string
필수
choices
object[]
필수
usage
object