/v1/messages。
工具调用
用tools(每个含 name、description、input_schema)声明工具,用
tool_choice 控制选择;支持多轮 tool_use / tool_result 内容块。
流式
设置stream: true 按 Anthropic SSE 事件流返回:
message_start、content_block_start、content_block_delta、
content_block_stop、message_delta、message_stop。
参数
支持:model、messages、max_tokens(必填)、system、temperature、
top_p、top_k、stop_sequences、tools、tool_choice、stream。
思考强度
支持的 Claude 模型使用原生output_config.effort,可用值取决于版本,详见各模型思考控制。原生 thinking 独立保留:effort 不会自动开启思考,也不会设置 token 预算。如需配置 thinking,请单独按模型要求设置。
max_completion_tokens、max_output_tokens 及原生对应字段限制的是思考与最终答案共用的 token 总量。effort 不是输出 token 上限;请求仍可能耗尽预算(Chat Completions 返回 finish_reason: "length"),导致最终答案不完整或为空。