/v1/messages lorsque votre client utilise déjà le format Anthropic Messages.
Utilisation des outils
Déclarez les outils avectools (chacun ayant name, description, input_schema) et
contrôlez la sélection avec tool_choice. Les blocs de contenu tool_use / tool_result
multi-tours sont pris en charge.
Streaming
Définissezstream: true pour recevoir les server-sent events Anthropic :
message_start, content_block_start, content_block_delta,
content_block_stop, message_delta, message_stop.
Paramètres
Pris en charge :model, messages, max_tokens (requis), system,
temperature, top_p, top_k, stop_sequences, tools, tool_choice
et stream.
Intensité du raisonnement
Utilisez le réglage natifoutput_config.effort pour les modèles Claude compatibles. Les valeurs dépendent de la version ; voir les contrôles de raisonnement par modèle. Le réglage natif thinking reste indépendant : effort n’active pas la réflexion et ne fixe pas de budget de tokens. Si nécessaire, configurez thinking séparément selon les exigences du modèle.
max_completion_tokens, max_output_tokens et leurs équivalents natifs comptent à la fois les tokens de raisonnement et de réponse finale. effort n’est pas une limite de tokens de sortie. Le budget peut toujours être épuisé (finish_reason: "length" dans Chat Completions), laissant une réponse finale incomplète ou vide.