Skip to main content
Utilisez /v1/messages lorsque votre client utilise déjà le format Anthropic Messages.
APIAny.AI traite la requête et renvoie une réponse compatible Anthropic.

Utilisation des outils

Déclarez les outils avec tools (chacun ayant name, description, input_schema) et contrôlez la sélection avec tool_choice. Les blocs de contenu tool_use / tool_result multi-tours sont pris en charge.

Streaming

Définissez stream: true pour recevoir les server-sent events Anthropic : message_start, content_block_start, content_block_delta, content_block_stop, message_delta, message_stop.

Paramètres

Pris en charge : model, messages, max_tokens (requis), system, temperature, top_p, top_k, stop_sequences, tools, tool_choice et stream.

Intensité du raisonnement

Utilisez le réglage natif output_config.effort pour les modèles Claude compatibles. Les valeurs dépendent de la version ; voir les contrôles de raisonnement par modèle. Le réglage natif thinking reste indépendant : effort n’active pas la réflexion et ne fixe pas de budget de tokens. Si nécessaire, configurez thinking séparément selon les exigences du modèle.
Les limites comme max_completion_tokens, max_output_tokens et leurs équivalents natifs comptent à la fois les tokens de raisonnement et de réponse finale. effort n’est pas une limite de tokens de sortie. Le budget peut toujours être épuisé (finish_reason: "length" dans Chat Completions), laissant une réponse finale incomplète ou vide.