> ## Documentation Index
> Fetch the complete documentation index at: https://docs.apiany.ai/llms.txt
> Use this file to discover all available pages before exploring further.

# 对话模型

> 文本生成和多模态对话模型能力。

对话模型可以通过以下接口暴露：

* `/v1/chat/completions`
* `/v1/messages`
* `/v1beta/models/{model}:generateContent`

价格可以包含：

* 输入 token。
* 输出 token。
* 缓存输入 token。
* 最低请求积分。

上下文窗口和最大输出长度属于模型能力元数据，通常由平台静态能力注册表维护。

## 可用模型

| 模型 ID                   | 简介                                                      |
| ----------------------- | ------------------------------------------------------- |
| `gpt-5.5`               | OpenAI GPT-5.5 —— 旗舰模型，擅长高级推理、编码与复杂多步指令。                |
| `gpt-5.4`               | OpenAI GPT-5.4 —— 高能力模型，擅长高级推理、编码与 Agent 工作流。           |
| `gpt-5.4-mini`          | OpenAI GPT-5.4 mini —— 速度、质量与成本均衡，适合高并发生产。              |
| `gpt-5.4-nano`          | OpenAI GPT-5.4 nano —— GPT-5.4 中最快、最低成本档，适合简单高吞吐任务。     |
| `gpt-4o-mini`           | OpenAI GPT-4o mini —— 快速实惠的多模态模型，适合日常对话与轻量任务。           |
| `claude-opus-4-8`       | Anthropic Claude Opus 4.8 —— 前沿模型，应对最复杂的推理、编码与长文本任务。    |
| `claude-sonnet-4-6`     | Anthropic Claude Sonnet 4.6 —— 均衡型前沿模型，在生产级速度与成本下保持强推理。 |
| `gemini-3.1-pro`        | Google Gemini 3.1 Pro —— 顶级多模态模型，适合复杂推理、长上下文与高要求生产场景。   |
| `gemini-3.5-flash`      | Google Gemini 3.5 Flash —— 快速、性价比高的多模态模型，推理强、上下文大。      |
| `gemini-3.1-flash-lite` | Google Gemini 3.1 Flash Lite —— 快速且经济，推理较 2.5 代有提升。     |
| `gemini-2.5-flash-lite` | Google Gemini 2.5 Flash Lite —— 超低成本、低延迟，适合高并发日常任务。     |
| `deepseek-v4`           | DeepSeek V4 —— 推理与编码表现强，价格极具竞争力。                        |
| `deepseek-v4-flash`     | DeepSeek V4 Flash —— 延迟优化版本，适合高并发、低成本推理。                |
| `glm-5.1`               | 智谱 GLM-5.1 —— 中英双语能力出色，适合推理、编码与 Agent 应用。               |
| `minimax-m3`            | MiniMax M3 —— 适合长上下文推理、工具调用与多语言对话的大语言模型。                |
