> ## Documentation Index
> Fetch the complete documentation index at: https://docs.apiyi.com/llms.txt
> Use this file to discover all available pages before exploring further.

# 当下热门模型（保持更新）

> 查看支持的400+AI模型详细信息，推荐给你当下热门、好用的 AI 大模型。

API易 支持 400+ 主流 AI 模型，本页面提供详细的模型信息、定价和使用说明。

<Note>
  **企业级专业稳定的AI大模型API中转站**\
  本站均为官方源头转发，价格八折（叠加充值加赠和汇率优势），聚合各种优秀大模型。不限速，不惧封号，按量计费，长期可靠服务。
</Note>

## 🔥 当前推荐模型

以下为当前稳定供给的热门模型，完整模型列表和实时价格请访问 [API易控制台定价页面](https://www.apiyi.com/account/pricing)，也可查看站内 [模型价格总览](/models)。

<Warning>
  **模型升级建议**：我们推荐优先使用最新模型以获得最佳性能，但请注意：

  1. **上线初期可能不稳定**：新模型刚发布时，原厂商算力可能不足，导致响应慢、超时或偶发错误，通常数天至数周后趋于稳定
  2. **注意参数兼容性**：新模型可能新增或变更参数（如 `max_completion_tokens` 替代 `max_tokens`），升级前请检查 API 参数是否兼容老模型
  3. **务必先测试再上线**：在将新模型用于生产环境前，务必在测试环境充分验证，确保输出质量和接口兼容性符合预期
</Warning>

<Info>
  表格中上下文一栏标注为「—」的，表示厂商暂未公布明确数值，实际以控制台与官方文档为准。价格均为每 100 万 tokens 的定价（输入/输出），可叠加充值加赠优惠。
</Info>

## 模型分类

### 🤖 OpenAI 系列

#### 🆕 最新模型

| 模型名称 | 模型ID | 上下文长度 | 特点 | 推荐场景 |
| - | - | - | - | - |
| **GPT-6 Astra** 🔥 | `gpt-6-astra` | 1.05M | 6 代旗舰，主打电脑操作与长程 Agent，推理力度五档（新增 `xhigh` / `max`），Terminal-Bench 4.0 **57.9%**、ScreenSpot-Pro 92.7%；\$10/\$50 | 顶级 Agent、电脑操作、科研 |
| **GPT-6 Sol** 🔥 | `gpt-6-sol` | 1.05M | 6 代中档，价格约为 5.6 Sol 的一半且为长期价，128K 输出；\$2/\$10 | 写功能、审代码、数据分析 |
| **GPT-6 Luna** 🔥 | `gpt-6-luna` | 1.05M | 6 代轻量档，\$0.10/\$0.50，适合摘要、抽取等大批量任务 | 高并发、成本敏感 |
| **GPT-5.5 Pro** | `gpt-5.5-pro` | 1M | 深度推理专用，Terminal-Bench 2.0 82.7%；**仅 `/v1/responses` 端点 + SVIP 分组**，价格高昂 | 顶级推理、科研（专业需求） |
| **chat-latest** | `chat-latest` | 400K | 去版本号别名，始终指向最新 ChatGPT Instant 模型 | 快速写作、对话 |

<Note>
  **GPT-6 系列供给**：`default` / `svip` 官转分组四项计费与官网一致，Chat Completions 与 Responses 双端点实测可用（含函数调用），从 5.6 迁移只需改 `model` 字段；Astra 另有 `Codex_Reverse` 分组按 0.5 折扣。Sol / Luna 单次上下文超过 272K 会整单进入更高一档计费。详见 [GPT-6 Astra 上线说明](/news/gpt-6-astra-launch) 与 [GPT-6 Sol / Luna 上线说明](/news/gpt-6-sol-luna-launch)。
</Note>

<Warning>
  **GPT Pro 系列（如 `gpt-5.5-pro`、`gpt-5.4-pro`）使用须知**：

  1. **仅支持 `/v1/responses` 端点**：不能走 `/v1/chat/completions`，调用前请确认 SDK / 代码已切换到 Responses API
  2. **价格高昂**：单次调用可能消耗数美金，且仅对 SVIP 分组开放，避免 Default 分组误用
  3. **非专业需求不建议使用**：日常任务用 GPT-6 Sol 或 GPT-5.6 Sol 即可，Pro 仅适合对推理深度有极致要求的科研、顶级任务
</Warning>

#### ✅ 稳定/经典系列

| 模型名称 | 模型ID | 上下文长度 | 特点 | 推荐场景 |
| - | - | - | - | - |
| **GPT-5.6 Sol** ⭐ | `gpt-5.6-sol` | 1M | 5.6 代旗舰，Terminal-Bench 2.1 88.8%，`gpt-5.6` 别名指向它；\$4/\$20（9/3 起降价） | 前沿智能、Agent 任务 |
| **GPT-5.6 Terra** | `gpt-5.6-terra` | 1M | 5.6 代主力档，\$2/\$12 | 日常开发 |
| **GPT-5.6 Luna** | `gpt-5.6-luna` | 1M | 5.6 代轻量档，\$0.20/\$1.20；256K 以上超长上下文表现较弱 | 高并发、成本敏感 |
| **GPT-5.5** ⭐ | `gpt-5.5` | 1M | 上代旗舰，SWE-bench Verified 88.7%，`xhigh` 推理档 | 复杂智能体、专业工作流 |
| **GPT-5.4** ⭐ | `gpt-5.4` | 1M | 上代主力，原生计算机操控，GDPval 83% | 复杂智能体、专业工作流 |
| **GPT-5.4 Mini** | `gpt-5.4-mini` | 1M | 轻量高性价比 | 平衡性能与成本 |
| **GPT-5.2** | `gpt-5.2` | 400K | GDPval 70.9% 超越专业人士 | 编程规划、结构化任务 |
| **GPT-5.1** | `gpt-5.1` | 128K | 智能与速度平衡，SWE-bench 76.3%，24h 缓存 | 综合应用、编程 |
| **GPT-5.1 Codex** | `gpt-5.1-codex-high` | 128K | Codex 编程专用系列（含 medium / mini 档） | 编程、智能体任务 |
| **GPT-5** | `gpt-5` | 128K | 经典旗舰稳定版 | 顶级推理、复杂任务 |
| **GPT-5 Mini** | `gpt-5-mini` | 128K | GPT-5 轻量版，性能优异 | 平衡性能与成本 |
| **o3** | `o3` | 200K | 推理模型，已大幅降价，性价比极高 | 复杂推理、数学、编程 |
| **o4-mini** | `o4-mini` | 200K | 轻量级推理模型 | 编程任务 |
| **GPT-4.1** | `gpt-4.1` | 128K | 速度快，老牌主力模型 | 综合应用 |
| **GPT-4o** | `gpt-4o` | 128K | 综合能力平衡，多模态支持 | 通用场景 |
| **GPT-4o Mini** | `gpt-4o-mini` | 128K | 轻量快速版本 | 快速响应 |

<Warning>
  **GPT-5 及以上系列使用注意事项**：

  1. 温度参数 `temperature` 必须设置为 1（只支持 1）
  2. 使用 `max_completion_tokens` 替代 `max_tokens`
  3. 不要传递 `top_p` 参数
</Warning>

<Info>
  **图像和视频生成模型**已移至专属页面，请访问 [图像与视频生成模型](/api-capabilities/image-video-models) 查看完整列表和定价。
</Info>

### 🎭 Claude 系列 (Anthropic)

#### 🆕 最新模型

| 模型名称 | 模型ID | 上下文长度 | 特点 | 推荐场景 |
| - | - | - | - | - |
| **Claude Opus 5.5** 🔥 | `claude-opus-5-5` | 1M | Terminal-Bench 4.0 **66.4%** 超过 Fable 5.1（55.8%），输出速度比 Opus 5 快 30%+；\$4/\$20，比 Opus 5 更便宜 | 顶级编程、复杂智能体 |
| **Claude Opus 5.5 Thinking** 🔥 | `claude-opus-5-5-thinking` | 1M | Opus 5.5 显式思考版本 | 顶级推理任务 |
| **Claude Fable 5.1** 🔥 | `claude-fable-5-1` | 1M | Mythos 级旗舰同价升级，Terminal-Bench-Science 24.7% → **52.6%**，含 `-thinking` 变体；\$10/\$50 | 顶级任务、长任务异步执行 |
| **Claude Sonnet 5** | `claude-sonnet-5` | — | SWE-bench Verified **85.2%**、Terminal-Bench 2.1 80.4%，AWS 纯官转高缓存命中；\$2/\$10 | 编程首选、智能体开发 |
| **Claude Opus 5** | `claude-opus-5` | 1M | Frontier Bench v0.1 43.3%，128K 输出，思考默认开启 + effort 五档，含 `-thinking` 变体；\$5/\$25 | 顶级编程、复杂智能体 |

<Warning>
  **Opus 5.5 / Fable 5.1 的破坏性变更**：强制工具调用（`tool_choice` 为 `any` / `tool`）直接报 400，思考块与模型绑定、编辑历史消息会让思考块失效；Opus 5.5 另有**思考无法关闭**、effort 默认从 `high` 降为 `medium`。从旧版迁移前请先看 [Opus 5.5 上线说明](/news/claude-opus-5-5-launch) 与 [Fable 5.1 上线说明](/news/claude-fable-5-1-launch)。
</Warning>

<Warning>
  **Fable 5 / Fable 5.1 / Mythos 5 的 30 天数据保留合规**：因模型能力先进，Bedrock 与 Anthropic 对高风险滥用执行额外检查，这两款模型的**输入与输出将保留 30 天**用于严重滥用检测，默认仅自动化安全系统访问，人工审查仅在系统标记潜在危害时发生。保留发生在 AWS / Anthropic 官方侧，API易 为纯透明代理、自身不保留数据；**其他 Claude 模型不受影响**。详见 [Fable 5.1 上线说明](/news/claude-fable-5-1-launch)。
</Warning>

#### ✅ 稳定/经典系列

| 模型名称 | 模型ID | 上下文长度 | 特点 | 推荐场景 |
| - | - | - | - | - |
| **Claude Fable 5** | `claude-fable-5` | — | 上代 Mythos 级旗舰，\$10/\$50 | 顶级任务 |
| **Claude Opus 4.8** | `claude-opus-4-8` | 1M (Beta) | Agentic 编程 69.2%，支持动态工作流 | 顶级编程、复杂智能体 |
| **Claude Opus 4.7** ⭐ | `claude-opus-4-7` | 1M (Beta) | 编程基准较 4.6 +13%，工具错误降至 1/3，含 `-thinking` 变体 | 顶级编程、复杂智能体 |
| **Claude Opus 4.6** | `claude-opus-4-6` | 1M (Beta) | Terminal-Bench 2.0 登顶，128K 输出 | 顶级编程、复杂智能体 |
| **Claude Sonnet 4.6** ⭐ | `claude-sonnet-4-6` | 1M (Beta) | 性能媲美 Opus 4.5，性价比极高 | 编程、智能体开发 |
| **Claude Opus 4.5** | `claude-opus-4-5-20251101` | 200K | SWE-bench 80.9%，价格降至前代 1/3 | 复杂编程、顶级推理 |
| **Claude Sonnet 4.5** | `claude-sonnet-4-5-20250929` | 200K | 世界级编码模型，SWE-bench 77.2%，含 `-thinking` 变体 | 代码生成、智能体开发 |
| **Claude Haiku 4.5** ⭐ | `claude-haiku-4-5-20251001` | 200K | 高性价比编码模型，SWE-bench 73.3%，速度 2 倍 | 实时聊天、结对编程 |
| **Claude 4 Sonnet** | `claude-sonnet-4-20250514` | 200K | 老牌稳定版本 | 代码生成、分析 |

<Note>
  **最新推荐**：Claude Opus 5.5 多数编程与知识工作基准超过 Fable 5.1，价格却比 Opus 5 还低（\$4/\$20），官方称典型负载综合成本比 Opus 5 低约 40%。Sonnet 5 性能逼近 Opus 4.8 而更快更省。**稳定首选**：Opus 4.7 / Sonnet 4.6 经过充分验证，适合已上线的生产工作流；Haiku 4.5 速度快 2 倍、性价比高。
</Note>

### 🌟 Google Gemini 系列

#### 🆕 最新模型

| 模型名称 | 模型ID | 上下文长度 | 特点 | 推荐场景 |
| - | - | - | - | - |
| **Gemini 3.8 Flash** 🔥 | `gemini-3.8-flash` | — | 谷歌 9/2 推出的新一版 Flash，官方规格尚未公布；150 例双协议实测与 3.7 逐项对齐；\$0.75/\$3.75 与 3.7 同价平迁 | 编程、Agent、性价比 |
| **Gemini 3.7 Flash** 🔥 | `gemini-3.7-flash` | 1M | 64K 输出，Terminal-bench 2.1 **85.8%**、DeepSWE 65.3%；\$0.75/\$3.75 为官方限时价（至 2026-12-31，之后 \$1.50/\$7.50） | 编程、Agent、多模态 |
| **Gemini 3.1 Pro Preview** | `gemini-3.1-pro-preview` | 1M | ARC-AGI-2 77.1%（3 Pro 的 2 倍+），谷歌最强推理模型 | 复杂推理、多模态分析 |
| **Gemini 3.1 Flash Lite** | `gemini-3.1-flash-lite` | 1M | GA 版，比 2.5 Flash 快 64%，\$0.25/\$1.50 | 高并发、大批量、低成本 |

<Warning>
  **注意**：Gemini 3 Pro Preview 已于 2026 年 3 月 9 日停止服务，请迁移至 Gemini 3.1 Pro Preview 或 Gemini 3.8 Flash。
</Warning>

#### ✅ 稳定/经典系列

| 模型名称 | 模型ID | 上下文长度 | 特点 | 推荐场景 |
| - | - | - | - | - |
| **Gemini 3.6 Flash** | `gemini-3.6-flash` | 1M | 多模态 Flash，默认开思考（四档可控），原生工具全放通；\$1.50/\$7.50 | 编程、Agent、多模态 |
| **Gemini 3.5 Flash-Lite** | `gemini-3.5-flash-lite` | 1M | 默认零思考、约 2 秒极速响应；\$0.30/\$2.50 | 高并发、低延迟、批量 |
| **Gemini 3.5 Flash** | `gemini-3.5-flash` | 1M | Terminal-Bench 2.1 76.2%；\$1.50/\$9.00 | 编程 |
| **Gemini 3 Flash Preview** | `gemini-3-flash-preview` | 1M | SWE-bench 78%，含 thinking / nothinking 变体 | 编程、性价比 |
| **Gemini 2.5 Pro** ⭐ | `gemini-2.5-pro` | 2M | 正式版，编程优势，多模态能力强 | 长文本、编程、多模态 |
| **Gemini 2.5 Flash** ⭐ | `gemini-2.5-flash` | 1M | 速度快，成本低，正式版 | 快速响应场景 |
| **Gemini 2.5 Flash Lite** | `gemini-2.5-flash-lite` | 1M | 超轻量版本，更快更便宜 | 大批量简单任务 |

<Note>
  **最新推荐**：Gemini 3.8 Flash 与 3.7 Flash 同价，编码与 Agent 能力较 3.6 Flash 大幅提升、价格只有一半，Gemini 原生格式与 OpenAI 兼容格式双端点可用，详见 [3.8 Flash 上线说明](/news/gemini-3-8-flash-launch) 与 [3.7 Flash 上线说明](/news/gemini-3-7-flash-launch)。高并发低延迟场景可选 [3.5 Flash-Lite](/api-capabilities/gemini-3-5-flash-lite/overview)。**稳定首选**：Gemini 2.5 Pro（2M 超长上下文）和 Gemini 2.5 Flash 适合已定型的生产环境。
</Note>

### 🚀 xAI Grok 系列

#### 🆕 最新模型

| 模型名称 | 模型ID | 上下文长度 | 特点 | 推荐场景 |
| - | - | - | - | - |
| **Grok 4.7** 🔥 | `grok-4.7` | 500K | 换用 2.1T 新基座，Terminal-Bench 4.0 18% → **33%**、DeepSWE 73%；\$2/\$6 与上代同价，但单任务输出 tokens 约为 4.6 的两倍 | 编程 Agent、长任务 |
| **Grok 4.6** 🔥 | `grok-4.6` | 500K | Artificial Analysis 智能指数 **61**，追平 GPT-5.6 Sol Max；\$2/\$6 | 综合任务、编程 |
| **Grok 4.5** | `grok-4.5` | 500K | 与 Cursor 联合训练，Agentic 工具调用单项登顶，输出 token 效率高；\$2/\$6 | 编程、Agent 任务 |
| **Grok 4.3** | `grok-4.3` | 1M | Intelligence Index 53、τ²-Bench 98%、IFBench 81%；\$1.25/\$2.50，200K 后阶梯翻倍 | 复杂推理、综合任务 |
| **Grok 4 Fast Reasoning** | `grok-4-fast-reasoning` | 200K | 推理模式，显示思考过程，降价 93%+ | 复杂推理任务 |
| **Grok Code Fast 1** | `grok-code-fast-1` | 256K | SWE-bench 70.8%，高速生成 | 代码生成、智能体编程 |

#### ✅ 稳定/经典系列

| 模型名称 | 模型ID | 上下文长度 | 特点 | 推荐场景 |
| - | - | - | - | - |
| **Grok 4.20 Beta** | `grok-4.20-beta` | 标准 | 含推理 / 多智能体 / 非推理多个变体 | 综合任务 |
| **Grok 4** | `grok-4` | 标准 | 官方版本，可选 `grok-4-all` 原生联网 | 综合任务、实时信息 |
| **Grok 3** | `grok-3` | 标准 | 官方稳定版本 | 日常使用 |
| **Grok 3 All** | `grok-3-all` | 标准 | 原生联网增强版 | 新闻资讯、市场分析 |
| **Grok 3 Mini** | `grok-3-mini` | 标准 | 带推理能力的小模型 | 轻量任务 |

<Info>
  **按任务估算 Grok 成本**：4.5 / 4.6 / 4.7 单价相同（\$2/\$6），但 Grok 4.7 完成同一批任务的输出 tokens 约为 4.6 的两倍，按任务算的实际花费会上升；Grok 4.5 输出最省。超过 200K tokens 的请求按官方第二档费率计费。详见 [Grok 4.7 上线说明](/news/grok-4-7-launch)。
</Info>

### 🔍 DeepSeek 系列

| 模型名称 | 模型ID | 上下文长度 | 特点 | 推荐场景 |
| - | - | - | - | - |
| **DeepSeek V4 Pro** 🔥 | `deepseek-v4-pro` | 1M | 1.6T/49B 激活，SWE-Verified 80.6 接近 Claude/Gemini，Hybrid Attention | 复杂推理、编程、智能体 |
| **DeepSeek V4.1 Flash** 🔥 | `deepseek-v4.1-flash` | — | DeepSeek 最新 Flash，OpenAI 与 Anthropic 双格式可用（Anthropic 格式走 `ClaudeCode` 分组），缓存命中低至 \$0.006；\$0.30/\$1.20 | 高并发、编程、Agent |
| **DeepSeek V3.2** | `deepseek-v3.2` | 128K | 性能比肩 GPT-5，工具调用融入推理 | 复杂推理、编程 |
| **DeepSeek V3.1** ⭐ | `deepseek-v3-1-250821` | 128K | 混合推理模式，Think/Non-Think 双模式 | 智能推理、编程 |
| **DeepSeek R1** | `deepseek-r1` | 64K | 推理模型 | 数学、推理 |
| **DeepSeek V3** | `deepseek-v3` | 128K | 综合能力强 | 通用场景 |

### 🐘 国产模型系列

#### 智谱 AI (GLM)

**🆕 最新**：GLM-5.3、GLM-5.3-Flash | **✅ 稳定/经典**：GLM-5.2、GLM-5.1、GLM-5

| 模型名称 | 模型ID | 上下文长度 | 特点 | 推荐场景 |
| - | - | - | - | - |
| **GLM-5.3** 🔥 | `glm-5.3` | 1M | 沿用 5.2 的 753B MoE 基座只扩后训练，Z.ai Code Bench 比 5.2 提升 **50%**；\$1.40/\$4.396 | 项目级编程、长程智能体 |
| **GLM-5.3-Flash** 🔥 | `glm-5.3-flash` | 1M | GLM-5 系列首个原生多模态（文本/图片/视频/文件），Terminal-Bench 2.1 **84.3** 逼近 Claude Opus 4.8；\$0.15/\$0.50 | 多模态、高性价比编程 |
| **GLM-5.2** | `glm-5.2` | 1M | 阿里云官转直连，AA 智能指数 **51** 开源第一，Terminal-Bench 2.1 81.0、SWE-bench Pro 62.1；\$1.142/\$3.997 | 项目级编程、长程智能体 |
| **GLM-5.1** ⭐ | `glm-5.1` | 200K | SWE-Bench Pro 58.4，744B MoE，MIT 开源 | 复杂编程、智能体 |
| **GLM-5** | `glm-5` | 200K | 744B 参数（40B 激活），编程对齐 Claude Opus 4.5 | 复杂编程、系统工程 |
| **GLM-4.6** | `glm-4.6` | 200K | 代码与推理增强版，稳定可靠 | 编程、推理、智能体 |
| **GLM-4.5** | `glm-4.5` | 128K | 标准版本，综合能力强 | 通用场景 |

<Info>
  **GLM-5.3 系列要点**：

  * 旗舰 GLM-5.3 与 5.2 同基座、只扩后训练，编程与网络安全能力（ExploitBench 54.4%，5.2 为 24.4%）大幅提升
  * GLM-5.3-Flash 是 320B-A18B 混合稀疏 + 线性注意力的原生多模态模型，价格约为旗舰的 1/10
  * 定价与智谱官网逐项一致，`default` / `svip` 分组可用；长任务建议把 timeout 调到 600 秒以上，详见 [GLM-5.3 上线说明](/news/glm-5-3-launch)
</Info>

#### 阿里通义千问 (Qwen)

**🆕 最新**：Qwen3.8-Max | **✅ 稳定/经典**：Qwen3.7 系列、Qwen3.6 系列、Qwen Max / Plus / Turbo

| 模型名称 | 模型ID | 上下文长度 | 特点 | 推荐场景 |
| - | - | - | - | - |
| **Qwen3.8-Max** 🔥 | `qwen3.8-max` | 1M | 2.4T 参数稀疏 MoE，131K 输出，GPQA Diamond **92.6**、PaperBench 93.0，原生图片/视频输入；思考默认开启，暂不支持 `/v1/responses`；\$1.65/\$4.95 | 智能体、多模态、长文本 |
| **Qwen3.7-Max** | `qwen3.7-max` | 1M | AA Intelligence Index 56.6 全球前五、国产第一，agent 长程 35 小时自主任务；\$1.714/\$5.142 | 智能体、多语言、长文本 |
| **Qwen3.7-Plus** | `qwen3.7-plus` | 1M | 3.7 代性价比档，\$0.60/\$2.40 | 综合任务、批量处理 |
| **Qwen3.6-Max-Preview** | `qwen3.6-max-preview` | 1M | 6 项编程基准登顶（AIME 2025 93%、GPQA 86%） | 编程、推理 |
| **Qwen3.6-Plus** | `qwen3.6-plus` | 1M | MoE 72B / 18B 激活，Terminal-Bench 61.6，始终开启思维链 | 编程智能体 |
| **Qwen3.6-Flash** | `qwen3.6-flash` | 1M | 35B-A3B MoE，多模态，\$0.17/\$1.02 | 高性价比、多模态 |
| **Qwen3.6 开源双模** | `qwen3.6-27b` / `qwen3.6-35b-a3b` | 1M | API易 官转托管开源权重，免去租 GPU 与运维推理框架 | 私有化替代、成本敏感 |
| **Qwen Max** | `qwen-max` | 32K | 老牌稳定版本 | 综合任务 |
| **Qwen Plus** | `qwen-plus` | 32K | 增强版本 | 性价比场景 |
| **Qwen Turbo** | `qwen-turbo` | 32K | 快速版本 | 低延迟场景 |

#### Moonshot Kimi 系列

**🆕 最新**：Kimi K3 | **✅ 稳定/经典**：Kimi K2.6、K2.5、K2

| 模型名称 | 模型ID | 上下文长度 | 特点 | 推荐场景 |
| - | - | - | - | - |
| **Kimi K3** 🔥 | `kimi-k3` | 1M | 2.8 万亿参数开源旗舰，Kimi Delta Attention，LMArena Frontend Code Arena **登顶第一**，GPQA Diamond 93.5%、Terminal-Bench 2.1 88.3%；\$3/\$15 全区间统一计价，缓存命中低至 \$0.30 | 前端编程、长程智能体 |
| **Kimi K2.7 Code** | `kimi-k2.7-code` | 256K | 编程专用档，\$0.95/\$3.99 | 编程任务 |
| **Kimi K2.6** ⭐ | `kimi-k2.6` | 256K | 1T MoE / 32B 激活，SWE-Bench Pro 58.6；\$0.60/\$2.40 约官网 6 折 | 编程、智能体 |
| **Kimi K2.5** | `kimi-k2.5` | 200K | 原生多模态，Agent Swarm 100 智能体协作 | 多模态、智能体 |
| **Kimi K2 正式版** | `kimi-k2-250711` | 200K | 火山引擎官方合作，稳定性强 | 生产环境 |

<Info>
  **Kimi K3 使用要点**：

  * 精确 1,048,576 tokens 上下文，**全区间统一计价**，长代码库 / 长文档可整体塞入，不担心跨档涨价
  * 最大输出默认 131,072、最高可调至 1,048,576 tokens；思考模式常开满档，请预留输出预算
  * 自动上下文缓存，命中部分输入按 \$0.30/1M 计费（未命中价的 1/10），多轮对话收益显著
</Info>

#### 字节跳动 Seed 系列

**🆕 最新**：Seed 2.1 Turbo | **✅ 稳定/经典**：Seed 2.0 Pro / Lite / Mini

| 模型名称 | 模型ID | 上下文长度 | 特点 | 推荐场景 |
| - | - | - | - | - |
| **Seed 2.1 Turbo** 🔥 | `dola-seed-2-1-turbo-260628` | 256K | 高频生产型文本模型，Chat Completions 与 Responses **双端点 15/15 用例实测通过**，思考开关可控 + 隐式/显式双层缓存；\$0.50/\$2.50 | 高并发生产、批量抽取 |
| **Seed 2.0 Pro** | `seed-2-0-pro-260328` | — | AIME 2025 98.3、Codeforces 3020，Agent 能力出色；\$0.50/\$3.00 | 复杂推理、编程 |
| **Seed 2.0 Lite** | `seed-2-0-lite-260428` | — | 高性价比企业级，支持图片/视频/文本多模态输入；\$0.25/\$2.00 | 大规模生产场景 |
| **Seed 2.0 Mini** | `seed-2-0-mini-260428` | — | 超轻量档，\$0.10/\$0.40 | 大批量简单任务 |

<Warning>
  **Seed 2.1 Turbo 默认开启深度思考**：不传任何参数时，一句话的简单问题也会先输出数百 tokens 的思考内容（实测一句话自我介绍消耗 444 输出 tokens，其中思考 409），且思考内容按输出 tokens 正常计费。高频短问答请把 `thinking: {"type": "disabled"}` 作为基线配置。详见 [接入文档](/api-capabilities/dola-seed-2-1-turbo/overview)。
</Warning>

### 🌐 MiniMax 系列

**🆕 最新**：MiniMax-M3 | **✅ 稳定/经典**：MiniMax-M2.7、M2.5

| 模型名称 | 模型ID | 上下文长度 | 特点 | 推荐场景 |
| - | - | - | - | - |
| **MiniMax-M3** 🔥 | `MiniMax-M3` | 1M | 首个集前沿 Agent 编程、百万上下文与原生多模态于一身的开源旗舰，SWE-Bench Pro **59.0** 反超 GPT-5.5 与 Gemini 3.1 Pro，MSA 稀疏注意力把长上下文推理成本降至前代 1/20 | 编程、智能体、长上下文 |
| **MiniMax-M2.7** | `MiniMax-M2.7` | 标准 | 10B 参数 SWE-bench Pro 56.22%，自进化能力，最小 Tier-1 模型 | 编程、智能体 |
| **MiniMax-M2.5** | `MiniMax-M2.5` | 标准 | 230B（10B 激活），SWE-bench 80.2%，极致性价比 | 编程、智能体、办公自动化 |

<Info>
  **MiniMax-M3 计费说明**：

  * 采用阶梯计费，0-512K 区间 \$0.30 输入 / \$1.20 输出（每 1M tokens），超出部分按更高档单价计费
  * 注意模型名大小写：`MiniMax-M3`（同系列 `MiniMax-M2.7-highspeed` 等亦区分大小写）
  * 做百万级长上下文任务前请预估好成本
</Info>

<Note>模型价格与官网对齐，且可能随官网调整；上表仅供参考，具体以顶部导航「模型价格」栏目为准：[模型价格](/models/index)。</Note>

## 💰 定价说明

### 计费方式

* **按量计费**：根据实际使用的 Token 数量计费
* **无最低消费**：充多少用多少
* **余额有效期**：自充值之日起 365 天内有效，再次充值自动重置（详见[充值活动说明](/faq/recharge-promotions)）
* **实时扣费**：每次调用后立即从余额扣除费用

### 价格优势

* 官方源头转发，价格略有优势
* 批量使用可联系客服获取更优惠价格
* 新用户注册后账号自带 \$0.05 试用额度，可直接跑通接入验证

### 查看实时价格

访问 [API易控制台定价页面](https://www.apiyi.com/account/pricing) 查看所有模型的最新价格，或查看站内 [模型价格总览](/models)。

## 🛠️ 使用建议

### 模型选择指南

**编程开发**

* 顶级性能：Claude Opus 5.5（Terminal-Bench 4.0 66.4%）、GPT-6 Astra（Terminal-Bench 4.0 57.9%）、Claude Sonnet 5（SWE-bench 85.2%）、Kimi K3
* 高性价比：GPT-6 Sol（约 5.6 代半价）、Gemini 3.8 Flash / 3.7 Flash、GLM-5.3 / 5.3-Flash、MiniMax-M3、DeepSeek V4.1 Flash
* 备选：Grok 4.7 / 4.6、Qwen3.8-Max、GPT-5.6 Sol、Kimi K2.6

**文本创作**

* 首选：GPT-6 Sol、Claude Opus 5.5、Claude Sonnet 5、Gemini 3.8 Flash
* 备选：chat-latest、GPT-5.6 Terra、Claude Sonnet 4.6、GLM-5.3

**快速响应**

* 首选：Gemini 3.5 Flash-Lite（默认零思考、约 2 秒）、Claude Haiku 4.5（速度快 2 倍）、GPT-6 Luna
* 备选：Gemini 3.1 Flash Lite、Gemini 2.5 Flash、Seed 2.1 Turbo（需显式关闭思考）

**长文本处理**

* 超长上下文：Gemini 2.5 Pro（2M）、Kimi K3（1M 全区间统一计价）、MiniMax-M3（1M）、GLM-5.3（1M）、GPT-6 系列（1.05M）、Claude Opus 5.5（1M）
* 注意：部分模型超过一定长度会按更高档阶梯计费（如 Grok 4.5 / 4.6 / 4.7 超 200K、GPT-6 Sol / Luna 超 272K、MiniMax-M3 超 512K），长任务前请预估成本

**图像生成**

* 最新推荐：gpt-image-2.5-flare / gpt-image-2.5-sunburst（2026-09 上线，原生 4K、size/quality 精确控制，与 gpt-image-2 同价，速度 / 编辑精度分别更强）、Nano Banana Pro（4K 高清，最佳文本渲染）
* 高性价比：Nano Banana 2（\$0.055/张，按量低至 \$0.025）、Nano Banana Lite（约 4 秒出图，\$0.025/张）
* 专业设计：Seedream 5.0 Pro（\$0.12/次，交互式编辑 + 最多 10 张参考图）、Seedream 5.0 Lite（\$0.035/张）
* 快速出图：Seedream 5.0 Flash（2026-09 上线，\$0.018/张，15–20 秒出图，中文排版准确）
* 最便宜：gpt-image-2-all（官逆，\$0.03/张）

**视频生成**

* 官转首选：VEO 3.1 Official（按次 \$0.3 / \$1.2，4/6/8 秒，原生同步音轨）
* 国产主力：Seedance 2.5 与 2.0 系列（2.5 / 标准 / fast / mini 四档）、Wan2.7、HappyHorse 1.1
* 注意：Sora 2 相关通道已下线，请改用上述通道，详见 [图像与视频生成模型](/api-capabilities/image-video-models)

**联网搜索**

* 原生联网：Grok 4 All、Grok 3 All（无需工具调用）
* 搜索 grounding：Gemini 3.8 Flash / 3.7 Flash / 3.6 Flash / 3.5 Flash-Lite

### 成本优化建议

1. **分级使用**：简单任务用便宜模型，复杂任务用高级模型
2. **测试优化**：先用小模型测试，确定需求后再用大模型
3. **批量处理**：大量相似任务可以选择 Luna / Lite / Mini 档位
4. **缓存复用**：善用各家的上下文缓存（Kimi K3、Seed 2.1 Turbo、Claude 系列命中后输入价可低至 1/10）
5. **关闭不必要的思考**：部分模型默认开启深度思考（如 Seed 2.1 Turbo、Gemini Flash 系列、Qwen3.8-Max），高频短问答显式关闭可同时省钱提速

## 🔗 相关资源

* [模型价格总览](/models) - 全量模型与实时价格
* [模型对比测试](https://imagen.apiyi.com/) - 图像生成效果对比
* [实时价格查询](https://www.apiyi.com/account/pricing) - 最新定价信息
* [API 文档](/api-manual) - 详细接口说明
* [快速开始](/getting-started) - 集成指南

<Note>
  模型列表持续更新中，我们会及时添加最新发布的优秀模型。最新上新动态请关注 [网站公告](/changelog)。如需使用特定模型或有批量需求，请联系客服。
</Note>


This documentation is built and hosted on [Mintlify](https://mintlify.com), a developer documentation platform.