Skip to main content
API易 支持 400+ 主流 AI 模型,本页面提供详细的模型信息、定价和使用说明。
企业级专业稳定的AI大模型API中转站
本站均为官方源头转发,价格八折(叠加充值加赠和汇率优势),聚合各种优秀大模型。不限速,不惧封号,按量计费,长期可靠服务。

🔥 当前推荐模型

以下为当前稳定供给的热门模型,完整模型列表和实时价格请访问 API易控制台定价页面,也可查看站内 模型价格总览。
模型升级建议:我们推荐优先使用最新模型以获得最佳性能,但请注意:
  1. 上线初期可能不稳定:新模型刚发布时,原厂商算力可能不足,导致响应慢、超时或偶发错误,通常数天至数周后趋于稳定
  2. 注意参数兼容性:新模型可能新增或变更参数(如 max_completion_tokens 替代 max_tokens),升级前请检查 API 参数是否兼容老模型
  3. 务必先测试再上线:在将新模型用于生产环境前,务必在测试环境充分验证,确保输出质量和接口兼容性符合预期
表格中上下文一栏标注为「—」的,表示厂商暂未公布明确数值,实际以控制台与官方文档为准。价格均为每 100 万 tokens 的定价(输入/输出),可叠加充值加赠优惠。

模型分类

🤖 OpenAI 系列

🆕 最新模型

GPT-6 系列供给:default / svip 官转分组四项计费与官网一致,Chat Completions 与 Responses 双端点实测可用(含函数调用),从 5.6 迁移只需改 model 字段;Astra 另有 Codex_Reverse 分组按 0.5 折扣。Sol / Luna 单次上下文超过 272K 会整单进入更高一档计费。详见 GPT-6 Astra 上线说明 与 GPT-6 Sol / Luna 上线说明。
GPT Pro 系列(如 gpt-5.5-pro、gpt-5.4-pro)使用须知:
  1. 仅支持 /v1/responses 端点:不能走 /v1/chat/completions,调用前请确认 SDK / 代码已切换到 Responses API
  2. 价格高昂:单次调用可能消耗数美金,且仅对 SVIP 分组开放,避免 Default 分组误用
  3. 非专业需求不建议使用:日常任务用 GPT-6 Sol 或 GPT-5.6 Sol 即可,Pro 仅适合对推理深度有极致要求的科研、顶级任务

✅ 稳定/经典系列

GPT-5 及以上系列使用注意事项:
  1. 温度参数 temperature 必须设置为 1(只支持 1)
  2. 使用 max_completion_tokens 替代 max_tokens
  3. 不要传递 top_p 参数
图像和视频生成模型已移至专属页面,请访问 图像与视频生成模型 查看完整列表和定价。

🎭 Claude 系列 (Anthropic)

🆕 最新模型

Opus 5.5 / Fable 5.1 的破坏性变更:强制工具调用(tool_choice 为 any / tool)直接报 400,思考块与模型绑定、编辑历史消息会让思考块失效;Opus 5.5 另有思考无法关闭、effort 默认从 high 降为 medium。从旧版迁移前请先看 Opus 5.5 上线说明 与 Fable 5.1 上线说明。
Fable 5 / Fable 5.1 / Mythos 5 的 30 天数据保留合规:因模型能力先进,Bedrock 与 Anthropic 对高风险滥用执行额外检查,这两款模型的输入与输出将保留 30 天用于严重滥用检测,默认仅自动化安全系统访问,人工审查仅在系统标记潜在危害时发生。保留发生在 AWS / Anthropic 官方侧,API易 为纯透明代理、自身不保留数据;其他 Claude 模型不受影响。详见 Fable 5.1 上线说明。

✅ 稳定/经典系列

最新推荐:Claude Opus 5.5 多数编程与知识工作基准超过 Fable 5.1,价格却比 Opus 5 还低($4/$20),官方称典型负载综合成本比 Opus 5 低约 40%。Sonnet 5 性能逼近 Opus 4.8 而更快更省。稳定首选:Opus 4.7 / Sonnet 4.6 经过充分验证,适合已上线的生产工作流;Haiku 4.5 速度快 2 倍、性价比高。

🌟 Google Gemini 系列

🆕 最新模型

注意:Gemini 3 Pro Preview 已于 2026 年 3 月 9 日停止服务,请迁移至 Gemini 3.1 Pro Preview 或 Gemini 3.8 Flash。

✅ 稳定/经典系列

最新推荐:Gemini 3.8 Flash 与 3.7 Flash 同价,编码与 Agent 能力较 3.6 Flash 大幅提升、价格只有一半,Gemini 原生格式与 OpenAI 兼容格式双端点可用,详见 3.8 Flash 上线说明 与 3.7 Flash 上线说明。高并发低延迟场景可选 3.5 Flash-Lite。稳定首选:Gemini 2.5 Pro(2M 超长上下文)和 Gemini 2.5 Flash 适合已定型的生产环境。

🚀 xAI Grok 系列

🆕 最新模型

✅ 稳定/经典系列

按任务估算 Grok 成本:4.5 / 4.6 / 4.7 单价相同($2/$6),但 Grok 4.7 完成同一批任务的输出 tokens 约为 4.6 的两倍,按任务算的实际花费会上升;Grok 4.5 输出最省。超过 200K tokens 的请求按官方第二档费率计费。详见 Grok 4.7 上线说明。

🔍 DeepSeek 系列

🐘 国产模型系列

智谱 AI (GLM)

🆕 最新:GLM-5.3、GLM-5.3-Flash | ✅ 稳定/经典:GLM-5.2、GLM-5.1、GLM-5
GLM-5.3 系列要点:
  • 旗舰 GLM-5.3 与 5.2 同基座、只扩后训练,编程与网络安全能力(ExploitBench 54.4%,5.2 为 24.4%)大幅提升
  • GLM-5.3-Flash 是 320B-A18B 混合稀疏 + 线性注意力的原生多模态模型,价格约为旗舰的 1/10
  • 定价与智谱官网逐项一致,default / svip 分组可用;长任务建议把 timeout 调到 600 秒以上,详见 GLM-5.3 上线说明

阿里通义千问 (Qwen)

🆕 最新:Qwen3.8-Max | ✅ 稳定/经典:Qwen3.7 系列、Qwen3.6 系列、Qwen Max / Plus / Turbo

Moonshot Kimi 系列

🆕 最新:Kimi K3 | ✅ 稳定/经典:Kimi K2.6、K2.5、K2
Kimi K3 使用要点:
  • 精确 1,048,576 tokens 上下文,全区间统一计价,长代码库 / 长文档可整体塞入,不担心跨档涨价
  • 最大输出默认 131,072、最高可调至 1,048,576 tokens;思考模式常开满档,请预留输出预算
  • 自动上下文缓存,命中部分输入按 $0.30/1M 计费(未命中价的 1/10),多轮对话收益显著

字节跳动 Seed 系列

🆕 最新:Seed 2.1 Turbo | ✅ 稳定/经典:Seed 2.0 Pro / Lite / Mini
Seed 2.1 Turbo 默认开启深度思考:不传任何参数时,一句话的简单问题也会先输出数百 tokens 的思考内容(实测一句话自我介绍消耗 444 输出 tokens,其中思考 409),且思考内容按输出 tokens 正常计费。高频短问答请把 thinking: {"type": "disabled"} 作为基线配置。详见 接入文档。

🌐 MiniMax 系列

🆕 最新:MiniMax-M3 | ✅ 稳定/经典:MiniMax-M2.7、M2.5
MiniMax-M3 计费说明:
  • 采用阶梯计费,0-512K 区间 $0.30 输入 / $1.20 输出(每 1M tokens),超出部分按更高档单价计费
  • 注意模型名大小写:MiniMax-M3(同系列 MiniMax-M2.7-highspeed 等亦区分大小写)
  • 做百万级长上下文任务前请预估好成本
模型价格与官网对齐,且可能随官网调整;上表仅供参考,具体以顶部导航「模型价格」栏目为准:模型价格。

💰 定价说明

计费方式

  • 按量计费:根据实际使用的 Token 数量计费
  • 无最低消费:充多少用多少
  • 余额有效期:自充值之日起 365 天内有效,再次充值自动重置(详见充值活动说明)
  • 实时扣费:每次调用后立即从余额扣除费用

价格优势

  • 官方源头转发,价格略有优势
  • 批量使用可联系客服获取更优惠价格
  • 新用户注册后账号自带 $0.05 试用额度,可直接跑通接入验证

查看实时价格

访问 API易控制台定价页面 查看所有模型的最新价格,或查看站内 模型价格总览。

🛠️ 使用建议

模型选择指南

编程开发
  • 顶级性能:Claude Opus 5.5(Terminal-Bench 4.0 66.4%)、GPT-6 Astra(Terminal-Bench 4.0 57.9%)、Claude Sonnet 5(SWE-bench 85.2%)、Kimi K3
  • 高性价比:GPT-6 Sol(约 5.6 代半价)、Gemini 3.8 Flash / 3.7 Flash、GLM-5.3 / 5.3-Flash、MiniMax-M3、DeepSeek V4.1 Flash
  • 备选:Grok 4.7 / 4.6、Qwen3.8-Max、GPT-5.6 Sol、Kimi K2.6
文本创作
  • 首选:GPT-6 Sol、Claude Opus 5.5、Claude Sonnet 5、Gemini 3.8 Flash
  • 备选:chat-latest、GPT-5.6 Terra、Claude Sonnet 4.6、GLM-5.3
快速响应
  • 首选:Gemini 3.5 Flash-Lite(默认零思考、约 2 秒)、Claude Haiku 4.5(速度快 2 倍)、GPT-6 Luna
  • 备选:Gemini 3.1 Flash Lite、Gemini 2.5 Flash、Seed 2.1 Turbo(需显式关闭思考)
长文本处理
  • 超长上下文:Gemini 2.5 Pro(2M)、Kimi K3(1M 全区间统一计价)、MiniMax-M3(1M)、GLM-5.3(1M)、GPT-6 系列(1.05M)、Claude Opus 5.5(1M)
  • 注意:部分模型超过一定长度会按更高档阶梯计费(如 Grok 4.5 / 4.6 / 4.7 超 200K、GPT-6 Sol / Luna 超 272K、MiniMax-M3 超 512K),长任务前请预估成本
图像生成
  • 最新推荐:gpt-image-2.5-flare / gpt-image-2.5-sunburst(2026-09 上线,原生 4K、size/quality 精确控制,与 gpt-image-2 同价,速度 / 编辑精度分别更强)、Nano Banana Pro(4K 高清,最佳文本渲染)
  • 高性价比:Nano Banana 2($0.055/张,按量低至 $0.025)、Nano Banana Lite(约 4 秒出图,$0.025/张)
  • 专业设计:Seedream 5.0 Pro($0.12/次,交互式编辑 + 最多 10 张参考图)、Seedream 5.0 Lite($0.035/张)
  • 快速出图:Seedream 5.0 Flash(2026-09 上线,$0.018/张,15–20 秒出图,中文排版准确)
  • 最便宜:gpt-image-2-all(官逆,$0.03/张)
视频生成
  • 官转首选:VEO 3.1 Official(按次 $0.3 / $1.2,4/6/8 秒,原生同步音轨)
  • 国产主力:Seedance 2.5 与 2.0 系列(2.5 / 标准 / fast / mini 四档)、Wan2.7、HappyHorse 1.1
  • 注意:Sora 2 相关通道已下线,请改用上述通道,详见 图像与视频生成模型
联网搜索
  • 原生联网:Grok 4 All、Grok 3 All(无需工具调用)
  • 搜索 grounding:Gemini 3.8 Flash / 3.7 Flash / 3.6 Flash / 3.5 Flash-Lite

成本优化建议

  1. 分级使用:简单任务用便宜模型,复杂任务用高级模型
  2. 测试优化:先用小模型测试,确定需求后再用大模型
  3. 批量处理:大量相似任务可以选择 Luna / Lite / Mini 档位
  4. 缓存复用:善用各家的上下文缓存(Kimi K3、Seed 2.1 Turbo、Claude 系列命中后输入价可低至 1/10)
  5. 关闭不必要的思考:部分模型默认开启深度思考(如 Seed 2.1 Turbo、Gemini Flash 系列、Qwen3.8-Max),高频短问答显式关闭可同时省钱提速

🔗 相关资源

模型列表持续更新中,我们会及时添加最新发布的优秀模型。最新上新动态请关注 网站公告。如需使用特定模型或有批量需求,请联系客服。