企业级专业稳定的AI大模型API中转站
本站均为官方源头转发,价格八折(叠加充值加赠和汇率优势),聚合各种优秀大模型。不限速,不惧封号,按量计费,长期可靠服务。
本站均为官方源头转发,价格八折(叠加充值加赠和汇率优势),聚合各种优秀大模型。不限速,不惧封号,按量计费,长期可靠服务。
🔥 当前推荐模型
以下为当前稳定供给的热门模型,完整模型列表和实时价格请访问 API易控制台定价页面,也可查看站内 模型价格总览。表格中上下文一栏标注为「—」的,表示厂商暂未公布明确数值,实际以控制台与官方文档为准。价格均为每 100 万 tokens 的定价(输入/输出),可叠加充值加赠优惠。
模型分类
🤖 OpenAI 系列
🆕 最新模型
GPT-6 系列供给:
default / svip 官转分组四项计费与官网一致,Chat Completions 与 Responses 双端点实测可用(含函数调用),从 5.6 迁移只需改 model 字段;Astra 另有 Codex_Reverse 分组按 0.5 折扣。Sol / Luna 单次上下文超过 272K 会整单进入更高一档计费。详见 GPT-6 Astra 上线说明 与 GPT-6 Sol / Luna 上线说明。✅ 稳定/经典系列
图像和视频生成模型已移至专属页面,请访问 图像与视频生成模型 查看完整列表和定价。
🎭 Claude 系列 (Anthropic)
🆕 最新模型
✅ 稳定/经典系列
最新推荐:Claude Opus 5.5 多数编程与知识工作基准超过 Fable 5.1,价格却比 Opus 5 还低($4/$20),官方称典型负载综合成本比 Opus 5 低约 40%。Sonnet 5 性能逼近 Opus 4.8 而更快更省。稳定首选:Opus 4.7 / Sonnet 4.6 经过充分验证,适合已上线的生产工作流;Haiku 4.5 速度快 2 倍、性价比高。
🌟 Google Gemini 系列
🆕 最新模型
✅ 稳定/经典系列
最新推荐:Gemini 3.8 Flash 与 3.7 Flash 同价,编码与 Agent 能力较 3.6 Flash 大幅提升、价格只有一半,Gemini 原生格式与 OpenAI 兼容格式双端点可用,详见 3.8 Flash 上线说明 与 3.7 Flash 上线说明。高并发低延迟场景可选 3.5 Flash-Lite。稳定首选:Gemini 2.5 Pro(2M 超长上下文)和 Gemini 2.5 Flash 适合已定型的生产环境。
🚀 xAI Grok 系列
🆕 最新模型
✅ 稳定/经典系列
按任务估算 Grok 成本:4.5 / 4.6 / 4.7 单价相同($2/$6),但 Grok 4.7 完成同一批任务的输出 tokens 约为 4.6 的两倍,按任务算的实际花费会上升;Grok 4.5 输出最省。超过 200K tokens 的请求按官方第二档费率计费。详见 Grok 4.7 上线说明。
🔍 DeepSeek 系列
🐘 国产模型系列
智谱 AI (GLM)
🆕 最新:GLM-5.3、GLM-5.3-Flash | ✅ 稳定/经典:GLM-5.2、GLM-5.1、GLM-5GLM-5.3 系列要点:
- 旗舰 GLM-5.3 与 5.2 同基座、只扩后训练,编程与网络安全能力(ExploitBench 54.4%,5.2 为 24.4%)大幅提升
- GLM-5.3-Flash 是 320B-A18B 混合稀疏 + 线性注意力的原生多模态模型,价格约为旗舰的 1/10
- 定价与智谱官网逐项一致,
default/svip分组可用;长任务建议把 timeout 调到 600 秒以上,详见 GLM-5.3 上线说明
阿里通义千问 (Qwen)
🆕 最新:Qwen3.8-Max | ✅ 稳定/经典:Qwen3.7 系列、Qwen3.6 系列、Qwen Max / Plus / TurboMoonshot Kimi 系列
🆕 最新:Kimi K3 | ✅ 稳定/经典:Kimi K2.6、K2.5、K2Kimi K3 使用要点:
- 精确 1,048,576 tokens 上下文,全区间统一计价,长代码库 / 长文档可整体塞入,不担心跨档涨价
- 最大输出默认 131,072、最高可调至 1,048,576 tokens;思考模式常开满档,请预留输出预算
- 自动上下文缓存,命中部分输入按 $0.30/1M 计费(未命中价的 1/10),多轮对话收益显著
字节跳动 Seed 系列
🆕 最新:Seed 2.1 Turbo | ✅ 稳定/经典:Seed 2.0 Pro / Lite / Mini🌐 MiniMax 系列
🆕 最新:MiniMax-M3 | ✅ 稳定/经典:MiniMax-M2.7、M2.5MiniMax-M3 计费说明:
- 采用阶梯计费,0-512K 区间 $0.30 输入 / $1.20 输出(每 1M tokens),超出部分按更高档单价计费
- 注意模型名大小写:
MiniMax-M3(同系列MiniMax-M2.7-highspeed等亦区分大小写) - 做百万级长上下文任务前请预估好成本
模型价格与官网对齐,且可能随官网调整;上表仅供参考,具体以顶部导航「模型价格」栏目为准:模型价格。
💰 定价说明
计费方式
- 按量计费:根据实际使用的 Token 数量计费
- 无最低消费:充多少用多少
- 余额有效期:自充值之日起 365 天内有效,再次充值自动重置(详见充值活动说明)
- 实时扣费:每次调用后立即从余额扣除费用
价格优势
- 官方源头转发,价格略有优势
- 批量使用可联系客服获取更优惠价格
- 新用户注册后账号自带 $0.05 试用额度,可直接跑通接入验证
查看实时价格
访问 API易控制台定价页面 查看所有模型的最新价格,或查看站内 模型价格总览。🛠️ 使用建议
模型选择指南
编程开发- 顶级性能:Claude Opus 5.5(Terminal-Bench 4.0 66.4%)、GPT-6 Astra(Terminal-Bench 4.0 57.9%)、Claude Sonnet 5(SWE-bench 85.2%)、Kimi K3
- 高性价比:GPT-6 Sol(约 5.6 代半价)、Gemini 3.8 Flash / 3.7 Flash、GLM-5.3 / 5.3-Flash、MiniMax-M3、DeepSeek V4.1 Flash
- 备选:Grok 4.7 / 4.6、Qwen3.8-Max、GPT-5.6 Sol、Kimi K2.6
- 首选:GPT-6 Sol、Claude Opus 5.5、Claude Sonnet 5、Gemini 3.8 Flash
- 备选:chat-latest、GPT-5.6 Terra、Claude Sonnet 4.6、GLM-5.3
- 首选:Gemini 3.5 Flash-Lite(默认零思考、约 2 秒)、Claude Haiku 4.5(速度快 2 倍)、GPT-6 Luna
- 备选:Gemini 3.1 Flash Lite、Gemini 2.5 Flash、Seed 2.1 Turbo(需显式关闭思考)
- 超长上下文:Gemini 2.5 Pro(2M)、Kimi K3(1M 全区间统一计价)、MiniMax-M3(1M)、GLM-5.3(1M)、GPT-6 系列(1.05M)、Claude Opus 5.5(1M)
- 注意:部分模型超过一定长度会按更高档阶梯计费(如 Grok 4.5 / 4.6 / 4.7 超 200K、GPT-6 Sol / Luna 超 272K、MiniMax-M3 超 512K),长任务前请预估成本
- 最新推荐:gpt-image-2.5-flare / gpt-image-2.5-sunburst(2026-09 上线,原生 4K、size/quality 精确控制,与 gpt-image-2 同价,速度 / 编辑精度分别更强)、Nano Banana Pro(4K 高清,最佳文本渲染)
- 高性价比:Nano Banana 2($0.055/张,按量低至 $0.025)、Nano Banana Lite(约 4 秒出图,$0.025/张)
- 专业设计:Seedream 5.0 Pro($0.12/次,交互式编辑 + 最多 10 张参考图)、Seedream 5.0 Lite($0.035/张)
- 快速出图:Seedream 5.0 Flash(2026-09 上线,$0.018/张,15–20 秒出图,中文排版准确)
- 最便宜:gpt-image-2-all(官逆,$0.03/张)
- 官转首选:VEO 3.1 Official(按次 $0.3 / $1.2,4/6/8 秒,原生同步音轨)
- 国产主力:Seedance 2.5 与 2.0 系列(2.5 / 标准 / fast / mini 四档)、Wan2.7、HappyHorse 1.1
- 注意:Sora 2 相关通道已下线,请改用上述通道,详见 图像与视频生成模型
- 原生联网:Grok 4 All、Grok 3 All(无需工具调用)
- 搜索 grounding:Gemini 3.8 Flash / 3.7 Flash / 3.6 Flash / 3.5 Flash-Lite
成本优化建议
- 分级使用:简单任务用便宜模型,复杂任务用高级模型
- 测试优化:先用小模型测试,确定需求后再用大模型
- 批量处理:大量相似任务可以选择 Luna / Lite / Mini 档位
- 缓存复用:善用各家的上下文缓存(Kimi K3、Seed 2.1 Turbo、Claude 系列命中后输入价可低至 1/10)
- 关闭不必要的思考:部分模型默认开启深度思考(如 Seed 2.1 Turbo、Gemini Flash 系列、Qwen3.8-Max),高频短问答显式关闭可同时省钱提速
🔗 相关资源
模型列表持续更新中,我们会及时添加最新发布的优秀模型。最新上新动态请关注 网站公告。如需使用特定模型或有批量需求,请联系客服。