No.001国产旗舰开源 · MIT
DeepSeek-V4-Pro
深度求索(DeepSeek)
深度求索2026年4月发布的旗舰大模型,MoE架构,总参数1.6万亿,激活49B,原生支持100万Token上下文,MIT协议完全开源。SWE-bench Verified得分80.6%,Codeforces 3206分,性能比肩全球顶级闭源模型。
SWE-bench_Verified 80.6%Codeforces 3206
输出成本 / M tokens¥6CNY
输入 ¥3最大输出 384K Tokens
※ 2026年5月永久降价至原价1/4;7月起引入峰谷计费:工作日9-12/14-18点价格翻倍(高峰输入6元/输出12元)
复杂逻辑推理大型代码工程百万级长文档理解+2
No.002经济之选开源 · MIT
DeepSeek-V4-Flash
深度求索(DeepSeek)
DeepSeek V4系列经济版,总参数2840亿,激活130亿,主打高并发与极致性价比,1M上下文,MIT协议开源。
输出成本 / M tokens¥2CNY
输入 ¥1
※ 7月起峰谷计费:工作日9-12/14-18点价格翻倍(高峰输入2元/输出4元)
高并发日常对话轻量文本生成成本敏感批量处理+1
No.003国际旗舰闭源
Claude Fable 5
Anthropic
Anthropic于2026年6月9日发布的Mythos级旗舰模型,首个面向公众的Mythos级模型。编码、长时程Agent任务和复杂推理大幅领先,支持Adaptive Thinking自适应推理,可连续数小时完成复杂任务链。
输出成本 / M tokens$50USD
输入 $10最大输出 128K Tokens
※ 约为Opus两倍;2026年7月20日起纳入Max/Team Premium订阅
大型代码库迁移重构长时程自主Agent复杂多步推理+2
No.004主流闭源
Claude Opus 4.6
Anthropic
Anthropic Claude 4系列顶级推理模型,SWE-bench 80.9%,1M Token上下文,企业级深度推理与代码审查首选。
SWE-bench_Verified 80.9%
输出成本 / M tokens$25USD
输入 $5
企业级代码审查大代码库重构复杂Agent规划+1
No.005主流闭源
Claude Sonnet 4.6
Anthropic
Anthropic中端主力模型,免费用户可用,一致性、指令遵循大幅提升,性价比极高。
输出成本 / M tokens$15USD
输入 $3
日常编程辅助文案创作通用对话+1
No.006国际旗舰闭源
GPT-5.5
OpenAI
OpenAI 2026年旗舰模型,105万Token上下文,13万最大输出,原生多模态(文本/图像/音频),多项Benchmark领先。
输出成本 / M tokens$30USD
输入 $5最大输出 130,000 Tokens
专业编码多模态理解生成企业级推理+2
No.007高性价比闭源
GPT-5.4
OpenAI
OpenAI面向编码和专业工作的更实惠模型,105万Token上下文,性能均衡。
输出成本 / M tokens$15USD
输入 $2.5最大输出 130,000 Tokens
日常编码辅助专业文档处理多语言翻译+1
No.008主流闭源
Gemini 3.6 Flash
Google DeepMind
Google 2026年7月21日发布,3.5 Flash后继。输出token减少17%、速度翻倍(303 tok/s),知识截止2026年3月,内置Computer Use。
DeepSWE 49%OSWorld-Verified 83.0%
输出成本 / M tokens$7.5USD
输入 $1.5最大输出 64K
※ 输出价较3.5 Flash降低17%($9→$7.50);有免费额度;Batch 50%折扣
Agent工作流多模态理解高并发轻量推理+2
No.009国际旗舰闭源
Gemini 3.0 Pro
Google DeepMind
Google Gemini 3旗舰推理模型,ARC-AGI-2得分77.1%,支持深度思考模式。
ARC-AGI-2 77.1%
输出成本 / M tokens$12USD
输入 $2
复杂科学推理多步骤问题求解长视频理解+1
月之暗面2026年4月20日发布并开源的万亿参数MoE多模态Agent大模型,32B激活参数,256K上下文,原生支持图片和视频输入。支持300个子Agent并行、4000协作步骤,单次任务可不间断编码13小时、编写超4000行代码。Modified MIT License开源。
SWE-bench_Pro 超越GPT-5.4HLE_with_tools 开源SOTA
输出成本 / M tokens¥27CNY
输入 ¥6.5
※ 较K2涨价约58%;第三方平台特惠价:输入2.5元/输出9.9元
长周期自主编码(13小时不间断)300 Agent并行协作多模态视觉转代码+3
No.011国产旗舰开源
GLM-5.1
智谱AI(Zhipu AI)
智谱AI 2026年4月8日发布的新一代开源旗舰模型,744B参数(激活40B),采用DeepSeek稀疏注意力+Multi-Token Prediction技术,SWE-bench-Verified 77.8%,Terminal Bench 2.0得分56.2,代码能力逼近Claude Opus 4.5。Artificial Analysis全球第四。
架构
MoE + DeepSeek稀疏注意力+ Multi-Token Prediction
SWE-bench-Verified 77.8%Terminal_Bench_2.0 56.2
输出成本 / M tokens¥32.4CNY
输入 ¥10.8
※ 较GLM-5再提价10%;Coding Plan订阅另有套餐价
复杂系统工程长周期智能体任务AI编程(Claude Code/Cursor/Cline)+2
No.012经济之选闭源
Doubao-Seed-2.0-Pro(豆包2.0 Pro)
字节跳动(ByteDance)/ 火山引擎
字节跳动2026年2月14日发布的旗舰大模型,IMO/CMO数学竞赛和ICPC编程竞赛金牌水平,超越Gemini 3 Pro的Putnam基准。多模态、科学推理、Agent全能,月活破亿。
IMO_CMO 金牌ICPC 金牌
输出成本 / M tokens¥16CNY
输入 ¥3.2
※ Lite版输入0.6元/输出3.6元;Mini版输入0.2元/输出2元
数学竞赛级推理多模态内容创作日常对话(月活破亿)+2
No.013主流开源 · Apache 2.0
ERNIE 4.5(文心一言)
百度(Baidu)
百度新一代多模态基础大模型,2025年6月开源(Apache 2.0),MoE架构,支持文本/图像/视频多模态理解。4.5 Turbo版性价比极高,中文理解精准,政企应用成熟。
输出成本 / M tokens¥24CNY
输入 ¥8
※ Turbo版输入0.8元/输出3.2元;个人基础版(3.5 Turbo)永久免费
中文知识问答政企智能客服搜索增强推理+2
No.014高性价比闭源
Grok 4.5
SpaceXAI(原xAI,马斯克旗下)
SpaceXAI(原xAI)2026年7月9日发布,基于1.5万亿参数V9底座,与Cursor联合训练。Token效率为竞品2倍,推理速度80TPS,SWE-bench Pro 64.7%超越GPT-5.5。定价极具侵略性,成本仅为Opus的1/4。
SWE-bench_Pro 64.7%Terminal-bench_2.1 83.3%
输出成本 / M tokens$6USD
输入 $2
※ 比Claude Opus便宜60%+;Token效率为竞品2倍
AI编程(Cursor深度集成)实时信息检索与分析高并发Agent任务+2
Meta 2025年4月发布的开源MoE多模态模型系列。Scout:109B总参/17B激活,10M超长上下文(业界最长);Maverick:400B总参/17B激活,1M上下文。原生多模态,支持12+语言。
总参数
Scout 109B / Maverick 400B
输出成本 / M tokens$0.6USD
输入 $0.2
※ 开源免费本地部署;云服务商按算力计费(AWS Bedrock Scout 约$0.17/$0.66,Maverick 约$0.24/$0.97);此处取托管API参考价
超长文档处理(10M上下文)多语言应用本地私有化部署+2
腾讯2026年7月6日正式发布的第三代大语言模型,MoE架构295B总参/21B激活,256K上下文。Agent能力追平GPT-5.5,Apache 2.0完全开源。已批量接入腾讯内部业务线。
输出成本 / M tokens¥4CNY
输入 ¥1
※ Apache 2.0开源,可本地部署免费使用
智能体(Agent)任务代码生成与调试企业办公自动化+2
No.017高性价比开源
MiniMax M3
稀宇科技(MiniMax)
稀宇科技2026年6月1日发布并开源的新一代旗舰模型,自研MSA稀疏注意力架构(非MoE),1M上下文,原生多模态。SWE-Bench Pro 59.0%超越GPT-5.5,BrowseComp 83.5分超越Claude Opus 4.7。发布一周OpenRouter全球调用量第三。
SWE-Bench_Pro 59.0%BrowseComp 83.5分(超越Opus 4.7的79.3)
输出成本 / M tokens¥16.8CNY
输入 ¥4.2
※ 512K上下文以内定价;发布首周API五折优惠;Token Plan订阅制可选
AI Coding(仓库级代码分析)多模态Agent长文档/视频理解+2
No.018国产旗舰闭源
Qwen3.7-Max(通义千问)
阿里云 / 通义实验室
阿里云2026年6月发布的旗舰智能体大模型,Artificial Analysis评测56.6分(全球第五、国产第一),面向深度逻辑推理、百万字长文档、大型代码工程。
Artificial_Analysis 56.6分(全球第五、国产第一)
输出成本 / M tokens¥36CNY
输入 ¥12
科研推演全仓库代码重构超长合同审核+2
No.019经济之选开源
Qwen3.5-Plus(通义千问)
阿里云 / 通义实验室
阿里云2026年2月发布的开源旗舰,397B总参/17B激活,以小胜大,部署显存降60%,推理吞吐提升19倍,原生多模态,全球最强开源模型之一。
输出成本 / M tokens¥2CNY
输入 ¥0.8
电商办公多语言翻译本地私有化部署+2
No.020高性价比闭源
Meta Muse Spark 1.1
Meta
Meta 2026年7月9日发布的全新闭源多模态推理模型,首个面向外部开发者的付费商用API。主打高级智能体工作流编排、多智能体并行协作、零样本工具调用、计算机操控能力。100万Token上下文。
输出成本 / M tokens$4.25USD
输入 $1.25
※ 新注册赠$20免费额度;Meta首个付费商用API
端到端软件开发Bug检测与修复多Agent工作流编排+2
月之暗面2026年7月发布的2.8T参数前沿旗舰模型,896专家MoE架构、每token激活16个专家,1M上下文统一定价无分级加价。KDA混合注意力机制带来6.3倍解码加速,前端编程能力全球第一,编码与推理对标Claude Opus而成本低一半。2026年7月27日开放权重。
前端编程 全球第一Artificial_Analysis_Index 第一梯队
输出成本 / M tokens¥108CNY
输入 ¥21.6最大输出 128K Tokens
※ ≈$3.0输入/$15.0输出;缓存命中仅≈$0.30/M(编码场景缓存率90%+);1M上下文统一定价;国产模型中最贵,仍比西方前沿模型便宜约50%
编码Agent长上下文推理复杂多步骤任务+1
No.022国产旗舰开源 · MIT
GLM-5.2
智谱AI(Zhipu AI)
智谱AI(Z.ai)2026年发布的开源旗舰模型,MIT协议开放权重,HuggingFace可下载。综合能力与Claude Opus 4.8接近而价格便宜80%,综合成本约为Claude Opus的20%,发布首周调用量暴涨27倍,被硅谷知名工程师盛赞“以零头成本比肩美国系统”。
vs_Claude_Opus_4.8 接近持平,便宜80%
输出成本 / M tokens¥5.76CNY
输入 ¥1.44最大输出 128K Tokens
※ ≈$0.2输入/$0.8输出;综合成本约为Claude Opus的20%;发布首周调用量增长27倍
通用推理AI编程低成本Claude替代+1
阿里巴巴的开源权重冠军,也是全球下载量最高的开源模型家族。在开源模型中中文能力与 Agent 表现最强。
MMLU(中文) 88.1HumanEval 82.4
输出成本 / M tokens$0.83USD
输入 $0.28最大输出 32K Tokens
※ 开源权重家族,覆盖 1B–235B 规格;下载量约 10 亿次(占全球开源模型下载量 50% 以上)。
自托管多语言应用Agent 与工具调用
月之暗面的长上下文强将,配备 200 万 token 窗口——一次调用即可吞下整个代码库或文档库的首选。
长上下文召回 业界领先
输出成本 / M tokens$1.1USD
输入 $1.1最大输出 128K Tokens
※ 高端长上下文专家;200 万 token 窗口。
海量文档分析代码库理解Agent 式搜索
MiniMax 的高效主力模型,按 API 调用量计稳居全球前三。消费级应用的性价比极佳。
全球调用量 前三
输出成本 / M tokens$0.4USD
输入 $0.1最大输出 64K Tokens
※ 最便宜的前沿级模型之一;按调用量计全球前三。
角色扮演与聊天高吞吐 Agent多模态
No.026国际旗舰闭源
Claude Opus 5
Anthropic
2026年7月24日发布。性能逼近Fable 5、价格仅一半。Frontier-Bench超Opus 4.8两倍,Claude Max默认模型。支持effort思考档位与Fast模式(2.5倍速)。
DeepSWE v1.1 68.8%FrontierCode v1.1 53.4%
输出成本 / M tokens$25USD
输入 $5最大输出 128K
※ 与Opus 4.8同价;Fast模式$10/$50;Batch 50%折扣;缓存命中$0.50/MTok(省90%)
复杂Agent编程企业级代码审查长链路自主任务+1
No.027高性价比闭源
Claude Sonnet 5
Anthropic
2026年6月30日发布,最强Agent属性Sonnet。性能接近Opus 4.8,成本仅四成。Free/Pro版默认模型。
SWE-Bench Pro 63.2%
输出成本 / M tokens$15USD
输入 $3
※ 促销期至2026-08-31:$2/$10;之后恢复$3/$15
日常编程高并发Agent研究分析