LIVE

AI MODEL FIELD GUIDE · 大模型选型手册

LLM.

模型图鉴

一册尽览主流大语言模型的参数规模、上下文窗口、API 定价与擅长场景——为选型、比价与架构决策提供一份可随手翻阅的参考。

汇率 1 USD ≈ 6.8 CNY价格单位 / M tokens
REGISTRY STATSSYNCED

收录模型

27

开源模型

14

收录厂商

13

最低输出价

¥2/M

MAX CONTEXT10M TOKENS

模型索引

SPECIMEN INDEX
27 ENTRIES
No.001国产旗舰开源 · MIT

DeepSeek-V4-Pro

深度求索(DeepSeek)

深度求索2026年4月发布的旗舰大模型,MoE架构,总参数1.6万亿,激活49B,原生支持100万Token上下文,MIT协议完全开源。SWE-bench Verified得分80.6%,Codeforces 3206分,性能比肩全球顶级闭源模型。

总参数

1.6T

激活参数

49B

上下文窗口

1M Tokens

架构

MoE + 压缩稀疏注意力

SWE-bench_Verified 80.6%Codeforces 3206
输出成本 / M tokens¥6CNY
输入 ¥3最大输出 384K Tokens

※ 2026年5月永久降价至原价1/4;7月起引入峰谷计费:工作日9-12/14-18点价格翻倍(高峰输入6元/输出12元)

复杂逻辑推理大型代码工程百万级长文档理解+2
No.002经济之选开源 · MIT

DeepSeek-V4-Flash

深度求索(DeepSeek)

DeepSeek V4系列经济版,总参数2840亿,激活130亿,主打高并发与极致性价比,1M上下文,MIT协议开源。

总参数

284B

激活参数

13B

上下文窗口

1M Tokens

架构

MoE

输出成本 / M tokens¥2CNY
输入 ¥1

※ 7月起峰谷计费:工作日9-12/14-18点价格翻倍(高峰输入2元/输出4元)

高并发日常对话轻量文本生成成本敏感批量处理+1
No.003国际旗舰闭源

Claude Fable 5

Anthropic

Anthropic于2026年6月9日发布的Mythos级旗舰模型,首个面向公众的Mythos级模型。编码、长时程Agent任务和复杂推理大幅领先,支持Adaptive Thinking自适应推理,可连续数小时完成复杂任务链。

总参数

激活参数

上下文窗口

1M Tokens

架构

输出成本 / M tokens$50USD
输入 $10最大输出 128K Tokens

※ 约为Opus两倍;2026年7月20日起纳入Max/Team Premium订阅

大型代码库迁移重构长时程自主Agent复杂多步推理+2
No.004主流闭源

Claude Opus 4.6

Anthropic

Anthropic Claude 4系列顶级推理模型,SWE-bench 80.9%,1M Token上下文,企业级深度推理与代码审查首选。

总参数

激活参数

上下文窗口

1M Tokens

架构

SWE-bench_Verified 80.9%
输出成本 / M tokens$25USD
输入 $5
企业级代码审查大代码库重构复杂Agent规划+1
No.005主流闭源

Claude Sonnet 4.6

Anthropic

Anthropic中端主力模型,免费用户可用,一致性、指令遵循大幅提升,性价比极高。

总参数

激活参数

上下文窗口

1M Tokens

架构

输出成本 / M tokens$15USD
输入 $3
日常编程辅助文案创作通用对话+1
No.006国际旗舰闭源

GPT-5.5

OpenAI

OpenAI 2026年旗舰模型,105万Token上下文,13万最大输出,原生多模态(文本/图像/音频),多项Benchmark领先。

总参数

激活参数

上下文窗口

1.05M Tokens

架构

输出成本 / M tokens$30USD
输入 $5最大输出 130,000 Tokens
专业编码多模态理解生成企业级推理+2
No.007高性价比闭源

GPT-5.4

OpenAI

OpenAI面向编码和专业工作的更实惠模型,105万Token上下文,性能均衡。

总参数

激活参数

上下文窗口

1.05M Tokens

架构

输出成本 / M tokens$15USD
输入 $2.5最大输出 130,000 Tokens
日常编码辅助专业文档处理多语言翻译+1
No.008主流闭源

Gemini 3.6 Flash

Google DeepMind

Google 2026年7月21日发布,3.5 Flash后继。输出token减少17%、速度翻倍(303 tok/s),知识截止2026年3月,内置Computer Use。

总参数

激活参数

上下文窗口

1M Tokens

架构

DeepSWE 49%OSWorld-Verified 83.0%
输出成本 / M tokens$7.5USD
输入 $1.5最大输出 64K

※ 输出价较3.5 Flash降低17%($9→$7.50);有免费额度;Batch 50%折扣

Agent工作流多模态理解高并发轻量推理+2
No.009国际旗舰闭源

Gemini 3.0 Pro

Google DeepMind

Google Gemini 3旗舰推理模型,ARC-AGI-2得分77.1%,支持深度思考模式。

总参数

激活参数

上下文窗口

1M Tokens

架构

ARC-AGI-2 77.1%
输出成本 / M tokens$12USD
输入 $2
复杂科学推理多步骤问题求解长视频理解+1
No.010国产旗舰开源 · Modified MIT License

Kimi K2.6

月之暗面(Moonshot AI)

月之暗面2026年4月20日发布并开源的万亿参数MoE多模态Agent大模型,32B激活参数,256K上下文,原生支持图片和视频输入。支持300个子Agent并行、4000协作步骤,单次任务可不间断编码13小时、编写超4000行代码。Modified MIT License开源。

总参数

1T

激活参数

32B

上下文窗口

256K Tokens

架构

MoE

SWE-bench_Pro 超越GPT-5.4HLE_with_tools 开源SOTA
输出成本 / M tokens¥27CNY
输入 ¥6.5

※ 较K2涨价约58%;第三方平台特惠价:输入2.5元/输出9.9元

长周期自主编码(13小时不间断)300 Agent并行协作多模态视觉转代码+3
No.011国产旗舰开源

GLM-5.1

智谱AI(Zhipu AI)

智谱AI 2026年4月8日发布的新一代开源旗舰模型,744B参数(激活40B),采用DeepSeek稀疏注意力+Multi-Token Prediction技术,SWE-bench-Verified 77.8%,Terminal Bench 2.0得分56.2,代码能力逼近Claude Opus 4.5。Artificial Analysis全球第四。

总参数

744B

激活参数

40B

上下文窗口

202K Tokens

架构

MoE + DeepSeek稀疏注意力+ Multi-Token Prediction

SWE-bench-Verified 77.8%Terminal_Bench_2.0 56.2
输出成本 / M tokens¥32.4CNY
输入 ¥10.8

※ 较GLM-5再提价10%;Coding Plan订阅另有套餐价

复杂系统工程长周期智能体任务AI编程(Claude Code/Cursor/Cline)+2
No.012经济之选闭源

Doubao-Seed-2.0-Pro(豆包2.0 Pro)

字节跳动(ByteDance)/ 火山引擎

字节跳动2026年2月14日发布的旗舰大模型,IMO/CMO数学竞赛和ICPC编程竞赛金牌水平,超越Gemini 3 Pro的Putnam基准。多模态、科学推理、Agent全能,月活破亿。

总参数

激活参数

上下文窗口

256K Tokens

架构

IMO_CMO 金牌ICPC 金牌
输出成本 / M tokens¥16CNY
输入 ¥3.2

※ Lite版输入0.6元/输出3.6元;Mini版输入0.2元/输出2元

数学竞赛级推理多模态内容创作日常对话(月活破亿)+2
No.013主流开源 · Apache 2.0

ERNIE 4.5(文心一言)

百度(Baidu)

百度新一代多模态基础大模型,2025年6月开源(Apache 2.0),MoE架构,支持文本/图像/视频多模态理解。4.5 Turbo版性价比极高,中文理解精准,政企应用成熟。

总参数

激活参数

上下文窗口

128K Tokens

架构

MoE

输出成本 / M tokens¥24CNY
输入 ¥8

※ Turbo版输入0.8元/输出3.2元;个人基础版(3.5 Turbo)永久免费

中文知识问答政企智能客服搜索增强推理+2
No.014高性价比闭源

Grok 4.5

SpaceXAI(原xAI,马斯克旗下)

SpaceXAI(原xAI)2026年7月9日发布,基于1.5万亿参数V9底座,与Cursor联合训练。Token效率为竞品2倍,推理速度80TPS,SWE-bench Pro 64.7%超越GPT-5.5。定价极具侵略性,成本仅为Opus的1/4。

总参数

1.5T

激活参数

上下文窗口

500K Tokens

架构

SWE-bench_Pro 64.7%Terminal-bench_2.1 83.3%
输出成本 / M tokens$6USD
输入 $2

※ 比Claude Opus便宜60%+;Token效率为竞品2倍

AI编程(Cursor深度集成)实时信息检索与分析高并发Agent任务+2
No.015主流开源 · Meta Llama License

Llama 4 Scout / Maverick

Meta

Meta 2025年4月发布的开源MoE多模态模型系列。Scout:109B总参/17B激活,10M超长上下文(业界最长);Maverick:400B总参/17B激活,1M上下文。原生多模态,支持12+语言。

总参数

Scout 109B / Maverick 400B

激活参数

17B

上下文窗口

10M Tokens

架构

MoE

输出成本 / M tokens$0.6USD
输入 $0.2

※ 开源免费本地部署;云服务商按算力计费(AWS Bedrock Scout 约$0.17/$0.66,Maverick 约$0.24/$0.97);此处取托管API参考价

超长文档处理(10M上下文)多语言应用本地私有化部署+2
No.016经济之选开源 · Apache 2.0

腾讯混元 Hy3

腾讯(Tencent)

腾讯2026年7月6日正式发布的第三代大语言模型,MoE架构295B总参/21B激活,256K上下文。Agent能力追平GPT-5.5,Apache 2.0完全开源。已批量接入腾讯内部业务线。

总参数

295B

激活参数

21B

上下文窗口

256K Tokens

架构

MoE

输出成本 / M tokens¥4CNY
输入 ¥1

※ Apache 2.0开源,可本地部署免费使用

智能体(Agent)任务代码生成与调试企业办公自动化+2
No.017高性价比开源

MiniMax M3

稀宇科技(MiniMax)

稀宇科技2026年6月1日发布并开源的新一代旗舰模型,自研MSA稀疏注意力架构(非MoE),1M上下文,原生多模态。SWE-Bench Pro 59.0%超越GPT-5.5,BrowseComp 83.5分超越Claude Opus 4.7。发布一周OpenRouter全球调用量第三。

总参数

激活参数

上下文窗口

1.05M Tokens

架构

MSA稀疏注意力

SWE-Bench_Pro 59.0%BrowseComp 83.5分(超越Opus 4.7的79.3)
输出成本 / M tokens¥16.8CNY
输入 ¥4.2

※ 512K上下文以内定价;发布首周API五折优惠;Token Plan订阅制可选

AI Coding(仓库级代码分析)多模态Agent长文档/视频理解+2
No.018国产旗舰闭源

Qwen3.7-Max(通义千问)

阿里云 / 通义实验室

阿里云2026年6月发布的旗舰智能体大模型,Artificial Analysis评测56.6分(全球第五、国产第一),面向深度逻辑推理、百万字长文档、大型代码工程。

总参数

激活参数

上下文窗口

1M Tokens

架构

Artificial_Analysis 56.6分(全球第五、国产第一)
输出成本 / M tokens¥36CNY
输入 ¥12
科研推演全仓库代码重构超长合同审核+2
No.019经济之选开源

Qwen3.5-Plus(通义千问)

阿里云 / 通义实验室

阿里云2026年2月发布的开源旗舰,397B总参/17B激活,以小胜大,部署显存降60%,推理吞吐提升19倍,原生多模态,全球最强开源模型之一。

总参数

397B

激活参数

17B

上下文窗口

1M Tokens

架构

MoE

输出成本 / M tokens¥2CNY
输入 ¥0.8
电商办公多语言翻译本地私有化部署+2
No.020高性价比闭源

Meta Muse Spark 1.1

Meta

Meta 2026年7月9日发布的全新闭源多模态推理模型,首个面向外部开发者的付费商用API。主打高级智能体工作流编排、多智能体并行协作、零样本工具调用、计算机操控能力。100万Token上下文。

总参数

激活参数

上下文窗口

1M Tokens

架构

输出成本 / M tokens$4.25USD
输入 $1.25

※ 新注册赠$20免费额度;Meta首个付费商用API

端到端软件开发Bug检测与修复多Agent工作流编排+2
No.021国产旗舰开源 · 开放(权重 7 月 27 日发布)

Kimi K3

月之暗面(Moonshot AI)

月之暗面2026年7月发布的2.8T参数前沿旗舰模型,896专家MoE架构、每token激活16个专家,1M上下文统一定价无分级加价。KDA混合注意力机制带来6.3倍解码加速,前端编程能力全球第一,编码与推理对标Claude Opus而成本低一半。2026年7月27日开放权重。

总参数

2.8T

激活参数

16专家激活

上下文窗口

1M Tokens

架构

MoE+ KDA混合注意力

前端编程 全球第一Artificial_Analysis_Index 第一梯队
输出成本 / M tokens¥108CNY
输入 ¥21.6最大输出 128K Tokens

※ ≈$3.0输入/$15.0输出;缓存命中仅≈$0.30/M(编码场景缓存率90%+);1M上下文统一定价;国产模型中最贵,仍比西方前沿模型便宜约50%

编码Agent长上下文推理复杂多步骤任务+1
No.022国产旗舰开源 · MIT

GLM-5.2

智谱AI(Zhipu AI)

智谱AI(Z.ai)2026年发布的开源旗舰模型,MIT协议开放权重,HuggingFace可下载。综合能力与Claude Opus 4.8接近而价格便宜80%,综合成本约为Claude Opus的20%,发布首周调用量暴涨27倍,被硅谷知名工程师盛赞“以零头成本比肩美国系统”。

总参数

激活参数

上下文窗口

200K Tokens

架构

MoE

vs_Claude_Opus_4.8 接近持平,便宜80%
输出成本 / M tokens¥5.76CNY
输入 ¥1.44最大输出 128K Tokens

※ ≈$0.2输入/$0.8输出;综合成本约为Claude Opus的20%;发布首周调用量增长27倍

通用推理AI编程低成本Claude替代+1
No.023国产旗舰开源 · Apache 2.0

Qwen3 Max

阿里云 / 通义实验室

阿里巴巴的开源权重冠军,也是全球下载量最高的开源模型家族。在开源模型中中文能力与 Agent 表现最强。

总参数

235B

激活参数

22B

上下文窗口

256K Tokens

架构

MoE

MMLU(中文) 88.1HumanEval 82.4
输出成本 / M tokens$0.83USD
输入 $0.28最大输出 32K Tokens

※ 开源权重家族,覆盖 1B–235B 规格;下载量约 10 亿次(占全球开源模型下载量 50% 以上)。

自托管多语言应用Agent 与工具调用
No.024国产旗舰开源 · Modified MIT

Kimi K2.5

月之暗面(Moonshot AI)

月之暗面的长上下文强将,配备 200 万 token 窗口——一次调用即可吞下整个代码库或文档库的首选。

总参数

1T

激活参数

32B

上下文窗口

2M Tokens

架构

MoE

长上下文召回 业界领先
输出成本 / M tokens$1.1USD
输入 $1.1最大输出 128K Tokens

※ 高端长上下文专家;200 万 token 窗口。

海量文档分析代码库理解Agent 式搜索
No.025高性价比开源 · Apache 2.0

MiniMax M2.5

稀宇科技(MiniMax)

MiniMax 的高效主力模型,按 API 调用量计稳居全球前三。消费级应用的性价比极佳。

总参数

激活参数

上下文窗口

200K Tokens

架构

MoE

全球调用量 前三
输出成本 / M tokens$0.4USD
输入 $0.1最大输出 64K Tokens

※ 最便宜的前沿级模型之一;按调用量计全球前三。

角色扮演与聊天高吞吐 Agent多模态
No.026国际旗舰闭源

Claude Opus 5

Anthropic

2026年7月24日发布。性能逼近Fable 5、价格仅一半。Frontier-Bench超Opus 4.8两倍,Claude Max默认模型。支持effort思考档位与Fast模式(2.5倍速)。

总参数

激活参数

上下文窗口

1M Tokens

架构

DeepSWE v1.1 68.8%FrontierCode v1.1 53.4%
输出成本 / M tokens$25USD
输入 $5最大输出 128K

※ 与Opus 4.8同价;Fast模式$10/$50;Batch 50%折扣;缓存命中$0.50/MTok(省90%)

复杂Agent编程企业级代码审查长链路自主任务+1
No.027高性价比闭源

Claude Sonnet 5

Anthropic

2026年6月30日发布,最强Agent属性Sonnet。性能接近Opus 4.8,成本仅四成。Free/Pro版默认模型。

总参数

激活参数

上下文窗口

1M Tokens

架构

SWE-Bench Pro 63.2%
输出成本 / M tokens$15USD
输入 $3

※ 促销期至2026-08-31:$2/$10;之后恢复$3/$15

日常编程高并发Agent研究分析

关于图鉴

本图鉴基于 2026 年 7 月各厂商公开信息整理,价格与参数以官方最新公告为准。部分模型存在峰谷定价、批量折扣、缓存命中与订阅套餐等差异化计费策略;美元价格按 1 USD ≈ 6.8 CNY 估算换算。

价格图例

  • 经济输出 ≤ ¥8 / M tokens
  • 中档¥8 – ¥25 / M tokens
  • 高端> ¥25 / M tokens
  • 自部署开源模型,按算力计费

数据来源

© 2026 LLM 模型图鉴 · MODEL FIELD GUIDE仅供选型参考 · VUE 3 + TAILWIND