主流国产大模型矩阵

按实验室分类,覆盖通用基座、推理代码、多模态与智能体方向,数据截至 2026 年年中。

V4

DeepSeek

深度求索 · DeepSeek

合并通用与推理两条技术线,按任务难度自适应“思考强度”,以极低推理成本著称。

MIT 开源MoE1M 上下文
突出强项代码 80.6% SWE-bench Verified · 成本控制
3.6

通义千问

阿里巴巴 · Qwen

全球部署最广的国产开源模型家族,覆盖 0.6B–235B+ 多尺寸,多语言与多模态能力最全。

Apache-2.0多尺寸27B 稠密
突出强项多语言 · 易自部署 · 生态最广
K3

Kimi

月之暗面 · Moonshot AI

面向“自主智能体编程”打造,K3 为迄今最大的开源权重模型之一,专攻长程多步骤编码。

开源权重~2.8T MoE1M 上下文
突出强项智能体编码 · SWE-bench Pro 领先
GLM-5.2

智谱 GLM

智谱 AI · Z.ai

2026 年首个登陆港交所的国产 AI 实验室,GLM-5 系列主要在华为昇腾算力上训练。

MIT 开源~753B MoE1M 上下文
突出强项长程编码智能体 · 国产算力兼容
Hy3

腾讯混元

腾讯 · Hunyuan

以更小激活参数量匹敌更大模型,多模态生成(图像 / 3D / 视频)与“世界模型”能力突出。

Apache-2.0295B MoE21B 激活
突出强项多模态生成 · 视频 / 3D · 高效率
Seed 2.1

豆包

字节跳动 · Doubao / Seed

国内调用量领先,API 价格最低,多模态与消费级产品体验强,是“成本地板”的设定者。

闭源 API 为主部分 Seed-OSS多模态
突出强项成本最低 · 通用智能体 · 多模态
ERNIE 5.0

文心大模型

百度 · ERNIE

全球 LMArena 前十,日均 API 调用 15 亿次,广泛落地搜索、企业与产业场景。

旗舰闭源4.5 开源搜索生态
突出强项企业落地 · 搜索生态 · 大规模调用
M2.5 / M2.7

MiniMax

稀宇科技 · MiniMax

长上下文与多模态能力强,2026 年随智谱之后登陆港交所,正推进 2.7T 参数模型。

闭源为主长上下文多模态
突出强项长上下文 · 多模态 · C 端产品
Step 3.5

阶跃星辰

StepFun · Step

高效推理与多模态并重,Flash 系列以更低成本提供接近旗舰的能力,调用量位居前列。

API / 开源高效推理多模态
突出强项高效推理 · 多模态 · 性价比
Ultra MoE

华为盘古

华为 · Pangu

唯一在国产软硬件栈上训练的前沿模型,强调算力自主可控与行业大模型落地。

openPangu 开源718B MoE国产算力
突出强项国产算力 · 自主可控 · 行业模型

代码能力横向对比

各旗舰模型的公开代码基准成绩(2026 年),用于横向参考。

模型基准成绩
DeepSeek V4 (Pro-Max)SWE-bench Verified80.6%
Qwen 3.6-27BSWE-bench Verified77.2%
Kimi K3SWE-bench Verified76.8%
Doubao-Seed 2.0 ProSWE-bench Verified76.5%
腾讯混元 Hy3SWE-bench Verified74.4%
智谱 GLM-5.2SWE-bench Pro(更难)62.1
注:基准数据来自厂商发布与独立榜单,截至 2026 年年中;不同基准口径不可直接等同,实际选型请以自身任务评测为准。