一、格局总览:头部十家厂商

截至本期数据,榜单共收录 333 款模型、来自 32 个厂商分类(含「其他/未归类」)。按模型数量排序,前十名如下——款数代表覆盖面,平均 Elo 代表整体实力,最强模型则决定厂商的天花板,三列结合看才完整。

#厂商模型数开源平均 Elo最强模型Elo
1阿里云37281325.0Qwen3.51471
2Google35131300.0Gemini 3.7 Flash1490
3OpenAI3321369.7GPT-5.51471
4Anthropic2101392.4Claude Opus 51504
5Meta21181211.9Muse Spark 1.21487
6xAI1401402.4Grok 4.51452
7智谱13101394.5GLM 5.31477
8Mistral AI13111249.5Mistral Large 31428
9NVIDIA11111300.0NVIDIA Nemotron 3 Ul…1445
10腾讯811345.0混元 Hy31441

整体格局:中国厂商在规模与开源上领先(阿里云 37 款居首),海外厂商在单点能力上更强(Anthropic 的 Claude Opus 5 以 1504 Elo 登顶全榜);而平均实力榜上,小米、月之暗面、xAI 等「小而精」的玩家反超了大厂——数量不再是衡量厂商的唯一标准。

二、重点厂商逐个盘点

以下 12 家厂商覆盖了榜单绝大多数的头部模型,按规模排序展开。

阿里云 37 款 · 开源 28 · 平均 Elo 1325.0
Qwen3.5Elo 1471

以 37 款模型位列全站模型数量第一,是榜单覆盖最广的厂商;28 款开源,开源占比 76%,生态开放程度高;平均 Elo 1325.0,中坚力量;旗舰为 Qwen3.5(Elo 1471)。

Google 35 款 · 开源 13 · 平均 Elo 1300.0

35 款模型位居数量前三;少数开源(13 款),以闭源商用为主;平均 Elo 1300.0,中坚力量;旗舰为 Gemini 3.7 Flash(Elo 1490)。

OpenAI 33 款 · 开源 2 · 平均 Elo 1369.7
GPT-5.5Elo 1471

33 款模型位居数量前三;少数开源(2 款),以闭源商用为主;平均 Elo 1369.7,中坚力量;旗舰为 GPT-5.5(Elo 1471)。

Anthropic 21 款 · 开源 0 · 平均 Elo 1392.4

21 款模型的规模处于第一梯队;全系闭源,走商业 API 路线;平均 Elo 1392.4,属「少而精」路线;旗舰为 Claude Opus 5(Elo 1504)。

Meta 21 款 · 开源 18 · 平均 Elo 1211.9

21 款模型的规模处于第一梯队;18 款开源,开源占比 86%,生态开放程度高;平均 Elo 1211.9,更侧重覆盖面与细分场景;旗舰为 Muse Spark 1.2(Elo 1487)。

xAI 14 款 · 开源 0 · 平均 Elo 1402.4
Grok 4.5Elo 1452

14 款模型的规模处于第一梯队;全系闭源,走商业 API 路线;平均 Elo 1402.4,属「少而精」路线;旗舰为 Grok 4.5(Elo 1452)。

智谱 13 款 · 开源 10 · 平均 Elo 1394.5
GLM 5.3Elo 1477

13 款模型的规模相对克制;10 款开源,开源占比 77%,生态开放程度高;平均 Elo 1394.5,属「少而精」路线;旗舰为 GLM 5.3(Elo 1477)。

腾讯 8 款 · 开源 1 · 平均 Elo 1345.0
混元 Hy3Elo 1441

8 款模型的规模相对克制;少数开源(1 款),以闭源商用为主;平均 Elo 1345.0,中坚力量;旗舰为 混元 Hy3(Elo 1441)。

DeepSeek 8 款 · 开源 8 · 平均 Elo 1332.1
DeepSeek R1Elo 1428

8 款模型的规模相对克制;8 款开源,开源占比 100%,生态开放程度高;平均 Elo 1332.1,中坚力量;旗舰为 DeepSeek R1(Elo 1428)。

月之暗面 6 款 · 开源 6 · 平均 Elo 1431.5
Kimi K3Elo 1476

6 款模型的规模相对克制;6 款开源,开源占比 100%,生态开放程度高;平均 Elo 1431.5,属「少而精」路线;旗舰为 Kimi K3(Elo 1476)。

小米 5 款 · 开源 3 · 平均 Elo 1432.4

5 款模型的规模相对克制;3 款开源,开源占比 60%,生态开放程度高;平均 Elo 1432.4,属「少而精」路线;旗舰为 MiMo V2.5 Pro(Elo 1465)。

MiniMax 5 款 · 开源 5 · 平均 Elo 1367.8
MiniMax M2.7Elo 1405

5 款模型的规模相对克制;5 款开源,开源占比 100%,生态开放程度高;平均 Elo 1367.8,中坚力量;旗舰为 MiniMax M2.7(Elo 1405)。

三、全部厂商一览

其余厂商(Mistral AI、NVIDIA、Allenai、Cohere、Microsoft、Ibm、Amazon、阶跃星辰等)模型数量较少,详见下表。

#厂商模型数开源平均 Elo最强模型Elo
1阿里云37281325.0Qwen3.51471
2Google35131300.0Gemini 3.7 Flash1490
3OpenAI3321369.7GPT-5.51471
4Anthropic2101392.4Claude Opus 51504
5Meta21181211.9Muse Spark 1.21487
6xAI1401402.4Grok 4.51452
7智谱13101394.5GLM 5.31477
8Mistral AI13111249.5Mistral Large 31428
9NVIDIA11111300.0NVIDIA Nemotron 3 Ul…1445
10腾讯811345.0混元 Hy31441
11DeepSeek881332.1DeepSeek R11428
12Allenai881234.2Olmo 3.1 32b Instruc…1311
13Cohere771217.6Command A 031331
14Microsoft771116.4Phi 41217
15月之暗面661431.5Kimi K31476
16Ibm661164.7Granite 4.1 8b1292
17小米531432.4MiMo V2.5 Pro1465
18MiniMax551367.8MiniMax M2.71405
19Amazon501301.2Amazon Nova Experime…1447
20阶跃星辰421352.5Step 3.5 Flash1404
21阿里巴巴211478.0Qwen3.8-Max1482
22百度201456.0ERNIE 5.11468
23深度求索221441.5DeepSeek V4 Pro1451
24字节跳动201429.0Dola Seed 2.0 Pro1448
25Thinky221425.5Inkling1439
26Ant-Group221347.5Ling Flash 2.01363
27Inception-Ai201320.0Mercury 21358
28智谱AI111465.0GLM-5.21465
29稀宇科技111435.0MiniMax M31435
30美团101426.0LongCat Flash Chat1426
31Upstage101376.0Solar Pro41376

四、怎么用这份盘点

  • 选供应商:追求能力天花板看「最强模型」,追求稳定输出看「平均 Elo」,追求生态看「模型数 + 开源数」;
  • 国产 vs 海外:数据合规敏感选阿里云 / 智谱 / DeepSeek 等国产厂商;英文场景 OpenAI / Anthropic / Google 仍有优势;
  • 私有化部署:优先看开源占比高的厂商(DeepSeek、智谱、Meta、Mistral),部署成本可控;
  • 数据在更新:本盘点随榜单数据每周自动刷新,厂商发布新模型后格局会同步变化。
数据口径:Elo 来自 LMArena 竞技场;「平均 Elo」为厂商所有已评模型 Elo 的算术平均,仅作整体实力参考。榜单实时快照见排行榜