以新知观科技,以远见望未来!

AI大模型排行榜

2026-07-25 19:05:09分类:AI大模型编辑:科技新知

当前AI大模型赛道竞争白热化,为客观呈现行业格局,我们综合豆包、DeepSeek、元宝三大主流模型的搜索与评测数据,从综合性能、用户规模、专项能力等多维度梳理出最新AI大模型排行榜,直观展现全球与国产模型的梯队分化、核心优势及市场趋势,为用户选型提供权威参考。

AI大模型排行榜

豆包:

1、Claude Fable 5(Anthropic):ELO 1507,长文本 / 复杂推理最强。

2、Claude Opus 4.8(Anthropic):代码 SWE-bench 88.6%,全能旗舰。

3、Gemini 3.1 Pro(Google):科学推理 GPQA 94.3%,多模态顶尖。

4、Grok 4.20 Beta(xAI):实时联网,4-Agent 并行架构。

5、GPT-5.5/5.6(OpenAI):OSWorld 75%,Agent 能力强。

6、豆包 Seed 2.0 Pro(字节):国产第一,全球前十。

7、Kimi K3(月之暗面):ELO 1486,前端开发榜第一(1677 分)。

8、GLM-5.2(智谱 AI):开源代码强,100 万上下文。

9、Qwen 3.7 Max(阿里):Hugging Face 开源榜第一。

10、DeepSeek V4 Pro(深度求索):MIT 开源,SWE-bench 80.6%。

DeepSeek:

1、Kimi K3 月之暗面 (Moonshot AI) 1677分

2、Claude Fable 5 Anthropic 1636分

3、GPT-5.6 Sol (xHigh) OpenAI 1633分

4、GLM-5.2 (Max) 智谱AI (Zhipu AI) 1593分

5、Claude Opus 4.8 (Thinking) Anthropic 1564分

6、Claude Opus 4.7 (Thinking) Anthropic 1559分

7、Grok-4.5 xAI 1556分

8、Claude Opus 4.7 Anthropic 1555分

9、Claude Sonnet 5 (High) Anthropic 1546分

10、Claude Opus 4.6 (Thinking) Anthropic 1543分

元宝:

1、Claude Opus 4.8 Anthropic Artificial Analysis智能指数61.4居首,编码/智能体突出

2、Gemini-3.1-Pro-Preview Google SuperCLUE2026.5中文综合75.73分排第一

3、GPT-5.5 (high) OpenAI SuperCLUE74.27分;LMSYS盲测Elo1484

4、Claude Opus 4.7 Anthropic LMSYS盲测Elo1492,硬提示/编码双榜前列

5、Claude Opus 4.6 Anthropic LMSYS综合榜Elo1502全球第一

6、Gemini 3 Pro Google LMSYS Elo1486,长上下文+视觉最强

7、Qwen3.7 Max 阿里巴巴 中文/多语言强,性价比赛道顶尖

8、GLM-5.2 智谱AI 开源权重综合最强,GPQA91.2%

9、Kimi K3 月之暗面 前端代码Arena第一,开源权重综合第三

10、DeepSeek V4 Pro / Flash DeepSeek 开源权重,价格仅为旗舰1/10

本文地址:https://www.kejixinzhi.com/large_ai_models/1.html 转载请注明出处,科技新知带你一起探索未知精彩!

上一篇:没有了

下一篇:

热点推荐

关注我们

    关注我们
返回顶部