← 文章 / AI技术
IT前沿 1小时前 · 2026-09-03 22:42:59 · 0 阅读

2026年8月AI大模型能力TOP30排行榜(附清单),藏着一些不太好看但很真实的信号

每次大模型排行榜更新,我都会认真看一遍。不是为了追热点,是因为这个榜单的变化速度,有时候比新闻本身更能说明问题。

八月份这份TOP30,我看完之后坐了一会儿,有些东西跟我想的不太一样。

先说最上面。

Claude Opus 5,63分,第一。紧接着是Claude Fable 5,62分。Anthropic一家公司占了前两名。

这个结果说实话让我有点意外,但仔细想想又不意外。过去一年多,Anthropic在长文本理解、复杂推理、代码生成这几个维度上的进步是有目共睹的。他们不怎么做营销,不怎么开发布会,但模型能力一直在往上走。

OpenAI这次排第三的是GPT-5.6 Sol,61分。后面还有Terra、Luna、Codex,加上一个5.3版本的Codex,OpenAI一家公司占了五个席位。这说明什么?说明他们的策略是多线并进,不同场景用不同版本去打。

Grok 4.6,61分,跟GPT-5.6 Sol并列。xAI这家公司,从马斯克一开始被大家当笑话看,到现在真刀真枪杀进前四,中间其实也就两三年。有时候我会想,行业里那些"不可能",保质期真的越来越短了。

然后是让我最关注的部分——中国厂商。

Kimi K3,60分,第五名。

月之暗面这家公司,从Kimi K1开始我就在关注。他们的产品思路一直很清晰,就是做"能真正帮人干活的AI"。K3这次能进前五,我觉得不是偶然,是他们一直在做的那件事终于到了一个临界点。

Qwen3.8-Max,58分,第六。阿里的通义千问系列,说实话之前有一段时间我觉得他们节奏有点慢,但这次3.8版本直接跳到第六,说明底层能力还是有的,只是之前可能没完全释放出来。

DeepSeek V4,56分,第九。深度求索这家公司,从V1到V4,每一步都走得很扎实。他们的开源策略在开发者社区里口碑很好,这次商业模型也能排进前十,算是两条腿都站住了。

再往后看,GLM-5.2,53分。豆包Seed,52分。这两个也在第一梯队边缘了。

但让我觉得需要说一说的,是后半段。

从第二十名开始往下,你会看到一个很集中的现象:华为盘古、百度文心、腾讯混元、科大讯飞、360智脑、商汤、百川、零一万物、中国移动九天……

这些名字,每一个背后都是大厂或者明星创业公司。但分数基本在33到43之间。

我不是说这些公司不行。但客观讲,跟前面那些比,差距确实存在。而且这个差距不是"再努力一下就能追上"的那种,更像是路线选择、资源投入、技术积累这些更深层的东西造成的。

尤其是华为盘古和百度文心,这两家其实很早就开始做大模型了,起步比很多公司都早。但现在排在这个位置,多少有点让人感慨。先发优势这个东西,在AI领域好像没那么管用。

最后说几个我个人的小感受。

第一个感受是,这个榜单的分数区间其实很窄。最高63,最低33,中间只差30分。但体感上,第一名和第三十名的差距远不止30分能形容的。越往上走,每一分的提升都越难。就像跑步,从10秒跑到9秒,和从5秒跑到4秒,完全是两回事。

第二个感受是,中国厂商在中间位置(第五到第十五名)的表现其实相当不错。Kimi、Qwen、DeepSeek、GLM、豆包,这几个已经能跟全球一线掰手腕了。但如果把视野拉到整个榜单,你会发现"头部集中"的趋势在加剧。

第三个感受,也是我最想说的:排行榜这个东西,看看就好。

分数能说明一些问题,但不能说明所有问题。一个模型排第几名,跟它在你的实际工作场景中好不好用,是两回事。我见过有人用排第十五的模型写出了非常好的方案,也见过有人用排第一的模型做了个一塌糊涂的PPT。

工具终究是工具。关键还是用工具的那个人,想清楚自己要解决什么问题。

这份榜单我大概率下个月还会再看一遍。到时候再聊聊,又有什么变了。

附:清单
排名模型名称厂商能力分数
1Claude Opus 5Anthropic63
2Claude Fable 5Anthropic62
3GPT-5.6 SolOpenAI61
4Grok 4.6xAI61
5Kimi K3月之暗面60
6Qwen3.8-Max阿里巴巴58
7Muse Spark 1.2Meta57
8GPT-5.6 TerraOpenAI57
9DeepSeek V4深度求索56
10Claude Sonnet 5Anthropic55
11GLM-5.2智谱AI53
12GPT-5.6 LunaOpenAI52
13DeepSeek V4-Flas深度求索52
14Gemini 3.6 FlashGoogle52
15豆包 Seed字节跳动52
16Gemini 3.1 ProGoogle48
17GPT-5.3 CodexOpenAI46
19小米 MiMo V2.5小米43
20Kimi K2.7 Code月之暗面43
21腾讯混元 Hy3腾讯42
22文心一言 5.1百度42
23华为 盘古华为41
24讯飞星火科大讯飞40
25阶跃星辰 Step 3.7阶跃星辰40
26360智脑36038
27商汤 商量商汤科技36
28百川百川智能35
29零一万物 Yi零一万物34
30中国移动 九天中国移动33
#AI #大模型 #AI排行榜往期精彩内容:改了几十篇AI生成的文案之后,发现AI味的病根是:AI永远在选最安全的写法来实现零风险表达。一年省下几千块,10个付费AI工具的免费替代清单几张图搞懂AI工具,选对AI工具比瞎收藏有用6个AI提示词,快速学会任何东西别再把所有活儿都丢给同一个AI了,不同的AI有不同的分工,用错了比不用还累
原始来源: IT前沿

评论 (0)