原创AI大模型周榜更新:国产双模型崛起,GLM-5.3-Max 首秀突围综合榜前15、Kimi-K3-Max 稳居前十
8月24日,Arena平台公布2026年第34周AI大模型盲测榜单。本期国产模型表现亮眼,智谱glm-5.3-max首次登榜就闯入综合榜前15.月之暗面kimi-k3-max成功挺进综合榜前十。同时多款国产新模型在代码、前端、视频、智能体等细分榜单刷新成绩,国产AI综合实力持续攀升,行业竞争格局持续变动。
一、榜单统计说明
本次榜单依托Arena平台匿名盲测投票产出,采用ELO算法统计分数排名,主要体现用户实际使用偏好,并非绝对性能判定标准。各个细分榜单数据相互独立,不能跨榜单对比。同时新模型需要积累足量投票数据,最终排名才会完全定型,小幅分差均属于正常误差范围。
二、综合榜整体情况:国产模型多点开花
综合榜头部阵容整体稳定,Anthropic旗下三款Claude模型稳居前三名,相互分差极小,处于持平状态。本周榜单最大亮点来自国产新模型,智谱glm-5.3-max首次入榜直接拿下第13名,表现十分亮眼;kimi-k3-max排名上升两位,首度冲进综合榜前十。此外还有多款新模型入榜、老模型排名涨跌变动,国产模型牢牢占据中上游席位。
三、代码榜:国产模型编程能力大幅进阶
代码榜头部排名出现小幅轮换,Claude系列模型包揽榜单前三,分数差距仅有1分,整体实力不相上下。国产模型表现尤为出彩,kimi-k3-max稳居榜单第六,智谱全新的glm-5.3-max首秀直接杀入前十。本周多款新模型扎堆登榜,同时部分阿里、小米旗下模型排名小幅下滑,国产编程类AI竞争愈发激烈。
四、前端开发榜:国产AI强势抢占前十席位
前端开发榜头部格局相对稳固,海外顶尖模型守住榜首位置。国产模型成为最大看点,kimi-k3-max、阿里qwen3.8-max稳定位居二、三名,和榜首差距不大。本次更是有glm-5.3-max、qwen3.8-27b两款国产新模型首次入榜且全部冲进前十,足以看出国产AI在前端开发场景的适配能力飞速提升。
五、AI生图榜:整体排名稳定,国产模型稳居前列
AI生图赛道榜单波动较小,整体格局十分稳定,海外模型持续领跑榜首。国产模型表现平稳且发挥稳定,字节、阿里旗下主流生图AI稳稳守住前十席位。腾讯混元生图模型排名小幅上涨,成功跻身前三十行列,国产生图大模型整体发挥稳健,没有出现大幅排名滑落的情况。
六、AI视频榜:字节新模型首秀即巅峰
视频生成赛道依旧由海外模型领跑,榜单前三席位基本固定。字节跳动全新发布的dreamina-seedance-2.5-720p表现惊艳,首次登榜就直接拿下第四名,和前代模型共同稳居榜单前五。多款国产视频模型稳定留在前三十,整体可用性持续提升,在视频生成领域的竞争力不断增强。
七、智能体榜:国产AI跻身头部第一梯队
智能体赛道头部依旧被Claude系列模型占据,前三名成绩差距极小。国产模型实现重大突破,kimi-k3-max排名升至第四,成功踏入行业第一梯队。同时深度求索、阿里全新模型首次登榜,智谱多款模型稳定留在榜单前列,国产AI在自主任务处理、智能交互方面的能力持续突破。
八、本周整体总结
纵观本周全赛道榜单,国产AI大模型迎来集中爆发。智谱、月之暗面、字节、阿里、深度求索等多家厂商新模型纷纷登榜,在综合能力、代码开发、视频生成、智能体等多个赛道全面突破。随着后续更多新版本模型上线,各大赛道的排名竞争会更加激烈,国产AI的整体崛起趋势十分明显。