Arena 平台最新一期 AI 大模型周榜公布。榜单显示,Anthropic 旗下多款 Claude 模型密集进入综合榜前列,claude-fable-5 继续保持头部位置,Claude Opus 系列的多个思考版和常规版模型也处于前段,Anthropic 在综合榜头部的占位仍然较为集中。

从榜单结构来看,Anthropic 多款模型之间的分数差距相对有限,头部梯队呈现出较强的聚集特征。Meta、谷歌和 OpenAI 的部分模型也出现在综合榜前列,但当前榜单的最上方仍主要由 Claude 系列模型构成。
国产模型方面,月之暗面 kimi-k3-max 保持在综合榜前段,是本期国产模型中的重要看点。此前,kimi-k3 系列已经在综合能力、前端开发和代码相关榜单中取得较高排名,kimi-k3-max 的持续入榜,意味着国产模型仍在全球大模型竞技场的头部区域保持存在感。
需要注意的是,Arena 榜单属于基于用户对战反馈形成的动态排名,新模型入榜、样本量变化以及不同统计周期,都可能带来名次和分数波动。因此,单期排名更适合用来观察模型近期的竞争位置,不能直接等同于模型在所有任务和应用场景中的综合能力。