本周榜单迎来大规模新模型集中入榜,其中最受关注的是国产模型 kimi-k3 的突出表现:它不仅首次杀入综合榜 Top 10,更直接登顶前端开发榜榜首,在细分能力上实现了对多数海外头部模型的反超。
整体来看,多款国产模型在多个榜单的前列位置站稳脚跟,梯队完整度进一步提升。
综合榜头部位置由 Claude、Meta、谷歌、OpenAI 等厂商的新模型主导,第一名依然由 claude-fable-5 占据,ELO 为 1507 分。Anthropic 旗下多款思考版本模型集中入驻 Top 5,彼此之间分差全部在 15 分以内,在误差范围内属于并列第一梯队。
本周最大的亮点是国产模型 kimi-k3 凭借 1486 分的 ELO 排名来到第 9 位,首次跻身综合榜 Top 10,和第 8 名的 gemini-3-pro、第 10 名的 gpt-5.6-sol-xhigh 分数完全一致,属于第一梯队的边缘位置。
前端开发榜呈现出前所未有的格局,国产模型 kimi-k3 直接以 1679 分的高 ELO 稳居第一名,大幅领先第二名 claude-fable-5 的 1631 分,分差达到 48 分,优势十分明显。
第四名同样由国产模型 glm-5.2 (max) 拿下,ELO 1587 分,超过了多款 Claude、OpenAI 的旗舰模型。这意味着国产大模型在前端开发这一细分场景的能力已经走在了全球最前列。(IT之家)
