技术进展

国产大模型集体突破 Arena周榜多维度进阶

Heooo 08月24日17时02分 26 阅读

「Arena平台最新AI大模型盲测榜单显示,智谱glm-5.3-max首秀即闯入综合榜第13名,月之暗面kimi-k3-max首次杀入前十。国产模型在代码、前端开发、AI视频及智能体等多个细分榜单表现亮眼,整体竞争力持续提升。」

Arena(arena.ai)平台近日发布了2026年第34周AI大模型盲测排名,本期榜单见证了国产大模型的集体突破。智谱新发布的glm-5.3-max首次入榜即强势跻身综合榜第13位,ELO得分为1487分;而月之暗面的kimi-k3-max则从第12名上升至第10名,首次进入综合榜前十,展现出强劲的用户偏好优势。


在综合榜中,头部仍由Claude系列模型占据,claude-fable-5以1508分蝉联第一,与第二、三名的claude-opus-4-6-high和claude-opus-4-7-high分差极小,在误差范围内可视为并列。值得注意的是,阿里系的qwen3.8-max本周排名下滑明显,从第8名跌至第19名,而其预览版qwen3.7-max-preview则稳定在第27名。


代码榜方面,glm-5.3-max同样表现抢眼,首秀即位列第10名,ELO达1531分。kimi-k3-max稳居第6名,阿里多款模型也保持在前30行列。而在前端开发榜,国产模型更是占据主导地位,kimi-k3-max和qwen3.8-max稳居第二、第三,新入榜的glm-5.3-max和qwen3.8-27b也迅速进入前十。


在多模态领域,国产模型同样进展显著。AI视频榜中,字节跳动新发布的dreamina-seedance-2.5-720p首次入榜即冲至第4名,与其前代产品共同占据前五席位。AI生图榜中,seedream-5.0-pro和qwen-image-3.0-pro稳定保持在前十。


尤为值得关注的是智能体榜,月之暗面Kimi K3 (Max)已升至第4名,净提升度达10.41%,任务确认成功率接近18%。阿里Qwen3.8 Max和深度求索DeepSeek V4 Pro也首次入榜,分别位列第15和第14名,显示出国产模型在智能体任务执行能力上的快速进步。


整体来看,本期Arena榜单反映出国产大模型在多个技术维度上的全面发力,不仅新模型入榜数量增多,且在关键细分领域已具备与国际顶尖模型正面竞争的能力。随着后续更多版本迭代发布,国产AI大模型的竞争格局有望进一步重塑。

# 大模型 # 国产AI # Arena榜单 # glm-5.3-max # kimi-k3-max

来源:Heooo AI工具导航