智谱开源GLM-5.3-Flash原生多模态模型
「智谱于8月26日上线并开源GLM-5.3-Flash,这是GLM-5系列首个原生多模态模型,总参数320B、激活参数仅18B。该模型在AA综合智能指数得57分,与Claude Opus 4.8持平,编程表现相当。定价为GLM-5.3的十分之一,限时折扣低至二十分之一,并采用稀疏注意力与线性注意力混合架构。」
智谱正式发布并开源了GLM-5系列的首个原生多模态模型——GLM-5.3-Flash。该模型总参数量为320B(3200亿),激活参数仅为18B(180亿),展现出极高的参数效率。值得注意的是,在正式发布之前,智谱以匿名模型Ox-Alpha(中文社区称为“牛来”)在OpenCode和OpenRouter平台上进行了大规模测试,该匿名模型迅速成为当周最受欢迎的模型,创下双平台调用量新高,而这些请求流量全部由国产芯片提供算力支持。
从性能表现来看,GLM-5.3-Flash全面超越了参数规模高出一倍的GLM-5.2。在全球权威的Artificial Analysis Intelligence Index(AA综合智能指数)中,该模型取得57分,进入全球前沿模型能力区间,与Anthropic最受欢迎的模型Claude Opus 4.8得分持平。在自研的Z.ai Code Bench体感评估中,其编程表现也与Claude Opus 4.8相当。这一成绩表明,通过架构创新,大幅降低激活参数与层数,依然可以实现甚至超越更高参数模型的性能。
该模型的核心优势在于其专为极低成本而设计的全新架构。GLM-5.3-Flash的总参数量与GLM-4.5相当(355B对比320B),但激活参数量从32B降至18B,层数从92层降至45层,几乎减半。结合最新的30T Token多模态预训练语料,GLM-5.3-Flash能够以更少的计算资源实现更强的性能。此外,该模型是首个采用稀疏注意力与线性注意力混合架构的开源前沿模型,在保持精准长上下文能力的同时,大幅降低了长上下文服务成本。同时,流形约束超连接(mHC)技术的引入,进一步提升了模型的Scaling能力。
在视觉能力方面,GLM-5.3-Flash将视觉原生融入Coding循环,使模型能够主动观察界面、渲染结果与交互反馈,并据此持续测试和改进。无论是前端开发、游戏构建、Blender 3D场景,还是BUA、CUA驱动的真实环境操作,模型都能在代码、浏览器和图形界面之间协同完成任务。这一特性拓展了模型在复杂工作场景中的应用边界。
GLM-5.3-Flash还进一步拓展至Office、金融研究和专业文档等工作场景。它能够自主拆解复杂目标、调用合适工具、检查并优化输出,完成从研究分析、模型构建到PPTX、PDF、DOCX、XLSX成品交付的完整工作流。目前,该模型已正式面向全球开源,接入ZCode等编码平台,并纳入GLM Coding Plan(每天限量发放10,000张体验卡),同步开放API调用。官方表示,GLM Coding Plan全员额度已重置,所有用户后台「用量统计」可见使用额度回满。
来源:Heooo AI工具导航