智谱AI正式上线并开源GLM-5.3-Flash (320B-A18B) 原生多模态模型。该模型总参数量为320B(3200亿),但激活参数仅为18B(180亿),采用全新的稀疏注意力与线性注意力混合架构。在正式发布前,该模型以代号“Ox-Alpha”在OpenCode和OpenRouter进行测试,凭借国产芯片提供的算力支持,迅速成为双平台调用量最高的模型。性能方面,GLM-5.3-Flash在全球权威的Artificial Analysis Intelligence Index中获得57分,进入全球前沿模型能力区间,与Anthropic的Claude Opus 4.8持平;在编程基准测试中表现亦与Opus 4.8相当。该模型定价极具竞争力,标准价格为GLM-5.3的1/10,限时折扣期间仅为GLM-5.3的1/20,即Claude Opus 4.8价格的1/40。官方数据显示,其架构通过减少层数和激活参数(32B降至18B),结合30T Token的多模态预训练语料,在各项基准测试中全面超越参数量高出一倍的GLM-5.2。GLM-5.3-Flash原生融合视觉能力至Coding循环,支持前端开发、Blender 3D构建及真实环境交互操作;同时拓展至Office、金融等专业文档场景,具备自主拆解目标、调用工具及交付成品的完整工作流能力。目前已接入ZCode等平台,开放API调用并纳入GLM Coding Plan。
事件分析
核心观点:智谱通过架构创新与国产算力协同,实现了“模型性能比肩SOTA、推理成本大幅降低”的突破,加速了开源大模型在复杂Agent场景的落地。
原文链接:Linux.do

评论前必须登录!
立即登录 注册