8月27日消息,智谱正式上线并开源GLM-5.3-Flash(320B-A18B),这是GLM-5系列的首个原生多模态模型。该模型总参数量为320B(3200亿),激活参数仅18B(180亿)。
值得一提的是,该模型在发布前曾以匿名代号Ox-Alpha在OpenCode和OpenRouter平台进行大规模测试,并迅速成为当周最受欢迎的模型,创下双平台调用量新高。而支撑这些请求流量的算力全部来自国产芯片。

性能方面,GLM-5.3-Flash在全球权威的Artificial Analysis Intelligence Index(AA综合智能指数)中取得57分,进入全球前沿模型能力区间,与Anthropic的Claude Opus 4.8得分持平;在自研Z.ai Code Bench体感评估中,编程表现亦与其相当。官方表示,其全面超越了参数量高出一倍的GLM-5.2。
架构层面,GLM-5.3-Flash为极低成本设计:总参数量与GLM-4.5相当,但激活参数量与层数几乎减半,结合30T Token多模态预训练语料,能以更少算力实现更强性能。它也是首个采用稀疏注意力与线性注意力混合架构的开源前沿模型,并引入流形约束超连接(mHC)提升Scaling能力。
能力上,模型将视觉原生融入Coding循环,可主动观察界面、渲染结果并持续迭代,覆盖前端开发、游戏构建、3D场景及真实环境操作;同时可完成从研究分析到PPTX、PDF、DOCX、XLSX成品交付的完整工作流。
价格方面,GLM-5.3-Flash定价为GLM-5.3的1/10,限时折扣价仅为1/20、Claude Opus 4.8的1/40。目前模型已接入ZCode等编码平台,纳入GLM Coding Plan(每天限量发放1万张体验卡),并同步开放API调用。此外,GLM Coding Plan全员额度已重置。

微信扫一扫
支付宝扫一扫 