IT 之家 8 月 26 日消息,智谱今晚上线并开源 GLM-5.3-Flash ( 320B-A18B ) ,这是 GLM-5 系列的首个原生多模态模型。该模型总参数量为 320B(3200 亿),激活参数仅 18B(180 亿)。





据介绍,这得益于其全新模型架构。GLM-5.3-Flash 的架构专为极低成本而设计,总参数量与 GLM-4.5 相当(355B vs. 320B),但激活参数量(32B → 18B)与层数(92 → 45)几乎减半。结合最新的 30T Token 多模态预训练语料,GLM-5.3-Flash 能够以更少的计算资源实现更强的性能。
GLM-5.3-Flash 同时进行了多项架构升级,是首个采用稀疏注意力与线性注意力混合架构的开源前沿模型,在保持精准长上下文能力的同时,大幅降低长上下文服务成本;并采用流形约束超连接(Manifold-Constrained Hyper-Connections,mHC)提升模型 Scaling 能力。
GLM-5.3-Flash 正式面向全球开源,已接入 ZCode 等编码平台,并纳入 GLM Coding Plan(每天限量发放 10,000 张体验卡),同步开放 API 调用。
IT 之家附相关链接:
BigModel 开放平台:https://docs.bigmodel.cn/cn/guide/models/vlm/glm-5.3-flash
Z.ai:https://docs.z.ai/guides/vlm/glm-5.3-flash
GLM Coding Plan:https://bigmodel.cn/glm-coding
HuggingFace:https://huggingface.co/zai-org/GLM-5.3-Flash