模型核心参数
智谱AI于8月26日正式发布并开源GLM-5.3-Flash,总参数320B、激活参数18B,是GLM-5系列首个原生多模态模型。在AA综合智能指数评测中,该模型获得57分,与Anthropic Claude Opus 4.8持平,但推理速度较上代提升50%,支持128K上下文窗口。
定价方面,GLM-5.3-Flash仅为GLM-5.3的1/10,限时优惠期更低至Opus 4.8的1/40(约0.1元/百万tokens)。这一价格突破得益于架构创新:总参数与GLM-4.5相当,但激活参数与层数近乎减半,是首个采用稀疏与线性注意力混合架构的开源前沿模型。
原生多模态与国产算力
- 原生多模态带来视觉编码能力,可自主观察渲染界面并迭代优化
- 服务首次跑在大规模国产芯片集群上,端到端性能较基线提升3倍
- 单token成本与英伟达GPU相当,实现国产算力商业化突破
- 开源权重已上线Hugging Face,支持社区自由部署与微调
- 某平台7天请求量达42万亿tokens,超过DeepSeek Flash同期表现
行业意义
GLM-5.3-Flash的发布标志着中国开源大模型在三个维度取得突破:一是架构创新(稀疏+线性注意力混合),二是国产算力规模化落地,三是极致性价比。智谱承诺每日100T算力支持开发者,若其1GW国产芯片数据中心投产,将进一步重塑大模型竞争格局。
对企业用户而言,GLM-5.3-Flash提供了一个在成本与性能之间取得平衡的新选项:前沿智能水平接近闭源旗舰,但运行成本大幅降低,且完全自主可控。

