返回行业动态
模型与产品

智谱正式发布并开源GLM-5.3-Flash:320B参数原生多模态,定价仅为Opus 4.8的1/40

智谱AI于8月26日正式上线并开源GLM-5.3-Flash(320B-A18B),这是GLM-5系列首个原生多模态模型。该模型在AA综合智能指数得57分,与Claude Opus 4.8持平,但定价仅为GLM-5.3的1/10、限时低至Opus 4.8的1/40。模型首次采用稀疏与线性注意力混合架构,服务跑在大规模国产芯片集群上,端到端性能较基线提升3倍。

来源:智谱AI官方原标题:GLM-5.3-Flash正式发布查看原文
智谱GLM-5.3-Flash模型架构示意图,多模态与国产算力

北京拓实科技原创

模型核心参数

智谱AI于8月26日正式发布并开源GLM-5.3-Flash,总参数320B、激活参数18B,是GLM-5系列首个原生多模态模型。在AA综合智能指数评测中,该模型获得57分,与Anthropic Claude Opus 4.8持平,但推理速度较上代提升50%,支持128K上下文窗口。

定价方面,GLM-5.3-Flash仅为GLM-5.3的1/10,限时优惠期更低至Opus 4.8的1/40(约0.1元/百万tokens)。这一价格突破得益于架构创新:总参数与GLM-4.5相当,但激活参数与层数近乎减半,是首个采用稀疏与线性注意力混合架构的开源前沿模型。

原生多模态与国产算力

  • 原生多模态带来视觉编码能力,可自主观察渲染界面并迭代优化
  • 服务首次跑在大规模国产芯片集群上,端到端性能较基线提升3倍
  • 单token成本与英伟达GPU相当,实现国产算力商业化突破
  • 开源权重已上线Hugging Face,支持社区自由部署与微调
  • 某平台7天请求量达42万亿tokens,超过DeepSeek Flash同期表现

行业意义

GLM-5.3-Flash的发布标志着中国开源大模型在三个维度取得突破:一是架构创新(稀疏+线性注意力混合),二是国产算力规模化落地,三是极致性价比。智谱承诺每日100T算力支持开发者,若其1GW国产芯片数据中心投产,将进一步重塑大模型竞争格局。

对企业用户而言,GLM-5.3-Flash提供了一个在成本与性能之间取得平衡的新选项:前沿智能水平接近闭源旗舰,但运行成本大幅降低,且完全自主可控。

编辑说明

本文由北京拓实科技根据公开信息整理,核心事实与数据请以原始来源为准。