GLM 5.3 Flash发布,国产芯片提供实际算力支持|中信计算机 【GLM 5.3 Flash上线并开源,1/40成本对标Opus 4.8】 1、根据智谱

图片

无图片

正文

GLM 5.3 Flash发布,国产芯片提供实际算力支持|中信计算机

【GLM 5.3 Flash上线并开源,1/40成本对标Opus 4.8】

1、根据智谱 微 信公 众号,智谱上线并开源GLM-5.3-Flash (320B-A18B),这是GLM-5系列的首个原生多模态模型。 2、该模型以小参数量,能力超过GLM-5.2,在自研Code Bench体感评估中,其编程表现与Claude Opus 4.8相当。 3、GLM-5.3-Flash定价为GLM-5.3/GLM5.2的1/10,限时折扣内为GLM-5.3的1/20,为Opus 4.8的1/40。 4、在正式发布前,以匿名模型Ox-Alpha(中文社区称作牛来)在OpenCode和OpenRouter上进行了大规模测试。Ox-Alpha迅速成为当周最受欢迎的模型,创下双平台调用量新高。

【国产芯片提供算力支持,token成本显著优化】

1、根据智谱 微 信公 众号,此前在OpenCode和OpenRouter上进行的大规模测试,请求流量全部由国产芯片提供算力支持。 2、GLM-5.3-Flash的架构专为极低成本而设计。相较于GLM-5.3,GLM-5.3-Flash的注意力计算量与KV缓存大小分别降低了3.01倍和4.44倍。其注意力计算量已经低于DeepSeek V4。 3、智谱认为,国产芯片主要瓶颈在于内存容量与带宽,尤其是支持长达1M上下文长度有挑战。智谱对底层架构进行内存优化,包括以算力换带宽、以通信换显存等定制优化。 4、与同一硬件上的初始基线相比,端到端服务性能提升了3倍,根据智谱进行的测试,其硬件效率和单token成本已达到与主流英伟达GPU相当的水平。智谱认为,这证明国产芯片有望在大规模场景下高效、经济地支撑前沿模型的推理需求。

【国产CPU&GPU&超节点产品受益,建议关注相关龙头公司】

芯片层面:建议关注国产CPU、GPU龙头海光信息等。 整机层面:建议关注浪潮信息、深信服等国产超节点龙头厂商。

总体总结

主题正文

  1. 1、根据智谱 微 信公 众号,智谱上线并开源GLM-5.3-Flash (320B-A18B),这是GLM-5系列的首个原生多模态模型。
  2. 2、该模型以小参数量,能力超过GLM-5.2,在自研Code Bench体感评估中,其编程表现与Claude Opus 4.8相当。
  3. 3、GLM-5.3-Flash定价为GLM-5.3/GLM5.2的1/10,限时折扣内为GLM-5.3的1/20,为Opus 4.8的1/40。
  4. 1、根据智谱 微 信公 众号,此前在OpenCode和OpenRouter上进行的大规模测试,请求流量全部由国产芯片提供算力支持。
  5. 4、与同一硬件上的初始基线相比,端到端服务性能提升了3倍,根据智谱进行的测试,其硬件效率和单token成本已达到与主流英伟达GPU相当的水平。
  6. 【国产CPU&GPU&超节点产品受益,建议关注相关龙头公司】
  7. 芯片层面:建议关注国产CPU、GPU龙头海光信息等。
  8. 整机层面:建议关注浪潮信息、深信服等国产超节点龙头厂商。