---
title: "GLM 5.3 Flash发布，国产芯片提供实际算力支持｜中信计算机 【GLM 5.3 Flash上线并开源，1/40成本对标Opus 4.8】 1、根据智谱"
topic_id: 22258828242211481
created_at: 2026-08-27T13:52:11.705+0800
source: zsxq
type: topic
cssclasses: zsxq-vault
---

# GLM 5.3 Flash发布，国产芯片提供实际算力支持｜中信计算机 【GLM 5.3 Flash上线并开源，1/40成本对标Opus 4.8】 1、根据智谱

- 序号：206
- 星球链接：[打开网页](https://wx.zsxq.com/group/15522451881222/topic/22258828242211481)
- 附件：图片 0，音频 0，文档 0
- 音频文件：_无音频_

## 图片

_无图片_

## 正文

GLM 5.3 Flash发布，国产芯片提供实际算力支持｜中信计算机

【GLM 5.3 Flash上线并开源，1/40成本对标Opus 4.8】

1、根据智谱 微 信公 众号，智谱上线并开源GLM-5.3-Flash (320B-A18B)，这是GLM-5系列的首个原生多模态模型。
2、该模型以小参数量，能力超过GLM-5.2，在自研Code Bench体感评估中，其编程表现与Claude Opus 4.8相当。
3、GLM-5.3-Flash定价为GLM-5.3/GLM5.2的1/10，限时折扣内为GLM-5.3的1/20，为Opus 4.8的1/40。
4、在正式发布前，以匿名模型Ox-Alpha（中文社区称作牛来）在OpenCode和OpenRouter上进行了大规模测试。Ox-Alpha迅速成为当周最受欢迎的模型，创下双平台调用量新高。

【国产芯片提供算力支持，token成本显著优化】

1、根据智谱 微 信公 众号，此前在OpenCode和OpenRouter上进行的大规模测试，请求流量全部由国产芯片提供算力支持。
2、GLM-5.3-Flash的架构专为极低成本而设计。相较于GLM-5.3，GLM-5.3-Flash的注意力计算量与KV缓存大小分别降低了3.01倍和4.44倍。其注意力计算量已经低于DeepSeek V4。
3、智谱认为，国产芯片主要瓶颈在于内存容量与带宽，尤其是支持长达1M上下文长度有挑战。智谱对底层架构进行内存优化，包括以算力换带宽、以通信换显存等定制优化。
4、与同一硬件上的初始基线相比，端到端服务性能提升了3倍，根据智谱进行的测试，其硬件效率和单token成本已达到与主流英伟达GPU相当的水平。智谱认为，这证明国产芯片有望在大规模场景下高效、经济地支撑前沿模型的推理需求。

【国产CPU&GPU&超节点产品受益，建议关注相关龙头公司】

芯片层面：建议关注国产CPU、GPU龙头海光信息等。
整机层面：建议关注浪潮信息、深信服等国产超节点龙头厂商。

## 总体总结

主题正文
1. 1、根据智谱 微 信公 众号，智谱上线并开源GLM-5.3-Flash (320B-A18B)，这是GLM-5系列的首个原生多模态模型。
2. 2、该模型以小参数量，能力超过GLM-5.2，在自研Code Bench体感评估中，其编程表现与Claude Opus 4.8相当。
3. 3、GLM-5.3-Flash定价为GLM-5.3/GLM5.2的1/10，限时折扣内为GLM-5.3的1/20，为Opus 4.8的1/40。
4. 1、根据智谱 微 信公 众号，此前在OpenCode和OpenRouter上进行的大规模测试，请求流量全部由国产芯片提供算力支持。
5. 4、与同一硬件上的初始基线相比，端到端服务性能提升了3倍，根据智谱进行的测试，其硬件效率和单token成本已达到与主流英伟达GPU相当的水平。
6. 【国产CPU&GPU&超节点产品受益，建议关注相关龙头公司】
7. 芯片层面：建议关注国产CPU、GPU龙头海光信息等。
8. 整机层面：建议关注浪潮信息、深信服等国产超节点龙头厂商。
