---
title: "【申万计算机】智谱牛来GLM 5.3 Flash发布，推理流量全部由国产芯片支持 [烟花]牛来推理流量全部由国产算力支持！效率接近英伟达 过去一周，智谱【首次】"
topic_id: 82258828512555522
created_at: 2026-08-27T08:12:16.096+0800
source: zsxq
type: topic
cssclasses: zsxq-vault
---

# 【申万计算机】智谱牛来GLM 5.3 Flash发布，推理流量全部由国产芯片支持 [烟花]牛来推理流量全部由国产算力支持！效率接近英伟达 过去一周，智谱【首次】

- 序号：626
- 星球链接：[打开网页](https://wx.zsxq.com/group/15522451881222/topic/82258828512555522)
- 附件：图片 0，音频 0，文档 0
- 音频文件：_无音频_

## 图片

_无图片_

## 正文

【申万计算机】智谱牛来GLM 5.3 Flash发布，推理流量全部由国产芯片支持

[烟花]牛来推理流量全部由国产算力支持！效率接近英伟达
过去一周，智谱【首次】在【大规模流量】中尝试用大【国产芯片集群】提供服务，这些芯片通过自研高带宽互联网络连接。为克服单张芯片算力与内存容量相对有限的问题，智谱在SGLang 基础上构建了专用的推理引擎。

[烟花]GLM-5.3-Flash 已在大规模国产 AI 芯片集群上实现【接近】 NVIDIA GPU 的推理效率

我们认为，GLM-5.3 Flash作为高性价比的前沿智能模型，对国产算力的支持将再次带动国产AI芯片的需求！

[烟花]性能跃升，比肩国际顶尖模型
GLM-5.3-Flash 总参数量达 3200 亿（320B-A18B），是 GLM-5 系列首个原生多模态模型。AA综合智能指数得分与 Anthropic 旗舰模型 Claude Opus 4.8 持平。

[烟花]极致性价比，价格仅为 1/40
GLM-5.3-Flash 的定价策略堪称颠覆性：
1）定价为 GLM-5.3 的 1/10
2）限时折扣价低至 GLM-5.3 的 1/20，仅为 Opus 4.8 的 1/40，意味着以 1/40 的成本即可获得同等前沿智能

[烟花]重点方向
[玫瑰]超节点服务器：浪潮信息、联想集团、华勤技术（电子）、中科曙光、紫光股份（通信）
[玫瑰]AI芯片：华为昇腾、寒武纪、海光信息、天数智芯、壁仞科技、摩尔线程、壁仞科技
[玫瑰]连接器（部分军工）：华丰科技、胜蓝股份、中航光电、航天电器、立讯精密

## 总体总结

主题正文
1. 【申万计算机】智谱牛来GLM 5.3 Flash发布，推理流量全部由国产芯片支持
2. 过去一周，智谱【首次】在【大规模流量】中尝试用大【国产芯片集群】提供服务，这些芯片通过自研高带宽互联网络连接。
3. [烟花]GLM-5.3-Flash 已在大规模国产 AI 芯片集群上实现【接近】 NVIDIA GPU 的推理效率
4. 我们认为，GLM-5.3 Flash作为高性价比的前沿智能模型，对国产算力的支持将再次带动国产AI芯片的需求！
5. GLM-5.3-Flash 总参数量达 3200 亿（320B-A18B），是 GLM-5 系列首个原生多模态模型。
6. AA综合智能指数得分与 Anthropic 旗舰模型 Claude Opus 4.8 持平。
7. [烟花]极致性价比，价格仅为 1/40
8. 2）限时折扣价低至 GLM-5.3 的 1/20，仅为 Opus 4.8 的 1/40，意味着以 1/40 的成本即可获得同等前沿智能
