---
title: "[红包]【GLM 5.3-Flash】OxAlpha获官方确认，多模态+超高性价比+国产推理 [太阳]事件：8月26日，智谱发布并开源GLM-5.3-Flash"
topic_id: 82258828851451582
created_at: 2026-08-27T09:39:03.994+0800
source: zsxq
type: topic
cssclasses: zsxq-vault
---

# [红包]【GLM 5.3-Flash】OxAlpha获官方确认，多模态+超高性价比+国产推理 [太阳]事件：8月26日，智谱发布并开源GLM-5.3-Flash

- 序号：441
- 星球链接：[打开网页](https://wx.zsxq.com/group/15522451881222/topic/82258828851451582)
- 附件：图片 0，音频 0，文档 0
- 音频文件：_无音频_

## 图片

_无图片_

## 正文

[红包]【GLM 5.3-Flash】OxAlpha获官方确认，多模态+超高性价比+国产推理

[太阳]事件：8月26日，智谱发布并开源GLM-5.3-Flash，系智谱首款具备多模态理解能力的模型，总参数/激活参数量为320B/18B，支持1M上下文。模型已面向API及GLM Coding Plan用户开放，在Hugging Face同步开源。

[太阳]【Coding Benchmark比肩Opus 4.8】DeepSWE v1.1得分63.4，高于Opus 4.8的58.0和DS-V4-Vision-Exp的59.3，低于GPT-5.6 Terra的69.6；Terminal Bench 2.1得分84.3，稍高于GLM-5.2的81.0和DS-V4-Vision-Exp的83.9，略低于Opus 4.8的85.0及Terra的87.4。 以极致性价比提供国产第一梯队Coding能力。

[太阳]【模型架构升级】引入线性注意力与稀疏注意力混合架构，并通过IndexPool将4个索引键向量加权压缩为1个；相较GLM-5.3，单token的注意力计算量降低3.0倍，平均KV Cache降低4.4倍。 以更低计算量和显存占用实现更低推理成本， 进而打开API降价空间。

[太阳]【多模态理解Benchmark同步达到Opus 4.8水平】将视觉能力原生嵌入Coding闭环，可观察网页、渲染结果和交互反馈，支持Browser Use、Computer Use及Office文档工作流。CharXiv得分89.4，低于Opus 4.8的89.9，高于GPT-5.6 Terra的88.0；Chartography得分78.0，略高于Opus 4.8的75.0和DS-V4-Vision-Exp的64.3。

[太阳]【API定价超高性价比】百万tokens计缓存命中/输入/输出分别为0.8/2.8元；首发两周5折至0.4/1.4元。对比DeepSeek-V4-Flash-Exp闲时价格1.5/4.5元，新发布的Qwen3.8-Flash-Next 1/3元，仍具有较高性价比。

[太阳]【OxAlpha阶段采用全国产推理】根据智谱官方微信公众号，此前OxAlpha在OpenCode和OpenRouter上的大规模测试，请求流量全部由国产芯片提供算力支持。 证明国产芯片完全可以在大规模场景下高效、经济地支撑前沿模型的推理需求。

## 总体总结

主题正文
1. [太阳]事件：8月26日，智谱发布并开源GLM-5.3-Flash，系智谱首款具备多模态理解能力的模型，总参数/激活参数量为320B/18B，支持1M上下文。
2. [太阳]【Coding Benchmark比肩Opus 4.8】DeepSWE v1.1得分63.4，高于Opus 4.8的58.0和DS-V4-Vision-Exp的59.3，低于GPT-5.6 Terra的69.6；
3. Terminal Bench 2.1得分84.3，稍高于GLM-5.2的81.0和DS-V4-Vision-Exp的83.9，略低于Opus 4.8的85.0及Terra的87.4。
4. [太阳]【模型架构升级】引入线性注意力与稀疏注意力混合架构，并通过IndexPool将4个索引键向量加权压缩为1个；
5. [太阳]【多模态理解Benchmark同步达到Opus 4.8水平】将视觉能力原生嵌入Coding闭环，可观察网页、渲染结果和交互反馈，支持Browser Use、Computer Use及Office文档工作流。
6. Chartography得分78.0，略高于Opus 4.8的75.0和DS-V4-Vision-Exp的64.3。
7. 对比DeepSeek-V4-Flash-Exp闲时价格1.5/4.5元，新发布的Qwen3.8-Flash-Next 1/3元，仍具有较高性价比。
8. [太阳]【OxAlpha阶段采用全国产推理】根据智谱官方微信公众号，此前OxAlpha在OpenCode和OpenRouter上的大规模测试，请求流量全部由国产芯片提供算力支持。
