[红包]【GLM 5.3-Flash】OxAlpha获官方确认,多模态+超高性价比+国产推理 [太阳]事件:8月26日,智谱发布并开源GLM-5.3-Flash
- 序号:441
- 星球链接:打开网页
- 附件:图片 0,音频 0,文档 0
- 音频文件:无音频
图片
无图片
正文
[红包]【GLM 5.3-Flash】OxAlpha获官方确认,多模态+超高性价比+国产推理
[太阳]事件:8月26日,智谱发布并开源GLM-5.3-Flash,系智谱首款具备多模态理解能力的模型,总参数/激活参数量为320B/18B,支持1M上下文。模型已面向API及GLM Coding Plan用户开放,在Hugging Face同步开源。
[太阳]【Coding Benchmark比肩Opus 4.8】DeepSWE v1.1得分63.4,高于Opus 4.8的58.0和DS-V4-Vision-Exp的59.3,低于GPT-5.6 Terra的69.6;Terminal Bench 2.1得分84.3,稍高于GLM-5.2的81.0和DS-V4-Vision-Exp的83.9,略低于Opus 4.8的85.0及Terra的87.4。 以极致性价比提供国产第一梯队Coding能力。
[太阳]【模型架构升级】引入线性注意力与稀疏注意力混合架构,并通过IndexPool将4个索引键向量加权压缩为1个;相较GLM-5.3,单token的注意力计算量降低3.0倍,平均KV Cache降低4.4倍。 以更低计算量和显存占用实现更低推理成本, 进而打开API降价空间。
[太阳]【多模态理解Benchmark同步达到Opus 4.8水平】将视觉能力原生嵌入Coding闭环,可观察网页、渲染结果和交互反馈,支持Browser Use、Computer Use及Office文档工作流。CharXiv得分89.4,低于Opus 4.8的89.9,高于GPT-5.6 Terra的88.0;Chartography得分78.0,略高于Opus 4.8的75.0和DS-V4-Vision-Exp的64.3。
[太阳]【API定价超高性价比】百万tokens计缓存命中/输入/输出分别为0.8/2.8元;首发两周5折至0.4/1.4元。对比DeepSeek-V4-Flash-Exp闲时价格1.5/4.5元,新发布的Qwen3.8-Flash-Next 1/3元,仍具有较高性价比。
[太阳]【OxAlpha阶段采用全国产推理】根据智谱官方微信公众号,此前OxAlpha在OpenCode和OpenRouter上的大规模测试,请求流量全部由国产芯片提供算力支持。 证明国产芯片完全可以在大规模场景下高效、经济地支撑前沿模型的推理需求。
总体总结
主题正文
- [太阳]事件:8月26日,智谱发布并开源GLM-5.3-Flash,系智谱首款具备多模态理解能力的模型,总参数/激活参数量为320B/18B,支持1M上下文。
- [太阳]【Coding Benchmark比肩Opus 4.8】DeepSWE v1.1得分63.4,高于Opus 4.8的58.0和DS-V4-Vision-Exp的59.3,低于GPT-5.6 Terra的69.6;
- Terminal Bench 2.1得分84.3,稍高于GLM-5.2的81.0和DS-V4-Vision-Exp的83.9,略低于Opus 4.8的85.0及Terra的87.4。
- [太阳]【模型架构升级】引入线性注意力与稀疏注意力混合架构,并通过IndexPool将4个索引键向量加权压缩为1个;
- [太阳]【多模态理解Benchmark同步达到Opus 4.8水平】将视觉能力原生嵌入Coding闭环,可观察网页、渲染结果和交互反馈,支持Browser Use、Computer Use及Office文档工作流。
- Chartography得分78.0,略高于Opus 4.8的75.0和DS-V4-Vision-Exp的64.3。
- 对比DeepSeek-V4-Flash-Exp闲时价格1.5/4.5元,新发布的Qwen3.8-Flash-Next 1/3元,仍具有较高性价比。
- [太阳]【OxAlpha阶段采用全国产推理】根据智谱官方微信公众号,此前OxAlpha在OpenCode和OpenRouter上的大规模测试,请求流量全部由国产芯片提供算力支持。