---
title: "唐杰老师上周对ScalingLaw的判断，暗示了这次Flash 的提升路径： Scaling没有结束，只是Scaling的维度不再只有参数量。总参数更多决定模型"
topic_id: 82258828881518222
created_at: 2026-08-27T10:50:51.857+0800
source: zsxq
type: topic
cssclasses: zsxq-vault
---

# 唐杰老师上周对ScalingLaw的判断，暗示了这次Flash 的提升路径： Scaling没有结束，只是Scaling的维度不再只有参数量。总参数更多决定模型

- 序号：308
- 星球链接：[打开网页](https://wx.zsxq.com/group/15522451881222/topic/82258828881518222)
- 附件：图片 0，音频 0，文档 0
- 音频文件：_无音频_

## 图片

_无图片_

## 正文

唐杰老师上周对ScalingLaw的判断，暗示了这次Flash 的提升路径：

Scaling没有结束，只是Scaling的维度不再只有参数量。总参数更多决定模型能“装多少知识”，激活参数和每次前向计算的有效深度，则决定模型能“想多深”。

GLM-5.3证明，基座、架构和参数量完全不变，仅扩大长程环境和RL后训练，能力仍能继续明显提升。说明后训练远没有到头，预训练得到的能力还有很大的挖掘空间；Flash 则进一步回到预训练和架构本身，提高单位参数的智能效率。

## 总体总结

主题正文
1. 唐杰老师上周对ScalingLaw的判断，暗示了这次Flash 的提升路径：
2. Scaling没有结束，只是Scaling的维度不再只有参数量。
3. 总参数更多决定模型能“装多少知识”，激活参数和每次前向计算的有效深度，则决定模型能“想多深”。
4. GLM-5.3证明，基座、架构和参数量完全不变，仅扩大长程环境和RL后训练，能力仍能继续明显提升。
5. 说明后训练远没有到头，预训练得到的能力还有很大的挖掘空间；
6. Flash 则进一步回到预训练和架构本身，提高单位参数的智能效率。
