最近盛科通信的变化: 第一,在shjw做测试,效果还不错,但是6月底我就在说51.2T公司内部测试效果好。我觉得这个算51.2的确定性提升逻辑。 第二, 我认为
- 序号:162
- 星球链接:打开网页
- 附件:图片 0,音频 0,文档 0
- 音频文件:无音频
图片
无图片
正文
最近盛科通信的变化:
第一,在shjw做测试,效果还不错,但是6月底我就在说51.2T公司内部测试效果好。我觉得这个算51.2的确定性提升逻辑。
第二, 我认为主要是交易训练比重提升~交易互联
类似于这个逻辑
Ai的逻辑重大变化:从推理重回训练,gpu+网络升级再次是关键。从行业角度,后面模型迭代重点要重回预训练,大幅提升参数量,网络层数要大度提升,gpu+光应该是最受益。过去两年的核心是 搞推理,增加上下文长度。后面核心又回到 提升参数量,大力出奇迹。国内3万亿 到 10万亿,海外 到30-50万亿参数,按照这个量,scaleup和scaleout都要大幅提升,重回训练的话,nvda又变得稀缺了,光为代表的连接又变的重要了。
总体总结
主题正文
- 第一,在shjw做测试,效果还不错,但是6月底我就在说51.2T公司内部测试效果好。
- 我觉得这个算51.2的确定性提升逻辑。
- 第二, 我认为主要是交易训练比重提升~交易互联
- Ai的逻辑重大变化:从推理重回训练,gpu+网络升级再次是关键。
- 从行业角度,后面模型迭代重点要重回预训练,大幅提升参数量,网络层数要大度提升,gpu+光应该是最受益。
- 过去两年的核心是 搞推理,增加上下文长度。
- 后面核心又回到 提升参数量,大力出奇迹。
- 国内3万亿 到 10万亿,海外 到30-50万亿参数,按照这个量,scaleup和scaleout都要大幅提升,重回训练的话,nvda又变得稀缺了,光为代表的连接又变的重要了。