【申万计算机周报】关注华为超节点进展!国产大模型多更新! 本周周报重点:1)华为超节点;2)智谱、DeepSeek大模型发布。 关注26Q4超节点上市! [礼物
- 序号:013
- 星球链接:打开网页
- 附件:图片 0,音频 0,文档 0
- 音频文件:无音频
图片
无图片
正文
【申万计算机周报】关注华为超节点进展!国产大模型多更新!
本周周报重点:1)华为超节点;2)智谱、DeepSeek大模型发布。
关注26Q4超节点上市! [礼物]当前国产算力确定性最高供应商之一—华为,超节点能力成熟。华为依托全栈自研打造Atlas 950 SuperPoD 超节点,构建国产 AI 算力全新范式。 [礼物]产品于 2026 WAIC 真机亮相,计划四季度上市,上一代 Atlas 900 超节点已商用 750 余套,目前已获科大讯飞、美团等头部企业深度适配验证,覆盖多行业大模型训练与高并发推理场景。
国产模型继续持续密集发布! [礼物]智谱发布 GLM 5.3:后训练 Scaling 驱动代码及 Agent 能力再跃升。本次提升官方明确表示来自后训练Scaling,在复杂编程能力、长程任务、网络安全方面表现强劲。 [礼物]在 Coding 等任务可执行、结果可验证的场景中,经过充分训后的较小参数模型能够以更低延迟和成本接近甚至超过更大参数的通用模型,但在跨代码库理解、复杂系统重构和长程规划等高难度任务中,预训练规模仍影响模型能力上限。 [礼物]DeepSeek 发布 V4 Pro 正式版。V4 Pro 的 Agent 成绩至少包含四层共同作用:模型后训练决定规划与工具调用倾向;Harness 决定上下文组织和循环;推理预算决定思考长度;工具与沙箱决定可执行边界。上述解释了官方跑分和外部部分测试体感不同的原因,可能来自于不同的harness系统。
总体总结
主题正文
- 本周周报重点:1)华为超节点;
- 关注26Q4超节点上市!
- 华为依托全栈自研打造Atlas 950 SuperPoD 超节点,构建国产 AI 算力全新范式。
- [礼物]产品于 2026 WAIC 真机亮相,计划四季度上市,上一代 Atlas 900 超节点已商用 750 余套,目前已获科大讯飞、美团等头部企业深度适配验证,覆盖多行业大模型训练与高并发推理场景。
- [礼物]智谱发布 GLM 5.3:后训练 Scaling 驱动代码及 Agent 能力再跃升。
- [礼物]在 Coding 等任务可执行、结果可验证的场景中,经过充分训后的较小参数模型能够以更低延迟和成本接近甚至超过更大参数的通用模型,但在跨代码库理解、复杂系统重构和长程规划等高难度任务中,预训练规模仍影响模型能力上限。
- V4 Pro 的 Agent 成绩至少包含四层共同作用:模型后训练决定规划与工具调用倾向;
- 上述解释了官方跑分和外部部分测试体感不同的原因,可能来自于不同的harness系统。