[跳跳]WorkBuddy调用混元4火热,当前排队较长 [發]华泰观点:我们强调Buddy系列对后训练的数据价值。WorkBuddy 访问量国内登顶;CodeB

图片

无图片

正文

[跳跳]WorkBuddy调用混元4火热,当前排队较长

[發]华泰观点:我们强调Buddy系列对后训练的数据价值。WorkBuddy 访问量国内登顶;CodeBuddy则持续沉淀高质量代码Agent轨迹。当前国内模型竞争重心仍在后训练,Buddy积累的长程任务、纠错过程及真实Eval,有望构成混元的重要数据优势

1️⃣ 模型能力:代码及长程Agent能力显著提升。 Hy4 Preview采用770B总参数、49B激活参数及1M上下文。DeepSWE由Hy3的28.0提升至64.3,Terminal-Bench 2.1由70.8提升至85.4,代码与长程Agent能力进步明显。49B激活参数本身既不稀疏也不轻量,腾讯此次路线较此前极致降本有所转变,对智能前沿能力的探索更加侧重

2️⃣ 价格定位:延续低价策略,定位性能优先的中档价格带。 Hy4 Preview输入/输出/缓存命中价格分别为6/18/0.3元/百万token,尤其缓存命中价格较低;对比GLM-5.3 Flash为0.8/2.8/0.23元,DeepSeek V4 Flash为3/9/0.1元,V4 Pro为9/27/0.3元(高峰时段)。

总体总结

主题正文

  1. [跳跳]WorkBuddy调用混元4火热,当前排队较长
  2. 当前国内模型竞争重心仍在后训练,Buddy积累的长程任务、纠错过程及真实Eval,有望构成混元的重要数据优势
  3. Hy4 Preview采用770B总参数、49B激活参数及1M上下文。
  4. DeepSWE由Hy3的28.0提升至64.3,Terminal-Bench 2.1由70.8提升至85.4,代码与长程Agent能力进步明显。
  5. 49B激活参数本身既不稀疏也不轻量,腾讯此次路线较此前极致降本有所转变,对智能前沿能力的探索更加侧重
  6. 2️⃣ 价格定位:延续低价策略,定位性能优先的中档价格带。
  7. Hy4 Preview输入/输出/缓存命中价格分别为6/18/0.3元/百万token,尤其缓存命中价格较低;
  8. 对比GLM-5.3 Flash为0.8/2.8/0.23元,DeepSeek V4 Flash为3/9/0.1元,V4 Pro为9/27/0.3元(高峰时段)。