【国泰海通计算机】DeepSeek峰谷调价+Harness开源:定价修复与Agent框架双线推进 [玫瑰]DeepSeek由低价抢占份额转向商业化优先,全时段基

图片

无图片

正文

【国泰海通计算机】DeepSeek峰谷调价+Harness开源:定价修复与Agent框架双线推进

[玫瑰]DeepSeek由低价抢占份额转向商业化优先,全时段基准价上调叠加峰谷机制,行业价格底部得到抬升。事件:8月17日起实施分时定价,闲时基准价同步上调,并非仅高峰涨价。V4‑Pro输出由6元/百万tokens上调至闲时13.5元(2.25倍)、高峰27元(4.5倍);V4‑Flash输出由2元上调至闲时4.5元(2.25倍)、高峰9元(4.5倍),缓存命中调价幅度更高。分时机制通过价格引导流量错峰,优化算力资源调度效率。

[玫瑰]Harness开源补齐智能体执行层短板,降低Agent工程落地门槛,打开模型中长期增量空间。Deepseek Harness把工具/Skills/沙箱/调度/子Agent等全部插件化,不锁死自家模型、可接入第三方(含GLM),等于把竞争从“单模型分数”拉开到模型能力×Harness效率×Token消耗×商业化定价四维;其与智谱ZCode等路线形成“开源插件基建 vs 闭源深度优化入口”对照,Agent商业化从壳产品进入底座/生态争夺。

[玫瑰]独立大模型厂商API业务直接受益行业定价修复,建议关注MiniMax‑W、智谱; 算力错峰调度与调用量上行带动算力需求, 云厂、算力租赁厂商盈利具备改善预期。

总体总结

主题正文

  1. [玫瑰]DeepSeek由低价抢占份额转向商业化优先,全时段基准价上调叠加峰谷机制,行业价格底部得到抬升。
  2. V4‑Pro输出由6元/百万tokens上调至闲时13.5元(2.25倍)、高峰27元(4.5倍);
  3. V4‑Flash输出由2元上调至闲时4.5元(2.25倍)、高峰9元(4.5倍),缓存命中调价幅度更高。
  4. 分时机制通过价格引导流量错峰,优化算力资源调度效率。
  5. Deepseek Harness把工具/Skills/沙箱/调度/子Agent等全部插件化,不锁死自家模型、可接入第三方(含GLM),等于把竞争从“单模型分数”拉开到模型能力×Harness效率×Token消耗×商业化定价四维;
  6. 其与智谱ZCode等路线形成“开源插件基建 vs 闭源深度优化入口”对照,Agent商业化从壳产品进入底座/生态争夺。
  7. [玫瑰]独立大模型厂商API业务直接受益行业定价修复,建议关注MiniMax‑W、智谱;
  8. 算力错峰调度与调用量上行带动算力需求, 云厂、算力租赁厂商盈利具备改善预期。