🍍OpenAI降价,token成本下降利好应用 🔺事件:7月30日OpenAI宣布对GPT-5.6两档模型降价,理由是推理服务效率提升。 🔺关键信息: 🔸Lun
- 序号:173
- 星球链接:打开网页
- 附件:图片 0,音频 0,文档 0
- 音频文件:无音频
图片
无图片
正文
🍍OpenAI降价,token成本下降利好应用
🔺事件:7月30日OpenAI宣布对GPT-5.6两档模型降价,理由是推理服务效率提升。
🔺关键信息: 🔸Luna(最快最便宜档):降约80%,输入/输出从$1/$6降至$0.2/$1.2(每百万token)。 🔸Terra(中端档):降约20%,输入/输出从$2.5/$15降至$2/$12。 🔸Sol(旗舰档):不降价,仍$5/$30。 🔸OpenAI直言:更便宜的中国开源模型(Kimi K3、DeepSeek V4等)正加大对OpenAI/Anthropic的压力,倒逼其证明高价的合理性;同时长程Agent任务吃Token远多于聊天,两家近月都在反复调价、调限额。
🔺点评: ①降价的是走量档(Luna/Terra)而非旗舰Sol,本质是“效率提升+中国开源施压”双轮驱动的Token通缩——能力上限继续卖高价,走量能力则被打到地板价; ②这印证我们此前判断:开源逼近闭源SOTA后,模型能力被商品化,价值分配从“卖模型”转向“用模型做出结果”,海内外同此逻辑; ③Token单价大幅下探,直接降低应用/Agent层的推理成本,尤其利好Token消耗大的Work/Agent类应用——单位成本下降往往带来调用量爆发(杰文斯悖论),有望驱动应用渗透加速; ④降价是普惠的,真正受益的是有真实场景、数据壁垒和高Token消耗的应用;且降的是走量档,复杂旗舰任务成本未必降。
🔺相关标的:AI应用/Agent落地方向(有场景+数据壁垒者优先),看好办公/Work落地,关注泛微、用友、金山等;国产模型&场景端【腾讯】、阿里。
总体总结
主题正文
- 🔺事件:7月30日OpenAI宣布对GPT-5.6两档模型降价,理由是推理服务效率提升。
- 🔸Luna(最快最便宜档):降约80%,输入/输出从$1/$6降至$0.2/$1.2(每百万token)。
- 🔸Terra(中端档):降约20%,输入/输出从$2.5/$15降至$2/$12。
- 🔸OpenAI直言:更便宜的中国开源模型(Kimi K3、DeepSeek V4等)正加大对OpenAI/Anthropic的压力,倒逼其证明高价的合理性;
- ①降价的是走量档(Luna/Terra)而非旗舰Sol,本质是“效率提升+中国开源施压”双轮驱动的Token通缩——能力上限继续卖高价,走量能力则被打到地板价;
- ②这印证我们此前判断:开源逼近闭源SOTA后,模型能力被商品化,价值分配从“卖模型”转向“用模型做出结果”,海内外同此逻辑;
- ③Token单价大幅下探,直接降低应用/Agent层的推理成本,尤其利好Token消耗大的Work/Agent类应用——单位成本下降往往带来调用量爆发(杰文斯悖论),有望驱动应用渗透加速;
- 🔺相关标的:AI应用/Agent落地方向(有场景+数据壁垒者优先),看好办公/Work落地,关注泛微、用友、金山等;