ds大超预期,v4 Flash正式版能力逼近opus 4.8,看好26H2国产模型加速成长【天风计算机缪欣君团队】 能力:基准测试远超 V4-Pro-Previ
- 序号:030
- 星球链接:打开网页
- 附件:图片 0,音频 0,文档 0
- 音频文件:无音频
图片
无图片
正文
ds大超预期,v4 Flash正式版能力逼近opus 4.8,看好26H2国产模型加速成长【天风计算机缪欣君团队】
能力:基准测试远超 V4-Pro-Preview。DeepSeek V4 Flash 正式版作为284b小模型跻身国产开源Agentic模型第一梯队。Agent编程测试中领先GLM-5.2,弱于k3;看海外,Agent Coding能力已接近GPT-5.6 Luna,综合能力略低于Opus 4.8、Luna,进一步低于Terra和Sol。
价格:推理价格只有 V4 Pro 的三分之一、GPT-5.6 Luna的1/3(降价后)、Terra的数十分之一、Sol和Opus的~1/100,延续国产模型极致性价比优势。
实现路径:V4 Flash与V4 Pro属于同一代、同一技术路线,架构范式差别不大。CSA+HCA、mHC和超大MoE构成的V4底座具备较高智力上限,但首版后训练和Agent Harness尚未充分释放其能力,补齐后训练后能力大幅释放,我们认为,V4 Pro正式版会更值得期待。
考虑v4的超预期提升,我们核心观点:1)重申看好国产模型下半年的国产模型百花齐放, 重点关注国产链。因为这背后本质是国产的模型在严肃办公场景进入“好用”这一跨越带来的,价格有极大优势,且能力进阶的引发的真实需求。2)模型智力提升,而单价大幅降低, 更优质的供给带来下游更充裕的应用需求。从Coding到Cowork,看好有基本面软件公司受益ai带来的增量需求,建议关注成长性30%+,同时叙事变化标的。
总体总结
主题正文
- ds大超预期,v4 Flash正式版能力逼近opus 4.8,看好26H2国产模型加速成长【天风计算机缪欣君团队】
- DeepSeek V4 Flash 正式版作为284b小模型跻身国产开源Agentic模型第一梯队。
- 看海外,Agent Coding能力已接近GPT-5.6 Luna,综合能力略低于Opus 4.8、Luna,进一步低于Terra和Sol。
- 价格:推理价格只有 V4 Pro 的三分之一、GPT-5.6 Luna的1/3(降价后)、Terra的数十分之一、Sol和Opus的~1/100,延续国产模型极致性价比优势。
- CSA+HCA、mHC和超大MoE构成的V4底座具备较高智力上限,但首版后训练和Agent Harness尚未充分释放其能力,补齐后训练后能力大幅释放,我们认为,V4 Pro正式版会更值得期待。
- 考虑v4的超预期提升,我们核心观点:1)重申看好国产模型下半年的国产模型百花齐放, 重点关注国产链。
- 因为这背后本质是国产的模型在严肃办公场景进入“好用”这一跨越带来的,价格有极大优势,且能力进阶的引发的真实需求。
- 从Coding到Cowork,看好有基本面软件公司受益ai带来的增量需求,建议关注成长性30%+,同时叙事变化标的。