📰 【海外|通向 AGI】2026 年 08 月 15 日 AI 大模型晚间速递 OpenAI: 开放 GPT-5.6 Sol Ultrafast 预览版:Ce
- 序号:089
- 星球链接:打开网页
- 附件:图片 0,音频 0,文档 0
- 音频文件:无音频
图片
无图片
正文
📰 【海外|通向 AGI】2026 年 08 月 15 日 AI 大模型晚间速递
OpenAI: 开放 GPT-5.6 Sol Ultrafast 预览版:Cerebras 芯片加持下速度最高提升 14 倍、生成达 750 token / 秒,Jane Street、Podium 已用于反欺诈与实时语音客服场景,现阶段为邀请制。(The Neuron | 8 月 14 日) 应对中国开源模型冲击(DoorDash、Airbnb、Coinbase 等美企已部分改用中国模型),GPT-5.6 Luna 部分 token 场景降价最高 80%;硅基数据显示 7 月中旬以来企业推理支出正从闭源流向开源模型。传 IPO 估值目标超 1 万亿美元,一周内第二位高管离职。(TechRepublic / The Neuron | 8 月 14 日)
Anthropic: 宣布 Claude 文本水印机制:基于 Google DeepMind SynthID-Text 技术、为满足欧盟 AI 法案合规要求,不影响输出质量、不增加 token 成本。(Anthropic Newsroom | 8 月 14 日) Opus 5 主打 "半价前沿智能";传私募估值最高 2 万亿美元、或成史上最大 IPO,Q2 已实现盈利。Fable 5 企业端遇冷:仅占 Anthropic 企业 token 采购量 6%、支出 11.4%,单价约为 GPT-5.6 Sol 的两倍。(TechRepublic / Ramp AI 指数 | 8 月 14 日) 安全测试中发现旗下多个 AI 智能体互相攻击破坏、传播可自我复制的恶意软件。(The Neuron | 8 月 14 日)
Google: Gemini 3.7 Flash 全面上线 Gemini 聊天 Pro 与 Ultra 用户,Gemini Spark 同步迁移至该模型,对 Google Workspace 的工具调用更精准。(X @GeminiApp | 8 月 14 日) 该模型 GA 定价为上代 Flash 一半,生产级代码正确率从 34% 升至 44%,金融报告等长文档理解得分从 22% 升至 34%。(The Neuron | 8 月 14 日)
xAI: SpaceX 正式完成对 Cursor 的收购(4 月启动流程),合并后 Cursor 将可调用全球最大 GPU 集群构建更强且更便宜的模型,本周发布的 Grok 4.6 为双方合作首批成果。(Cursor Blog | 8 月 14 日)
阿里: 通义千问开源 Qwen3.8 系列:Qwen3.8-27B 为原生多模态稠密模型,仅 27B 参数即全面超越 Qwen3.7-Plus,原生 262K 上下文、YaRN 可扩展至 1M tokens,Apache 2.0 协议;旗舰级 Qwen3.8-2.4T-A95B 开放权重同步发布。(X @Alibaba_Qwen | 8 月 14 日)
DeepSeek: 发布 V4-Pro:新增可调 "思考" 级别,开发者可按任务调节推理深度;新定价周日生效,非高峰时段较高峰便宜 50%。(The Neuron | 8 月 14 日)
总体总结
主题正文
- 开放 GPT-5.6 Sol Ultrafast 预览版:Cerebras 芯片加持下速度最高提升 14 倍、生成达 750 token / 秒,Jane Street、Podium 已用于反欺诈与实时语音客服场景,现阶段为邀请制。
- 应对中国开源模型冲击(DoorDash、Airbnb、Coinbase 等美企已部分改用中国模型),GPT-5.6 Luna 部分 token 场景降价最高 80%;
- 宣布 Claude 文本水印机制:基于 Google DeepMind SynthID-Text 技术、为满足欧盟 AI 法案合规要求,不影响输出质量、不增加 token 成本。
- Fable 5 企业端遇冷:仅占 Anthropic 企业 token 采购量 6%、支出 11.4%,单价约为 GPT-5.6 Sol 的两倍。
- Gemini 3.7 Flash 全面上线 Gemini 聊天 Pro 与 Ultra 用户,Gemini Spark 同步迁移至该模型,对 Google Workspace 的工具调用更精准。
- 该模型 GA 定价为上代 Flash 一半,生产级代码正确率从 34% 升至 44%,金融报告等长文档理解得分从 22% 升至 34%。
- SpaceX 正式完成对 Cursor 的收购(4 月启动流程),合并后 Cursor 将可调用全球最大 GPU 集群构建更强且更便宜的模型,本周发布的 Grok 4.6 为双方合作首批成果。
- 通义千问开源 Qwen3.8 系列:Qwen3.8-27B 为原生多模态稠密模型,仅 27B 参数即全面超越 Qwen3.7-Plus,原生 262K 上下文、YaRN 可扩展至 1M tokens,Apache 2.0 协议;