前沿模型密集发布,国产调用持续问鼎-20260816 🔥事件:继Kimi K3后,近期DS V4 Pro、GLM-5.3、Grok 4.6等前沿模型接连发布,国

图片

无图片

正文

前沿模型密集发布,国产调用持续问鼎-20260816

🔥事件:继Kimi K3后,近期DS V4 Pro、GLM-5.3、Grok 4.6等前沿模型接连发布,国产模型兼具性能、定价优势,稳居全球调用榜首。

1️⃣国内:1)DeepSeek:8月13日,DeepSeek V4 Pro正式版发布,Deep SWE测试得分从预览版的12.8升至62.7,模型能力显著提升;2)智谱:8月14日,发布旗舰模型GLM 5.3,Coding能力在多基准测试中取得开源第一;3)阿里:8月3日,正式发布Qwen3.8-Max,编程、办公、科研以及长程任务等方面明显提升。

2️⃣国外:1)SpaceX:8月12日,正式发布Grok 4.6,强化长程Agent能力,多测试分数超过旗舰竞品,并突出性价比;2)谷歌:8月13日,发布Gemini 3.7 Flash,其软件工程能力大幅提高;3)OpenAI:8月对Chat版GPT-5.6 Sol重新调优,并新增Ultrafast超高速模式,最高可达750 output tokens/秒,推理速度提升。

3️⃣国产模型调用持续问鼎。据OpenRouter,8月3-9日全球大模型调用量69万亿Token,其中国产模型调用34.25万亿Token(环比+21.76%),连续15周超过美国,稳居全球首位;同时,8月调用量榜TOP5被国产模型包揽。当前,国产开源大模型在模型架构、推理性能、场景适配等方面实现突破,正重塑全球大模型格局。

总体总结

主题正文

  1. 🔥事件:继Kimi K3后,近期DS V4 Pro、GLM-5.3、Grok 4.6等前沿模型接连发布,国产模型兼具性能、定价优势,稳居全球调用榜首。
  2. 1️⃣国内:1)DeepSeek:8月13日,DeepSeek V4 Pro正式版发布,Deep SWE测试得分从预览版的12.8升至62.7,模型能力显著提升;
  3. 2)智谱:8月14日,发布旗舰模型GLM 5.3,Coding能力在多基准测试中取得开源第一;
  4. 3)阿里:8月3日,正式发布Qwen3.8-Max,编程、办公、科研以及长程任务等方面明显提升。
  5. 2️⃣国外:1)SpaceX:8月12日,正式发布Grok 4.6,强化长程Agent能力,多测试分数超过旗舰竞品,并突出性价比;
  6. 2)谷歌:8月13日,发布Gemini 3.7 Flash,其软件工程能力大幅提高;
  7. 3)OpenAI:8月对Chat版GPT-5.6 Sol重新调优,并新增Ultrafast超高速模式,最高可达750 output tokens/秒,推理速度提升。
  8. 据OpenRouter,8月3-9日全球大模型调用量69万亿Token,其中国产模型调用34.25万亿Token(环比+21.76%),连续15周超过美国,稳居全球首位;