前沿模型密集发布,国产调用持续问鼎-20260816 🔥事件:继Kimi K3后,近期DS V4 Pro、GLM-5.3、Grok 4.6等前沿模型接连发布,国
- 序号:412
- 星球链接:打开网页
- 附件:图片 0,音频 0,文档 0
- 音频文件:无音频
图片
无图片
正文
前沿模型密集发布,国产调用持续问鼎-20260816
🔥事件:继Kimi K3后,近期DS V4 Pro、GLM-5.3、Grok 4.6等前沿模型接连发布,国产模型兼具性能、定价优势,稳居全球调用榜首。
1️⃣国内:1)DeepSeek:8月13日,DeepSeek V4 Pro正式版发布,Deep SWE测试得分从预览版的12.8升至62.7,模型能力显著提升;2)智谱:8月14日,发布旗舰模型GLM 5.3,Coding能力在多基准测试中取得开源第一;3)阿里:8月3日,正式发布Qwen3.8-Max,编程、办公、科研以及长程任务等方面明显提升。
2️⃣国外:1)SpaceX:8月12日,正式发布Grok 4.6,强化长程Agent能力,多测试分数超过旗舰竞品,并突出性价比;2)谷歌:8月13日,发布Gemini 3.7 Flash,其软件工程能力大幅提高;3)OpenAI:8月对Chat版GPT-5.6 Sol重新调优,并新增Ultrafast超高速模式,最高可达750 output tokens/秒,推理速度提升。
3️⃣国产模型调用持续问鼎。据OpenRouter,8月3-9日全球大模型调用量69万亿Token,其中国产模型调用34.25万亿Token(环比+21.76%),连续15周超过美国,稳居全球首位;同时,8月调用量榜TOP5被国产模型包揽。当前,国产开源大模型在模型架构、推理性能、场景适配等方面实现突破,正重塑全球大模型格局。
总体总结
主题正文
- 🔥事件:继Kimi K3后,近期DS V4 Pro、GLM-5.3、Grok 4.6等前沿模型接连发布,国产模型兼具性能、定价优势,稳居全球调用榜首。
- 1️⃣国内:1)DeepSeek:8月13日,DeepSeek V4 Pro正式版发布,Deep SWE测试得分从预览版的12.8升至62.7,模型能力显著提升;
- 2)智谱:8月14日,发布旗舰模型GLM 5.3,Coding能力在多基准测试中取得开源第一;
- 3)阿里:8月3日,正式发布Qwen3.8-Max,编程、办公、科研以及长程任务等方面明显提升。
- 2️⃣国外:1)SpaceX:8月12日,正式发布Grok 4.6,强化长程Agent能力,多测试分数超过旗舰竞品,并突出性价比;
- 2)谷歌:8月13日,发布Gemini 3.7 Flash,其软件工程能力大幅提高;
- 3)OpenAI:8月对Chat版GPT-5.6 Sol重新调优,并新增Ultrafast超高速模式,最高可达750 output tokens/秒,推理速度提升。
- 据OpenRouter,8月3-9日全球大模型调用量69万亿Token,其中国产模型调用34.25万亿Token(环比+21.76%),连续15周超过美国,稳居全球首位;