Latest

Grok 4.6 和 DeepSeek V4 Pro-0813 接连发布:2026年8月的大模型格局速览

数据核实时间:2026年8月14日。文中benchmark分数均为厂商自报或第三方聚合站(Artificial Analysis等)数据,非独立中立测试,具体数字以各官方页面实时公示为准。 TL;DR 2026年8月12日到13日,xAI和DeepSeek在24小时内接连发布Grok 4.6和DeepSeek V4 Pro-0813。前者主打长程Agent任务和视觉交互能力,跑分逼近Fable 5级别;后者是一次低调的静默更新,没有发布会,但在编程类benchmark上有大幅跳升。放在一起看,能观察到一个更大的趋势:开源模型和闭源旗舰的差距,正在以肉眼可见的速度缩小。 Grok 4.6:不是上下文升级,是Agent持续力升级 xAI于2026年8月12日发布Grok 4.6,距离上一代Grok 4.5发布仅一个月。官方博客说明这次的重点不是把上下文窗口做大——上下文窗口维持在50万token,跟4.5一致——而是让模型在长链条任务里"待得住":无论是深挖一个代码库、多步骤研究一个陌生话题,还是把一个粗糙的原型迭代成可用软件,模型都被要求保持任务连续性。
LMU

AI

Claude API

Claude Code