摘要
一个月内,9款旗舰模型扎堆发布,这在大模型行业并不常见。 从月初腾讯混元Hy3发布正式版并开源,到月末Anthropic发布Claude Opus 5,其间Kimi K3、 Qwen3.8-Max预览版 、Grok 4.5等模型陆续登场。7月成为近一年少见的发布高峰。 各家选择的时间点并不相同。有的厂商借竞品更新后的间隙跟进发布,有的厂商选在世界人工智能大会前后亮相,也有厂商通过价格调整回应市场竞争。 但7月不只是模型发布的数量多,更值得注意的是这轮发布反映出的两个变化。 第一,模型之间的能力差距正在缩小。Artificial Analysis最新综合智能指数显示,头部模型之间的分差已经明显收窄。随着版本快速迭代,“最强模型”的位置越来越难长期保持,各家开始围绕不同任务寻找优势,而不是追求单一维度的绝对领先。 第二,开源模型正在进入第一梯队。7月发布的新模型中,腾讯混元Hy3、Kimi K3等选择开放权重(开放模型参数,允许开发者自行下载和部署)。其中,Kimi K3在Code Arena前端编程榜单中排名第一,超过GPT-5.6 Sol和Claude Fable 5。过去两年,开源模型更多被视为闭源模型的追赶者,而这一轮竞争显示,开源模型已经开始在部分开发场景中与闭源模型直接竞争。 那么,这一个月的密集发布究竟带来了哪些变化,又意味着什么? 01.不再只比谁更聪明 过去几年,大模型行业主要比拼通用能力,谁的知识面更广、谁的回答更准确。但现在,竞争维度已经变了。 这一轮,代码能力成为最明显的争夺方向。 OpenAI继续强化编程和复杂推理,并持续扩展Codex生态,希望通过开发工具绑定程序员用户。Anthropic押注代码理解和安全审计,帮助开发者处理大型项目中的复杂工程问题。Grok 4.5则强调速度和低成本,并与AI编程工具Cursor绑定,覆盖日常开发场景。 大模型研究者姚宇航告诉「定焦One」,各家公司都在重点投入编程能力,差距也在快速缩小,比如Kimi K3的代码能力提升明显,正在接近头部闭源模型的水平。 图源 / pexels