Kimi K3,已经撕裂了整个硅谷 文章

极客公园 AI2026-07-24NEWSzh作者:

详细信息

来源站点
极客公园 AI
作者
文章类型
NEWS
语言
zh
发布日期
2026-07-24

别名

Kimi K3 卷起风暴,终极赢家还是黄仁勋?

摘要

DeepSeek 之后,又一个中国模型让美国紧张了。作者|宇航猿 编辑|靖宇 7 月 22 日,同一天里发生了四件事。 白宫科技政策办公室主任 Michael Kratsios 在 X 上公开指控月之暗面(Moonshot AI)的 Kimi K3 涉嫌「大规模蒸馏」美国模型。 OpenAI 总裁 Greg Brockman,在接受 Bloomberg 采访时承认 K3「是一个很不错的模型,毫无疑问」。 同时,近 200 家硅谷创业公司联名致信特朗普政府,警告如果封禁中国开源模型,「 将有数百家公司瞬间死亡 」。而 Nvidia CEO 黄仁勋,则在 Axios 的独家专访中明确表态,美国公司「绝对应该被允许使用中国模型」。 四种声音,四个方向,指向同一个导火索。 这个导火索就是 7 月 16 日,中国 AI 公司月之暗面发布的 Kimi K3。 如果说 DeepSeek 在 2025 年初引爆的那场冲击波,主要冲的是华尔街对 AI 基建投资的信仰。而 K3 引爆的这一轮,冲的是一个更根本的问题—— 当中国能以接近前沿的水平开放模型权重时,美国的 AI 产业应该怎么办? 能力步步紧逼的 Kimi K3,只用一周时间,就撕裂了整个硅谷和华盛顿。 01 不是「又一个中国模型」 先说 Kimi K3 本身。 2.8 万亿参数,MoE(混合专家)架构,896 个专家中每次激活 16 个,支持 100 万 token 的上下文窗口。这是目前全球最大的开放权重模型,完整权重将在 7 月 27 日公开发布。 在 Artificial Analysis 的智能指数上,K3 得分 57,排名第三—— 仅次于 Anthropic 的 Fable 5(60 分)和 OpenAI 的 GPT-5.6 Sol(59 分),超过了 Claude Opus 4.8(56 分) 。在前端代码能力上,K3 发布 24 小时内就登上了 Arena 排行榜的第一名,超过了所有美国前沿模型。 技术上,K3 引入了几项有意思的架构创新。 Kimi Delta Attention(KDA)是一种混合线性注意力机制,在百万 token 级别的上下文中实现了 6.3 倍的解码加速。