摘要
DeepSeek、Qwen、Kimi,美国和硅谷已经快经不起中国开源大模型的连环暴击了。Sad。 7月27日深夜,月之暗面(Kimi)正式开源了K3的模型权重。2.8万亿总参数、性能据说接近全球最顶级模型Claude Fable 5,完全免费下载、本地部署、自由商用,太炸裂了。 硅谷再一次恐慌,费城半导体和美股狂跌。黄仁勋紧急开通X,发公开信力挺中国AI,下面签名的公司,已经有一大串了。 摩根大通说这是"DeepSeek 2.0 时刻",杨植麟,终于走到了一个和梁文锋接近的位置。杨圣,呼之欲出。 作为中国最顶级的两家独立大模型公司,DeepSeek和Kimi你追我赶,各不相让。去年初的DeepSeek R1让梁文锋封神,杨植麟失意,而今,他终于靠K3扳回了一局。 技术之外,这两家公司也走在资本化的竞速路上。按照最新融资估值,两家都已达到500亿美元。从流程来判断,Kimi的上市之路会比DeepSeek更快。 梁圣也好,杨圣也罢,他们都是中国开源模型的代表,共同向世界展示了,中国大模型,快追上美国了。全球AI,中美双线叙事开演。 1、 一家中国创业公司,一个90后。这次算是扬眉吐气了。 Kimi K3是2.8 万亿参数的MoE模型,在Artificial Analysis智能指数上排全球第三,前面只 有 Claude Fable 5和GPT-5.6 Sol;在Frontend Code Arena编程榜单上 ,则 以 1679 分登顶 ,超越所有闭源模型。 K3通过 KDA 混合线性注意力、Attention Residuals 等架构创新,用远少于 OpenAI、Anthropic 的算力和资金,训出了接近它们的模型 ,这与DS去年的冲击的逻辑一致。 更意外的是,这么强的模型给大家全开放了。AI创业者拍手称庆,“他们永远也夺不走我的Fable 5”了,Kimi K3,成了他们的Fable 5。 不过,Kimi的算力瓶颈也是显而易见,7月19日宣布暂停C端新用户订阅,优先保障现有付费用户算力。 硅谷感受到中国大模型的强压,不是第一次了。 2025年1月,DeepSeek发布R1并同步开源权重,硅谷震动。