泡泡资讯网

外媒称中国在一个下午就烧掉了美国 AI 的领先优势!7 月 16 日,中国初创

外媒称中国在一个下午就烧掉了美国 AI 的领先优势!7 月 16 日,中国初创 AI 公司 "月之暗面"(Moonshot)发布的 Kimi K3,在编码测试中击败了 Anthropic 的 Fable 5 和 OpenAI 的 GPT-5.6 Sol,然后在更广泛的排名中略胜 Opus 4.8,同时成本还降低了 40%。

就在 7 月 15 日,Anthropic 高级主管声称,美国在尖端 AI 模型上仍保持 6 到 9 个月的领先优势,同时将中国竞争对手的模型蒸馏称为 "对抗性的"。结果就在 24 小时后,Moonshot 的 Kimi K3 在 Frontend Code Arena 上击败了 Claude Fable 5!

时间线拉出来看,戏剧性直接拉满。

7 月 15 号 Anthropic 高管还在外交关系协会的活动上侃侃而谈,说美国领先中国至少半年到九个月,还把中国模型的技术进步定性为 "对抗性蒸馏攻击",言下之意就是你们不是真本事,是抄我们的。

结果转天下午,月之暗面就把 Kimi K3 放出来了。一天之内,Arena.ai 的前端代码排行榜直接被刷新。1679 分,全球第一,压过了 Claude Fable 5 的 1631 分和 GPT-5.6 Sol 的 1618 分。

这个榜单可不是那种实验室里跑出来的纸面分数。它用的是国际象棋同款 Elo 排名机制,真实开发者提交真实任务,两个匿名模型各出一份答案,开发者盲选投票,投完才知道自己选的是谁家的模型。

说白了就是不靠品牌光环,纯靠硬实力说话。

数据更狠。Kimi K3 在两两对战中的平均胜率高达 76%,而 Claude Fable 5 是 63%,GPT-5.6 Sol 只有 58%。七个细分评测类别里,Kimi K3 一口气拿了六个单项第一。

不止前端编程。第三方机构 Artificial Analysis 的 14 项基准测试显示,Kimi K3 在 11 项上打赢了 GPT-5.6 Sol,对 Opus 4.8 更是实现了全方面碾压。

综合智能指数拿到 57 分,稳稳排在全球第三,仅次于 Fable 5 和 GPT-5.6 Sol,把 Opus 4.8 甩在了身后。

最扎心的还不是性能,是价格。Kimi K3 的调用成本比 Opus 4.8 便宜了足足 40%。美国那边几千亿美元砸出来的算力护城河,被一家中国初创公司用性价比直接凿穿了。

而且这还不是最狠的。月之暗面宣布,7 月 27 号会把 Kimi K3 的完整权重全部开源。

也就是说,全世界任何公司、任何政府,都能免费下载,自己部署,随便改,不用看美国公司脸色,也不用订阅付费。

这一下就打到了美国 AI 产业的命门上。

美国的玩法一直是闭源模型 + 英伟达芯片,建高墙收租子,特朗普甚至跑到欧盟峰会上推销 "全套美国 AI 套餐",要求西方统一战线封堵中国 AI。

结果中国不跟你打阵地战,你建围墙,我直接开源放水。

从 DeepSeek 到现在的 Kimi K3,中国大模型走的全是开源路线。你闭源卖高价,我开源免费给全世界用。生态一旦起来,闭源模型的溢价空间只会越来越小。

当然了,客观说也不能吹过头。月之暗面自己都承认,综合能力上 Kimi K3 还是略逊于 Fable 5 和 GPT-5.6 Sol 这两款当前最强闭源模型。

但问题是,差距已经缩小到这种程度了,而且是在对方声称领先 6 到 9 个月的前提下,24 小时之内就被拉到了肉眼可见的距离。

其实 "对抗性蒸馏" 这事儿本来就是笔糊涂账。模型蒸馏技术是 AI 教父辛顿 2015 年提出来的,全行业都在用,Meta 当年用 ChatGPT 输出训练 LLaMA 也没人说什么。

怎么到了中国公司这儿,就成了 "对抗性攻击" 了?说白了还是双标,我用可以,你用不行。

但现在说这些已经没意义了。事实摆在桌面上:一家成立不到三年的中国初创公司,拿出了一个在专项能力上全球第一、综合能力全球前三的大模型,还比美国竞品便宜 40%,马上还要全开源。

所谓 6 到 9 个月的领先优势,可能真的就在一个下午之间,被烧掉了一大半。

接下来就看美国那边怎么接招了,是继续嘴硬扣帽子,还是老老实实回去搞研发。反正全球开发者的眼睛是雪亮的,谁好用谁便宜,心里都有数。