“每次有新模型发布,我们都会测一测,从成本、能力等角度看看它能不能替代我们正在使用的模型。”TalkMe CEO贾子健告诉记者,作为一家开发C端口语练习应用的公司,测试大模型已经是工作习惯。
这一次贾子健测试的对象是Kimi K3。自7月17日凌晨发布后,月之暗面的Kimi K3成为最受关注的大模型。参数规模2.8万亿,取代参数量1.6万亿的DeepSeek-V4 Pro,成为参数量最大的开源权重模型。因为OpenAI、Anthropic等公司推出的模型闭源,其参数量外界不得而知,但外界普遍推测其顶尖模型参数量可能大幅领先于开源模型。
新的架构,超过两万亿的参数规模,都让贾子健对Kimi K3有比较高的期待。他认为:“当下,‘大力出奇迹’的定律依然有效。”
Kimi K3一经发布,使用量也迅速提升。人们争相使用的Kimi K3究竟好不好用?贾子健的答案是:“‘好’并不等于适合。就像兰博基尼足够好,但是不适合每天接送孩子。”
在Kimi K3发布前后的72小时内美股半导体板块蒸发数千亿美元,《华尔街日报》认为,Kimi K3加剧了这轮芯片股的抛售。Kimi K3被认为像DeepSeek-R1一样,一定程度动摇了人们对于高端算力芯片的信仰。
尽管Kimi K3带给美国业界的震撼与DeepSeek相似,不过从应用层面的影响来看,称其为“DeepSeek 2.0时刻”也许过于乐观↓↓


