这两天随着KIMI K3登顶全球AI参数第一名,自然也让人想起了论文一个曾经力压美国AI对手的中国公司deepseek,两位创始人因为同样是中国广东老乡,自然就会被拿来对比,其实这很正常,有竞争有对比,行业才会发展的好,但有些人就有点偏激了,说谁才是最牛的,谁又是吹牛的。这真的没必要,不能因KIMI一时全球第一,就拉踩杨植麟和deepseek梁文锋,他们在AI领域都是基石人物,都是中国AI的精英人物。我们要做的是从他们的经历中得到启发和学习。

梁文锋1985年出生于广东湛江吴川,父母都是小学老师。17岁时,他以吴川一中高考状元的身份考入浙江大学电子信息工程专业,2010年获得信息与通信工程硕士学位。在校期间,他就与同学一起探索全自动量化交易。这是一个从广东小城走出来的“技术理想主义者”,一路脚踏实地。

杨植麟1992年出生于广东汕头。高中时凭借信息学奥赛成绩保送清华大学,大二转入计算机系,本科以年级第一的成绩毕业。随后赴卡内基梅隆大学攻读博士,师从苹果AI负责人Ruslan Salakhutdinov,仅用四年就完成了常规六年的博士课程。他在ICLR、NeurIPS等顶级会议发表论文二十余篇,在所有六个主流语言建模数据集保持世界第一。

一个从浙大出发,深耕量化与工程;一个从清华、CMU出发,专注学术与前沿——两条不同的求学路,最终在AI大模型的赛道上交汇。
梁文锋的创业从金融开始。2013年与浙大同学创立杭州雅克比投资,2015年成立幻方量化。幻方迅速崛起为中国量化私募“四巨头”之一,管理规模峰值达千亿级别。2023年7月,他创立DeepSeek,将量化积累的巨额资源投入AI大模型研发。
杨植麟的创业则从学术圈起步。2016年创立循环智能,为企业提供AI服务,参与华为盘古大模型、智源悟道大模型等头部项目。2023年4月创立月之暗面,推出Kimi智能助手。Kimi以强悍的长文本处理能力一炮而红,DAU从2023年12月的50.83万飙升至2024年5月的589.7万。

梁文锋走的是“金融反哺科技”的路——用量化赚的钱养大模型;杨植麟走的是“学术转化产品”的路——用顶尖学术积累做产品。路径不同,但都指向同一个方向:通用人工智能。
DeepSeek的核心贡献在于“降本增效”。DeepSeek-V3研发费用仅558万美元,训练成本不到GPT-4o的二十分之一,只用了2048张H100 GPU,用时53天。DeepSeek-V2的API定价仅为GPT-4 Turbo的百分之一。梁文锋坚持全线开源,将DeepSeek定位为“中国AI基础设施”。2025年R1模型发布后,英伟达股价单日蒸发5890亿美元——一个模型撼动了整个华尔街。

Kimi的核心贡献在于“产品突破”。2024年3月,Kimi支持200万字上下文理解,是当时GPT-4 Turbo的数十倍。此后,Kimi在长文本、Agent、Coding等方向持续迭代,K2.6在Artificial Analysis榜单排全球第一,Agent集群系统能同时调度300个子任务协同工作。杨植麟提出了MUON二阶优化器,让AI学习效率翻倍,并致力于“通过底层架构的推倒重建,打破沿用十年的行业技术标准”。
有趣的是,两人在技术路线上多次“撞车”——从2025年1月R1与K1.5同期发布,到2月NSA与MoBA注意力架构同日发表,再到4月数学推理模型几乎同时上线。清华大学教授章明星指出:“DeepSeek R1和Kimi K1.5都指向了ORM based RL,而Kimi MoBA和DeepSeek NSA再一次都指向了可以反向传递的learned sparse attention”。这并非内卷,而是两位顶尖技术者对行业痛点的相似判断。更关键的是,两者之间存在着超越零和博弈的协作关系——Kimi采用的MLA注意力机制源于DeepSeek的早期工作,而DeepSeek V4中关键的Muon优化器则由Kimi团队率先验证。
梁文锋和杨植麟代表了中国新一代创业者的典型特征——技术创业。他们不是王健林式的房地产开发商,也不是史玉柱式的营销天才。他们是真正“写代码”出身的人:梁文锋亲自参与技术论文撰写,杨植麟是Transformer-XL和XLNet的第一作者。他们不靠资源整合、不靠模式创新,靠的是硬核的技术突破。

两人先后作为新质生产力代表出席总理座谈会。这一信号再明确不过:国家支持的不是PPT创业,而是能解决“卡脖子”问题的实战派。
在国际舞台上,梁文锋和杨植麟共同构成了中国AI的“非对称作战”能力。DeepSeek-R1第一次让华尔街意识到“中国能追”;Kimi K3则第二次告诉世界“中国还在追,而且没停”。Kimi K3发布再次引发市场对美国AI领先地位的担忧。两家公司交替冲击全球榜单,形成了一种“双星共振”的格局。这不是一个人的胜利,而是一个时代的崛起。
所以,当Kimi一时登顶全球第一,没必要急着踩DeepSeek;当DeepSeek震撼硅谷,也没必要贬低Kimi。梁文锋和杨植麟,一个是85后的量化起家的AI天才,一个是90后的AI学术精英;一个走开源基建路线,一个走产品创新路线。他们是中国AI这艘大船上的双引擎,缺一不可。正如有人所言,他们是“中国大模型最有希望的两个年轻人”。与其拉踩,不如庆幸——在这个关键赛道,我们中国同时拥有两个世界级的选手。
评论列表