昨天传出消息,DeepSeek 和智谱都已经开始自研 AI 芯片。这倒不是很意外,毕竟全球头部 AI 大厂几乎都走上了自研芯片这条道路。
比如谷歌、微软、OpenAI、Anthropic,国内的阿里、百度等,都已推出或已立项了 AI 芯片项目。
主要原因当然是降低成本,尤其是降低后续运行中的推理成本。
千亿参数大模型的训练与推理成本比例可达2:8甚至1:9,而定制的 AI 芯片往往是针对特定模型量身打造,能显著提高模型运行效率,在能耗方面也有明显优势。
如果大家都在做芯片,那直接挑战的,就是今天英伟达的市场地位。
而老黄的应对之策,则是合纵连横、化敌为友。
据『The Information』披露,英伟达的工程师现在愿意和友商的工程师一起合作,调整 GPU 的控制软件,把 AI 模型的运行过程拆分给完全不同类型的芯片,这种做法在业内被称为分离式推理。
比如英伟达正与 AI 芯片初创公司 d-Matrix 合作,将双方硬件整合进一套新系统。就在一个月前,英伟达与另一家 AI 服务器芯片设计公司 SambaNova 也宣布了类似的合作。
此外,有英伟达正式的背书,客户采购这套组合系统的意愿也会随之提升。
从去年起,英伟达开始加速拓宽战略边界,宣布允许其他厂商的芯片接入 NVLink(一款互联 AI 服务器以提升运行效率的网络设备)。这意味着,即便卖不出自家的计算芯片,英伟达也能借机卖出更多网络设备。
当然,要说最底层的逻辑还是,只有 AI 产业链上的大家都能开始赚钱,那英伟达也才能继续繁荣。
竭泽而渔和放水养鱼的区别,像老黄这样的老江湖肯定还是门清的。

