程浅 发自 凹非寺
量子位 | 公众号 QbitAI
意料之中??
英伟达最近被曝砸60亿美元押注开源模型。
桌面上,英伟达一只手和几个闭源大模型公司推杯换盏,“OpenAI、Anthropic咱们合作愉快!”
牌桌下,另一只手则悄悄掏出60亿美元塞给GitHub前CTO的初创公司Poolside:“快去给我做个比肩世界一流的开源大模型!”
不仅如此,本周刚敲定的这笔交易,瞄准的还有DeepSeek、Kimi K3这些强劲的开源选手。
如今,开源模型已经贡献了相当可观的AI生成token,而黄仁勋希望这个比例继续往上走,持续刺激对自家芯片的需求。
有分析认为,“英伟达并不在意哪个AI模型赢到最后,只要这个世界源源不断地继续做出越来越多的模型来……”
英伟达的豪情壮志与开源版图
上月,黄仁勋一改往日低调,在X上发布了自己人生中的第一条帖子:
该帖与20余家公司联合署名,主张美国的AI产业要想谋发展,必须闭源开源两手抓。
而现在,英伟达正亲自下场去完成这场光荣使命。
最近,英伟达向AI初创公司Poolside投资10亿美元,同时再掏出60亿美元买下其“模型工厂”技术的非独家使用权,并希望将该公司100多名工程师全部招致麾下。
外界普遍认为英伟达此举是在赌,它想靠Poolside的技术和团队加持,向全球最强的开源模型发起冲击。
这一举措并不突兀。
过去几年,OpenAI、Anthropic、DeepMind等头部AI实验室将主要资源投入闭源模型研发,没有任何一家将自身最先进的模型开源。
这也为DeepSeek、Kimi K3等模型提供了发展空间。
面对这一格局,英伟达找准机会,反其道而行之。
自2025年底起,英伟达陆续发布了Nemotron 3系列模型,其中最大的Ultra版本在今年6月还一度成为美国最强的开源权重模型。
并且,Nemotron的开源态度彻底地像是某种宣言:除了模型权重,其他数据也没藏着掖着。
训练数据、训练配方、后训练方法论以及GPU集群训练软件都被公开了。
除自主研发外,英伟达今年3月还组了个开源小团体——Nemotron联盟。
其8位成员也是藏龙卧虎,各有来头,包括Mistral、Perplexity、Thinking Machines Lab、Cursor、LangChain、Reflection AI、Black Forest Labs、Sarvam……
英伟达作为老大提供DGX Cloud计算资源,各成员公司贡献各自的技术与数据,共同训练一个开源模型,该模型将作为下一代Nemotron 4系列的基础。
并且,英伟达的开源布局也不限于语言模型。
在机器人领域,英伟达发布了Isaac GR00T系列模型;在物理世界模拟领域,有Cosmos系列;此外还有面向自动驾驶的Alpamayo系列和面向生物医药领域的Clara平台……
一家理想主义者创立的公司,如何变成了英伟达的拼图块
Poolside,泳池边。
由软件开发者Eiso Kant与GitHub前首席技术官Jason Warner于2023年创立。
据说这个名字是两位创始人在跟大厂融资谈判时,对方高管要来一场松弛的“poolside informal meeting”(泳池边非正式会谈)。
最后谈没谈下来不知道,但这个名字二人一听就觉得特好,好记,又有趣。
去年10月,Poolside宣布要在得州建设一座2吉瓦的数据中心,没想到今年4月,项目合作方退出,随之而来的20亿美元融资也告吹。
资金与算力上的双重压力,使泳池边一度面临经营困境。
而支撑它们在有限资源下持续产出模型的,是其内部的 “模型工厂”体系。
据Eiso Kant介绍,其公司训练一个模型到发布通常耗时5至8周,研发团队规模在70人以内,每月可执行1万至2万次实验。
这个能力,也正是英伟达所看重的。
完成此次与英伟达的合作后,公司Poolside剩余团队将主要由三人组成:两位创始人以及运营高管。
值得一提,泳池边创始人Eiso Kant曾在播客节目中表示过:
One More Thing我希望看到一个有100家基础模型公司存在的世界,而不是只剩5家的世界,即便我们本可能是那5家之一。
实际上,此次对泳池边的交易结构也并非英伟达第一次使用。
非独家许可、核心人才招揽、原公司保留独立运营的名义,与此种种都不构成直接收购,因而无需接受反垄断审查。
分析师Stacy Rasgon评价,“这么做也许就能让「竞争尚存」的说法继续维持下去”。
英伟达,希望将整个开源生态的关键节点都紧紧攥在自己手里。
英伟达生成式AI软件副总裁曾说:
模型只是副产品,不是我们的核心业务。
应用深度学习研究副总裁也曾表示,开发Nemotron系列的首要目的,是确保英伟达能够持续存在。
毕竟,随着摩尔定律效应减弱,只有整个AI生态持续扩张、模型的开发和应用主体持续增加,英伟达的算力需求才能持续增长下去。