英伟达发布开源 AI 模型,向开发者免费开放:免费背后藏着什么算盘?
8 月 11 日,英伟达发布了开源 AI 模型 Nemotron 3.5 Lightning。这件事本身不算稀奇——开源模型这两年多得很。但稀奇的是发布方的身份:英伟达,以及背后站着的黄仁勋。要知道,就在不到三周前,黄仁勋才刚在社交平台公开力挺开源 AI。现在,他说到做到,把模型端出来了。
这是个什么样的模型?
Nemotron 3.5 Lightning 是一个 300 亿参数的轻量级模型,专为 AI 智能体设计——就是那种替你跑后台任务的 AI,比如代码审查、工具调用、安全告警监控、账单问答。它的最大卖点是三个字:免费开源。企业可以免费下载、免费使用、免费修改,不用跟英伟达打招呼,也不用交一分钱。

而且它很轻——一台普通电脑的单张 GPU 就能跑,不需要昂贵的服务器集群,个人电脑、笔记本都能带得动。英伟达还说,它的输出速度最高可达同类模型的 4 倍,智能体任务完成速度提升 30%。技术上,它是用「蒸馏」技术做出来的——把大模型的本领浓缩进小模型,所以小归小,能力不差。
更关键的是这套「路由软件」
如果说模型是「汽车」,那英伟达这次还配套发了一套「导航系统」——叫 NeMo Switchyard。它的作用是:帮你判断当前这个任务,用哪个模型最划算。比如一个任务用便宜的小模型就能搞定,它就不会让你去调用贵的大模型。据英伟达说,这样能把任务成本降到使用顶级闭源模型的三分之一左右。对开发者来说,这相当于多了一个「省钱管家」。
开源最怕「发了没人用」。这次英伟达拉出了一串名单:CrowdStrike(网络安全)、Harvey 和 Trajectory(法律服务)、CodeRabbit 和 Baseten(代码审查)、LilaSciences(物理与生命科学)都已经在测试。模型已经在 Hugging Face 和英伟达官网开放下载。
黄仁勋为什么突然拥抱开源?
这件事放在更大的背景里看,就很有意思了。
导火索来自中国。 7 月 16 日,中国公司月之暗面发布了开源模型 Kimi K3——一个 2.8 万亿参数的大模型,性能逼近美国顶级闭源模型,价格却便宜得多,权重还全面公开。这一下让硅谷和华盛顿都紧张了,甚至有声音要对中国开源模型搞限制。
7 月 24 日,黄仁勋在他人生第一条 X 帖子中,公开支持一份由 25 家科技公司联署的公开信《开放权重与美国 AI 领导力》,呼吁美国政府支持开源模型、避免过早限制。联署方包括英伟达、微软、Meta、Mistral、Hugging Face 等,之后几天扩大到 70 多家。有意思的是,OpenAI、Anthropic、Google 这三家闭源巨头集体缺席。开源与闭源两大阵营的对立,在这封公开信上看得清清楚楚。
免费背后的「算盘」
外行人看热闹:黄仁勋搞慈善,白送模型。内行人看门道:免费模型,才是最赚钱的生意。 黄仁勋自己说过一句大实话——「免费 AI 对硬件有利,对芯片有利,对数据中心有利。」
逻辑很简单:模型免费了,用的人就多了;用的人多了,跑的 GPU 就多了;GPU 多了,英伟达的芯片就卖出去了。模型不收钱,但跑模型的「铲子」收钱。 开源模型不像闭源模型那样能被「卖 API」赚钱,但它能撬动更大的算力需求。对卖芯片起家的英伟达来说,这恰恰是最划算的买卖。
黄仁勋这次的动作,其实透露了 AI 行业的一个关键转向:开源正在从「社区理想」变成「巨头战略」。 过去开源是极客们的情怀,现在微软、Meta、英伟达这些巨头都下场力挺。因为大家逐渐意识到:真正卡住 AI 脖子的,可能不是模型,而是算力。 而算力,正好攥在英伟达手里。
所以,当黄仁勋喊出「开源万岁」的时候,别急着感动。他真正想说的是:模型随便用,芯片记得买。
说明:本文消息基于公开报道整理,仅供交流学习之用;封面图通过AI生成。
