英伟达被曝研发万亿参数开源模型 Nemotron 4,意在强化开放模型与 GPU 生态
据 IT之家 8 月 11 日消息,The Information 援引项目参与者消息称,英伟达正在开发新一代 AI 模型系列 Nemotron 4,目标是在开源模型阵营中与全球最先进系统展开竞争。来源显示,Nemotron 4 目前尚未完成最终训练,发布日期也未确定,但参与开发的员工认为,相关模型最早可能在今年秋末准备就绪。其中,规模最大的版本预计至少拥有 1 万亿个参数。
这意味着,英伟达正在把自身在 AI 芯片、训练基础设施和企业级软件栈上的优势,进一步延伸到模型层。对于一家以 GPU 算力为核心业务的大型科技企业来说,主动投入开源模型并不只是技术展示,也可能是其扩展 AI 应用场景、带动算力需求的重要策略。
Nemotron 4:英伟达押注开放模型生态
来源称,英伟达是美国少数主动推出开源模型的大型科技企业之一。该公司生成式 AI 副总裁 Kari Briski 在邮件中表示,投资 Nemotron 是因为英伟达相信每家企业、每个国家都需要可及的前沿开源模型。
从产品线看,Nemotron 并非孤立项目。英伟达此前已发布 Nemotron 3.5 Lightning 模型,覆盖代码审查、工具调用、安全警报监控、回答账单问题等任务。这些场景高度贴近企业工作流,说明英伟达并不只关注通用聊天能力,而是试图让模型更深入地进入软件开发、IT 运维、自动化办公和企业服务流程。
与此同时,英伟达还推出了开源模型路由库 NeMo Switchyard。该工具可以根据不同 AI 任务需求,将任务自动分配给更合适的模型。对于企业来说,这类“模型调度”能力可能比单一大模型本身更实用:在成本、速度、准确性和安全要求不同的任务之间,自动选择合适模型,有助于提高整体 AI 系统效率。
- 模型规模:据称 Nemotron 4 最大版本至少为万亿参数级别。
- 发布进度:最终训练尚未完成,发布时间仍未确定。
- 定位方向:面向开源前沿模型竞争,并服务企业级 AI 应用。
- 生态配套:英伟达已布局 Nemotron 3.5 Lightning 与 NeMo Switchyard 等工具。
为什么开源模型重新成为焦点
今年以来,AI 开发和运行成本持续攀升。与此同时,价格更低的中国模型在性能上逐步逼近 Anthropic、OpenAI 等美国领先 AI 实验室的顶尖系统,使开源模型的商业吸引力进一步提升。对于大量企业和开发者而言,开放权重模型意味着更高可控性、更灵活的部署方式,以及在私有化、定制化场景中的成本优势。
但开放模型也带来更复杂的安全讨论。来源提到,近期多起涉及自主 AI 智能体的黑客攻击事件被披露,这进一步放大了外界对开源模型的关注。原因在于,开源模型通常不会像闭源商业服务那样对网络安全用途设置严格限制。对于安全研究、企业防御和红队测试来说,这种开放性有积极价值;但在恶意使用场景下,也可能降低攻击门槛。
英伟达上个月还与多家企业成立联盟,共同开发并共享 AI 安全和网络安全工具。此外,英伟达与微软等科技巨头共同签署公开信,支持开放权重模型,以避免创新能力向海外转移。可以看出,围绕开放模型的争论已经不只是技术路线之争,也牵涉产业竞争、国家创新能力和安全治理。
影响解读:模型开放背后仍是算力生态竞争
对英伟达而言,Nemotron 4 的战略意义可能不止于“做一个强模型”。开源模型越普及,企业越倾向于在本地、私有云或混合云中运行和微调模型,这会持续拉动对 GPU、推理加速、训练集群和软件工具链的需求。换句话说,英伟达开放模型,最终可能进一步巩固其从芯片到软件、从训练到推理的 AI 基础设施地位。
对于中文科技行业观察者来说,Nemotron 4 值得关注的地方在于:全球 AI 竞争正在从单纯比拼闭源模型能力,转向“模型能力 + 成本效率 + 开放生态 + 安全工具”的综合竞争。若万亿参数级 Nemotron 4 最终开放并具备较强性能,它将为企业级 AI 部署提供新的选择,也会加剧开源大模型阵营与闭源顶级模型之间的竞争。
目前,Nemotron 4 仍处于研发和训练阶段,外界还无法判断其实际推理能力、训练质量、许可证条款以及对中文等多语言任务的支持水平。但可以确定的是,英伟达正在更积极地进入模型生态上游,而这将影响未来 AI 工具、企业自动化和算力市场的竞争格局。