英伟达被曝开发万亿参数开源模型Nemotron 4:卖芯片的霸主,为什么要做’开放’的生意?

· 科技资讯

今天发生了什么

8 月 11 日,多家媒体报道:英伟达正在开发万亿参数级别的开源 AI 模型 Nemotron 4,目标直指全球顶级模型。如果属实,这将是英伟达在开源模型赛道上的最大动作——从 340B 到 120B 再到传闻中的”万亿参数”,英伟达正在把开源从”试水”变成”主力产品线”。

英伟达被曝开发万亿参数开源模型Nemotron 4:卖芯片的霸主,为什么要做'开放'的生意?封面

为什么说这是个大反转

英伟达的定位一直是”AI 淘金热里的卖铲人”——靠 GPU 和 CUDA 生态赚钱,自己不亲自下场炼模型。过去两年它被质疑”既当裁判又当运动员”,但闭源阵营(OpenAI、Anthropic)和开源阵营(Meta、DeepSeek)打得越凶,GPU 卖得越多。如今传闻中的 Nemotron 4 却是一个”万亿参数开源模型”,这意味着英伟达要从卖铲人,变成亲自挖矿的矿工。

这不是突然的决定

英伟达的开源布局其实一直在加码。2024 年开源 Nemotron-4 340B,主打用合成数据训练大模型;今年 3 月发布的 Nemotron 3 Super,120B 总参数、仅 12B 活跃参数的混合专家架构,推理成本压到每百万 token 输入 0.3 美元,一度登顶开源模型排行榜;同期还推出主打 Agent 吞吐量的 Nano Omni。Nemotron 系列早就不是”玩票”,而是英伟达”开源换生态、生态换算力需求”的阳谋

英伟达到底图什么

逻辑其实很直白:

开源模型跑得越好,越需要更多 GPU。万亿参数模型的推理和训练,是 GPU 销量的最强催化剂。

卡住”从云到端”的入口。Nemotron 官方强调可在 RTX PRO、DGX Spark 等自家硬件上部署,模型越强,开发者越难绕开英伟达的硬件栈。

对抗闭源联盟的定价权。当 OpenAI 们把 API 价格定得越来越高,开源替代品会逼着整个市场降价,而降价只会让更多人去买显卡自己跑。

谁该关注,谁可以忽略

模型开发者和中小企业:如果 Nemotron 4 真能做到万亿参数开源 + 宽松许可证,本地部署大模型的成本可能再次下降,值得提前关注技术栈。

GPU 采购决策者:算力需求会因开源生态膨胀而上涨,预算规划要有心理准备。

只把 ChatGPT 当聊天工具的用户:这条新闻短期内与你无关。

需要泼的冷水

注意”消息称”三个字——目前这是媒体报道,英伟达官方尚未确认。历史上英伟达对”万亿参数”叙事非常谨慎,且开源许可证的具体条款(是否允许商用、是否限制蒸馏)才是关键。判断这件事是炒作还是真布局,就看三点:官方是否确认、权重是否真的开放、许可证是否宽松。

🔥 关注LC智趣厅,AI 产业格局变化第一时间解读

👇 点赞转发,让更多技术圈朋友看到


— END —
LC 智趣厅 · 科技与生活的交点
ihygg.cn

Scroll to Top
微信公众号:LC智趣厅

扫码关注微信公众号
LC智趣厅