英伟达半导体科技(上海)母公司被曝研发Nemotron 4:万亿参数开源模型,是护城河还是与客户抢生意? 北京时间8月11日晚间,The Information 援引项目参与者消息报道,英伟达正在开发新一代开源AI模型系列 Nemotron 4,目标性能对标全球顶尖开源大模型, 观点网 、 华尔街见闻 随后转引。消息落地后,英伟达美股盘前涨近2%,盘中一度涨近1%,在 经济观察网 当晚报道的科技七巨头中属于逆势上行一方。 对英伟达半导体科技(上海)有限公司而言,这是母公司在算力主业之外的又一动作——把触角从芯片层伸向模型层。以下数字、时间线与控制关系均已按已核验来源逐一标注;其中"万亿参数""秋末发布"等均为参与项目的员工口径,尚未得到官方确认。 一组数字,看清这场赌局 ≥1万亿 旗舰版 Nemotron 4 目标参数(员工口径) 约为6月发布的 Nemotron 3 Ultra 两倍;即使达到,体量仍小于美国头部开源模型,英伟达押注模型压缩技术。 570名 上一代旗舰模型论文作者数 员工称 Nemotron 4 参与研发人数将进一步扩大,一名前员工称"现阶段所有人都希望能够参与其中"。 280亿美元 多年期云服务承诺(截至2026年4月) 通过向购芯云厂商回租AI服务器获取算力,总额约为一年前披露值的3倍,覆盖至2031年初。 70亿美元 本财年(截至2028年1月)云算力相关支出 报道称已超过绝大多数美国与中国领先开源实验室的历史融资总额。 300亿美元 英伟达已向 OpenAI 的投资 Nemotron 4 又定位为企业提供更低成本的模型替代——与自己的被投方形成微妙竞争。 第2 / 前40之外 Nemotron 3 Ultra 现有排名 据 Arena 与 Artificial Analysis 基准,在美国开源模型中排第二(落后 Thinking Machines 的 Inkling),全球整体排名在前40名之外。 事件脉络:从表态到传闻 2026年1月 英伟达应用深度学习研究副总裁 Bryan Catanzaro 在播客中称,投资 Nemotron"对我们公司的未来至关重要"。 2026年6月 发布现有最大旗舰模型 Nemotron 3 Ultra;Palantir 宣布与英伟达合作,将 Nemotron 模型用于美国政府客户——模型层商业化已有落地。 2026年7月 英伟达与多家企业成立联盟,共同开发共享AI安全与网络安全工具;黄仁勋邮件公开支持开源,称开源模型"促进安全、网络安全、科学进步和国家安全";与微软等签署支持开放权重模型的公开信。 2026年8月11日 The Information 援引员工消息报道 Nemotron 4 研发;同日公司发布 Nemotron 3.5 Lightning(开放版300亿参数混合专家模型)与免费模型路由软件 NeMo Switchyard。美股盘前涨近2%。 预计2026年秋末 员工认为旗舰版最早可准备就绪;多名员工表示预训练数据与架构已做出若干决策,但最终规格、发布日期未定,最终训练阶段尚未启动。 为什么是现在:三股力量把芯片巨头推向模型层 第一,头部客户开始自研芯片。 英伟达芯片需求高度集中于 OpenAI、微软、SpaceX 等少数前沿实验室与云服务商,而后者正日益布局自研AI芯片。Nemotron 4 的推进被报道解读为把需求基础拓展至更广泛企业用户,降低对头部客户的依赖。 第二,中国开源模型的性价比冲击。 报道指出,今年以来AI开发与运行成本持续攀升,价格更低的中国模型性能逐步逼近 Anthropic、OpenAI 等顶尖系统,开源模型获得更多关注。生成式AI副总裁 Kari Briski 在邮件中给出的理由是:"投资Nemotron,是因为我们相信每家企业、每个国家都需要可及的前沿开源模型。" 第三,生态位逻辑。 AI模型评测机构 Arena 首席执行官 Anastasios Angelopoulos 的判断是:"无论哪家公司做出优秀的开源模型,英伟达都是赢家。"核心逻辑是:开源生态越繁荣、参与主体越多元,GPU整体需求就越旺盛。英伟达组建的"Nemotron联盟"——成员包括 Reflection、Cursor、Thinking Machines、Mistral 等开源开发商——正是这一逻辑的执行层:各方贡献训练数据、评估支持与模型设计;Prime Intellect 已贡献30万个模拟环境,Cognition 据称就提供代码训练数据展开讨论(尚未正式公布)。 关系矩阵:盟友、客户与对手的边界在模糊 OpenAI 被投方+客户+潜在对手 英伟达已投资300亿美元;Nemotron 4 定位恰是更低成本的替代方案,与 OpenAI 商业模型竞争。 微软 客户+公开信盟友 既是芯片大客户,又与英伟达共同签署支持开放权重模型的公开信,称以避免创新能力向海外转移。 Palantir 合作方 2026年6月宣布将 Nemotron 用于美国政府客户,Nemotron 系列的政企落地案例。 Mistral / Cursor / Thinking Machines / Reflection 联盟成员+英伟达注资方 多为英伟达已投资的开源创业公司,既共建 Nemotron 4,也在推进各自模型项目。 中国开源模型(如 DeepSeek 等) 竞争者+生态推动者 价格更低、性能逼近头部实验室系统,倒逼美国大厂重视开源,也直接抬升开源生态的整体热度。 中国区实体的最新档案:出口受限之下仍在扩编 工商登记显示,英伟达半导体科技(上海)有限公司为外国法人独资,由 NVIDIA SEMICONDUCTOR HOLDING COMPANY(毛里求斯) 持股100% ,法定代表人 MARK STEVEN HOOSE(2023年12月由 KAREN BURNS 变更而来),注册于上海自贸区,经营范围覆盖集成电路设计、集成电路制造、软件开发、技术服务与汽车零部件研发。 项目 已核验数据 口径/来源 经营状态 存续(开业) 工商基础信息 注册资本 900万美元(实缴900万美元) 工商基础信息 员工规模(社保口径) 2025年报养老参保2479人,2024年报2196人,一年净增约283人(约+12.9%);工商登记口径参保2514人 企业年报 注册地址 2025-03-14 由申江路5709号迁至纳贤路600号、祥科路55号 企业天眼风险 税务评级 A(2017–2025年均留有记录) 企业天眼风险 分支机构 卢湾分公司、北京分公司均已注销 工商基础信息 曾用名 商辉达半导体(上海)有限公司 工商基础信息 与母公司扩张叙事形成对照的是中国市场的外部压力:2026年5月报道显示,黄仁勋随美方企业家团队访华后,中国方面仍未采购英伟达H200,理由涉及美方征收25%"芯片税"与国产算力崛起(该条为 自媒体信源 ,经天眼查新闻舆情收录, 新闻舆情 ,口径需谨慎)。反差在于:硬件出口受阻的同时,中国区研发队伍一年净增约283人——母公司在华布局并未收缩。 风险观察与下一步验证 口径未证实。 1万亿参数、秋末时间表均为参与项目的员工口径,官方未确认,最终训练尚未启动。验证信号:英伟达就预训练数据与架构的官方披露、Nemotron 4 论文规模与发布日期。 与客户竞争的结构性张力。 OpenAI 是芯片需求主力也是300亿美元投资对象,Nemotron 4 的低成本定位直接与之重叠;微软、SpaceX 等大客户同样在自研芯片。 排名落后是现实。 现有旗舰 Nemotron 3 Ultra 全球前40名之外,万亿参数仍小于美国头部开源模型——英伟达把宝押在模型压缩技术上,属于尚未被验证的技术假设。 资金烧钱速度。 280亿美元云服务承诺约一年前3倍,本财年相关支出70亿美元,高于多数开源实验室的历史融资总额——这是一场需要持续兑现的资本赌局。 有利条件同样成立。 所有开源模型最终都要跑在 GPU 上;Nemotron 联盟提供训练数据与设计支援;Nemotron 3.5 Lightning 可在 RTX 个人电脑、DGX Spark 本地运行并与 vLLM、Ollama 等工具链打通——模型层与硬件层的协同生态已经铺开。 分析建议(判断,非事实): 对跟踪者而言,最早验证"模型层拉动力"的两组信号,一是 Nemotron 4 的官方确认节点(发布口径、参数规模、训练完成时间),二是 Nemotron 3.5 Lightning 在 OpenRouter 与开发者平台的采用数据。对英伟达中国区而言,若母公司"每家企业、每个国家都可及"的开源叙事成立,模型层开放或能在一定程度上对冲硬件出口限制——但这取决于出口管制政策与国产算力竞争两个外部变量的走向,目前均无已证实结论。 来源 经济观察网:美股存储芯片深夜拉升,SK海力士涨超3%,英伟达涨近1% 观点网(新浪财经):英伟达被曝开发Nemotron 4开源模型 旗舰版目标至少1万亿参数 新浪财经7x24:英伟达全力研发Nemotron 4开源大模型 拉动芯片需求同时直面客户竞争 华尔街见闻:万亿参数!英伟达被曝正在开发新一代AI,目标直指全球顶尖开源模型 天眼查|英伟达半导体科技(上海)有限公司|工商基础信息 天眼查|疑似实际控制人 天眼查|企业年报 天眼查|企业天眼风险 天眼查|新闻舆情(H200拒购报道)