事时观察 · 新闻扩展 · AI基础设施 英伟达半导体科技(上海)母公司1亿美元押注RadixArk:AMD、英特尔罕见同席,赌的是GPU别再空转 2026年5月5日,由开源推理引擎SGLang孵化的RadixArk宣布完成1亿美元种子轮融资,投后估值4亿美元,Accel领投、Spark Capital联合领投。 英伟达半导体科技(上海) 的母公司NVIDIA集团通过旗下风投NVentures入场,同席的还有AMD、联发科、Databricks;个人投资者则包括英特尔CEO陈立武、博通CEO陈福阳(Hock Tan)、OpenAI联合创始人John Schulman、PyTorch联合创始人Soumith Chintala、xAI前联合创始人Igor Babuschkin。多家媒体称这是"2026年AI Infra赛道最重的一笔早期下注"。 三家互为死对头的芯片厂坐上同一张股东桌,靠的是一组数字:GPU其实有大把时间在"闲着"。这场投资赌的是——把已经卖出去的卡榨干,而不是再买新卡。 1亿美元 RadixArk种子轮融资额,投后估值4亿美元(2026-05-05公告) 40万+ SGLang部署GPU规模,日承载数万亿token生产流量 65% AzureCode推理负载中"空转"能耗占比(CMU 756块GPU遥测) 423 tok/s Kimi K3单卡batch size 1 decode速度(SGLang DSpark) 5美分 Blackwell上每百万token硬件成本,Hopper为20美分 01 为什么是现在:GPU真的在空转 卡内基梅隆大学今年4月发布的研究,对某大型学术AI集群的756块GPU做了31天细粒度遥测,覆盖A6000到B200共六种型号,发现约 20%的执行时间和11%的能耗被浪费在"执行时空转" ;在AzureCode这类推理负载上,空转能耗占比高达65%,OpenAI的Chat类请求也达52%。 这笔浪费直接换算成钱:一台英伟达GB200 NVL72机柜采购成本约400万美元,软件栈没优化到位时利用率可能只有50%——相当于烧掉一半机柜的钱。反过来,把利用率从50%推到90%,效果等同凭空多出一台机柜。与此同时,AI推理市场被估算已超1万亿美元规模,Baseten一年收入增长20倍、估值从21亿美元涨至130亿美元,Fireworks七个月估值翻四倍至175亿美元、年化营收破10亿美元。Meta、谷歌、微软2026年合计资本开支预计超1万亿美元,黄仁勋预测2030年全球AI基础设施年投资将达4万亿美元——堆硬件之外,"榨干已装机的硅"成了新战场。 02 一张罕见的股东桌:芯片厂集体卡位 机构投资人 身份 NVentures(英伟达旗下风投) GPU/算力平台 AMD GPU/CPU,CUDA之外的第二路线 联发科 边缘/端侧芯片 Databricks 数据与模型平台 Salience Capital、HOF Capital、Walden Catalyst、A&E Investment、LDVP、WTT Fubon Family 财务投资人 天使投资人 身份 陈立武(Lip-Bu Tan) 英特尔CEO Hock Tan(陈福阳) 博通CEO John Schulman OpenAI联合创始人、Thinking Machines Lab联合创始人 Igor Babuschkin xAI前联合创始人 Soumith Chintala PyTorch联合创始人 Lilian Weng Thinking Machines Lab联合创始人 资料来源: 机器之心 、 新智元 。 被投的RadixArk核心资产只有两样:开源推理引擎SGLang和强化学习框架Miles。SGLang自2023年诞生,两年内成为开源推理的事实标准之一,GitHub超2.7万星标,部署超40万张GPU,谷歌、微软、英伟达、甲骨文、AMD、xAI等都是使用者。CEO盛颖是SGLang主要创始人、前xAI推理团队负责人;CTO朱邦华曾任英伟达Principal Research Scientist,其联合创立的Nexusflow被英伟达收购——这条"英伟达血脉"是联合调优的天然接口。 03 Day-0:英伟达买的其实是"新平台首发权" 融资落地后,两个案例验证了这笔钱能买到什么: DeepSeek-V4(4月25日发布当天): SGLang和Miles成为全球首个同时支持其推理与RL训练的开源技术栈,并完成Hopper、Blackwell、Grace Blackwell、AMD、NPU的全平台适配,背后是ShadowRadix前缀缓存、Flash Compressor、Lightning TopK(Top-K延迟压至15微秒)等系统级优化。 Kimi K3(7月27日,首个3万亿参数级开源模型,2.8T参数): SGLang与Miles联合Moonshot AI和NVIDIA团队,发布首日完整覆盖——DSpark推测解码下batch size 1达约423 tok/s,PD分离后单GPU吞吐2808 tok/s,12小时RL训练把AIME-2024成绩从43.3%提升到76.7%。 "新模型发布即支持、新硬件发布即适配",正是芯片厂要的乘法效应。行业解读指向各自的算盘: 英伟达 希望通过SGLang提升H100/B200/GB300利用率,让客户更愿意为高端GPU买单——生态护城河靠"让自家硬件跑得比谁都好"建立; AMD 需要一个与CUDA解耦、能公平发挥MI300性能的中立推理栈; 英特尔 则想借开源生态为Gaudi系列破局。三家同席,本质是押注"下一代基础设施事实标准"。 开源推理引擎双雄 SGLang → RadixArk vLLM → Inferact 核心创新 RadixAttention基数树KV缓存复用,命中率提升3–5倍 PagedAttention分页KV,支持500+模型架构、200+加速器 商业化公司 RadixArk:1亿美元种子轮、投后4亿美元,Accel领投+Spark联合领投,芯片厂集体入局 Inferact:1.5亿美元种子轮、估值8亿美元,a16z与Lightspeed领投(2026年1月) Day-0纪录 DeepSeek-V4(4.25)、Kimi K3(7.27) — 资料来源: 百家号《AMD/英伟达罕见联手》 。 04 中国实体:增量被卡死,效率游戏是另一面 英伟达半导体科技(上海)有限公司是NVIDIA集团在华全资子公司:2004年7月成立,注册资本900万美元,由毛里求斯NVIDIA SEMICONDUCTOR HOLDING COMPANY 100%持股,法定代表人MARK STEVEN HOOSE(2023年12月起接任),2025年报披露参保2479人(养老/医疗口径),2025年3月迁址至上海自贸区纳贤路600号,经营范围覆盖集成电路设计、制造、软件开发与企业总部管理,税务评级近年连续为A。 它所在的增量市场正被卡住。据天眼查收录的媒体报道:2026年5月,美国虽批准"特供版"H200对华出口,但附加了英伟达须上缴25%销售额给美财政部、芯片经美第三方检验等条件;报道称英伟达年收指引中H200中国营收为0,若正常销售,中国市场一年价值约35–40亿美元。黄仁勋5月的北京之行,被同一批报道形容为"白跑一趟"。 增量采购被锁死,存量算力的效率优化成为中国市场少数还能继续讲的故事——而SGLang的适配清单里恰恰包括NPU等平台。英伟达押注的推理引擎,客观上也是中国存量算力可用的工具:这笔钱投出去,收益未必只回到自家芯片。 05 风险观察:同席的代价 "养虎为患"的平台中立性。 SGLang的优化同时惠及AMD MI300与NPU路线,英伟达的出资也在让对手的芯片更好用。短期看,每token成本下降会扩大总需求盘子,英伟达只要保持"默认首选"就净赚;一旦RadixArk在适配深度上向AMD或国产NPU倾斜,这笔钱就变成给对手的补贴。 开源中立性争议。 三家互为对手的芯片厂同时出现在一张cap table上,业内已有公开担忧:开发方向是否会优先满足投资方需求、强商业资本是否削弱SGLang的社区中立性。 商业化尚未兑现。 RadixArk的企业支持、托管云、深度集成方案都还在路上;4亿美元投后估值已把预期拉满,而Day-0适配是工程能力,不是收入。 双引擎标准战。 vLLM系Inferact以更高估值(8亿美元)先行融资,两家都在争"开源推理事实标准"。芯片厂未来是否两头下注、标准如何分化,将直接决定RadixArk护城河的深浅。 06 下一步验证什么 下一个爆款模型发布日的Day-0纪录归谁——适配速度是推理引擎排位最硬的标尺。 NVIDIA下一代Rubin平台发布时,SGLang能否拿到首发适配——检验"新硬件day-0"承诺是否兑现。 RadixArk托管云/企业版何时上线、首批客户是谁——4亿美元估值需要商业化接住。 AMD MI300后续与国产NPU的适配深度——平台中立性的试金石。 英伟达后续财报里,数据中心收入与"利用率/每token成本"叙事能否互相印证。 利好逻辑(多头) 推理效率提升→每token成本下降→应用与工作负载指数增长→算力总需求上升;SGLang用户本就包括NVIDIA自己,Day-0适配让新平台上市即有用武之地,是销量放大器。 反噬逻辑(空头) 中立开源引擎同时喂饱AMD、NPU等替代路线;效率提升意味着同等算力可服务更多请求,理论上会压低新增GPU采购;芯片厂联盟本身也是脆弱的利益结构。 时间线锚点:SGLang 2023年诞生 → 2025年11月Miles开源、vLLM团队成立Inferact → 2026年1月22日Inferact公布1.5亿美元种子轮 → 2026年2月13日英伟达发布Blackwell每token成本降4–10倍分析 → 2026年4月25日DeepSeek-V4当日适配 → 2026年5月5日RadixArk完成1亿美元种子轮 → 2026年7月27日Kimi K3 Day-0支持。 钛媒体|"榨"出硅的极限:怎么让GPU不"闲着"?| tmtpost.com/8088046 机器之心(新浪财经转载)|拿下1亿美元种子轮!SGLang团队创立RadixArk| finance.sina.cn 新智元|1亿美金!英伟达AMD英特尔破天荒联手,投给了这支团队| m.163.com 百家号|AMD/英伟达罕见联手!1亿美金押注的RadixArk要改写AI基础设施游戏规则?| baijiahao.baidu.com 网易|罕见!英伟达、AMD、英特尔联手,砸1亿美元投同一家AI公司| c.m.163.com 百家号(GiantPandaLLM译)|SGLang和Miles为Kimi K3提供Day-0支持| baijiahao.baidu.com Recodex|AI推理市场:深入解析价值1万亿美元的市场机遇| recodex.ai 百家号|英伟达Blackwell架构与开源协同,推动AI推理成本降低10倍| baijiahao.baidu.com 天眼查|英伟达半导体科技(上海)有限公司·工商基础信息| tianyancha.com 天眼查|企业年报(2025)| tianyancha.com 天眼查|疑似实际控制人| tianyancha.com 天眼查|新闻舆情(H200对华出口)| tianyancha.com 核验边界说明:英伟达半导体科技(上海)的工商、年报、实控与新闻舆情信息来自company-index档案中已完整读取的天眼查条目;RadixArk融资、SGLang数据与Day-0案例来自上述网络公开报道。文中"行业解读""社区担忧"均标注为外部观点,不代表事实判定。AMD中国主体(超威半导体(中国)有限公司)未纳入本轮档案核验。