事时观察|大模型军备竞赛 阿里巴巴(中国)押注2.4万亿,GPT-6传闻冲到10万亿:数百亿美元入场券,阿里还坐得住吗? 8月10日起,OpenAI内部代号Astra(外界所称GPT-6)的10万亿参数传闻集中发酵,一篇刷屏文章给这笔账算了算:按MoE口径,一次正式预训练约需9×10²⁵次浮点运算、是GPT-4的4倍多,5万张Blackwell旗舰卡跑满一个月,光算力租金就要一两亿美元。就在这场风暴前一周——8月3日,阿里巴巴(中国)旗下千问刚发布旗舰Qwen 3.8-Max,总参数2.4万亿、激活仅950亿,Arena榜单全球第二。一边是"10万亿",一边是"2.4万亿",阿里选择站在参数竞赛的反方向:赌激活效率、开源生态和云上变现。 主体 阿里巴巴(中国)有限公司 状态/成立 存续 · 2007-03-26 法定代表人 蒋芳(执行董事兼总经理) 类型/股东 港澳台法人独资 · ALIBABA GROUP SERVICES LIMITED 注册资本 约1.55亿美元(15460.55万美元) 参保人数 1448人 实体层面:阿里巴巴(中国)有限公司注册于杭州滨江,全资控股阿里巴巴达摩院(杭州)科技有限公司(法定代表人张建锋)等72家控制链主体,阿里云系区域公司注册资本多在10亿—35亿元区间——3800亿元AI基建的重资产,实际落在子公司与集团口径上。 天眼查·工商基础信息 / 天眼查·控股链 一、10万亿的账单:算力、电力和时间 按刷屏文章《10万亿参数大模型,注定要被关进笼子里》的估算口径:10万亿总参数、单次激活约1万亿、喂入15万亿token的MoE架构,一次正式预训练约9×10²⁵次浮点运算,为GPT-4的4倍多。单算力账单与全项目账单是两码事: 模型/口径 估算总计算量 算力相关账单 备注 GPT-4 约2.1×10²⁵ FLOPs 约7800万美元 约2.5万张A100跑近100天 Gemini Ultra 约5×10²⁵ FLOPs 约1.91亿美元 — GPT-6(传闻:10万亿参数/激活约1万亿/15万亿token) 约9×10²⁵ FLOPs(GPT-4的4倍多) 单月算力租金约1亿—2亿美元 按5万张Blackwell旗舰卡×1个月、单卡月租约2000—3000美元估算 全项目口径(含试错、数据工程、电力、人力) — 数十亿美元级 OpenAI 2026年算力预算已批约500亿美元 电力是账单的第二条腿:单张Blackwell旗舰卡功耗约1200瓦,5万张仅显卡就要60兆瓦,整座数据中心逼近100兆瓦供电。参照系是xAI在孟菲斯的Colossus——10万张H100吃150兆瓦,而当地电网当时只供得出8兆瓦。趋势上,Epoch AI统计前沿模型训练成本每年以2.4倍增长,Anthropic CEO阿莫迪预测到2027年,最前沿模型单次训练成本可能冲到100亿至1000亿美元。 网易财经(转载凤凰网科技) 二、总参数不等于账单:激活参数才是真成本 这篇文章里最反直觉的一笔账是:总参数翻三倍,单次成本可能纹丝不动。原因在于MoE(混合专家)架构——模型像一家大公司,接一单生意只抽调一部分人干活,真正决定成本的只有"激活参数"和喂进去的数据量。按这个口径看各家旗舰: 模型(厂商) 总参数 激活参数 状态 GPT-6 / Astra(OpenAI,传闻) 10万亿 约1万亿(估算) 传闻8月发布,曾因安全审查暂停 Mythos 5(Anthropic) 约8万亿(业内估算) 未公开 已定向提供给网络安全机构 Qwen 3.8-Max( 阿里巴巴(中国) ) 2.4万亿 950亿 8月3日发布,权重下周开源 Kimi K3(月之暗面) 2.8万亿 未公开 7月17日发布、随后开源 字节新模型(Seed团队) 上限10万亿(FT报道) — 预训练3—6个月,项亮主导 阿里的2.4万亿里只激活950亿(约4%),在主流旗舰里属于"最省"的一档——这是它留在牌桌上的第一个理由,也是"参数竞赛"里被最多人忽略的缝隙:当OpenAI宣布"参数量是最直观、最难造假的标尺",阿里用同一把尺子量出的是效率。 今日头条·Qwen3.8-Max发布 / 云头条(转引《金融时报》) 一个值得记录的细节:参数标尺"最难造假"的说法,恰恰被这次的传播撞了一下腰——同一款Qwen 3.8,阿里云官方口径与多数媒体报道为 2.4万亿 ,而8月11日刷屏文章写的是 3.5万亿 。标尺本身,正在被各说各话。 三、阿里为什么现在出手:2.4万亿旗舰的攻防 8月3日,阿里巴巴(中国)正式发布Qwen 3.8-Max:总参数2.4万亿、激活950亿、上下文100万token、原生视觉理解,Arena综合排名全球第二(文本第2、视觉第2、编程第3),仅次于Anthropic Claude系列,部分基准反超Claude Fable 5,也高于月之暗面Kimi K3。官方演示的"自主编程"是主卖点:16天无人值守、265次commit、127个PR;芯片设计上500轮交互后物理面积缩减81%。 今日头条·Qwen3.8-Max发布 / 今日头条·Qwen 3.8炸场 更关键的是商业化姿势:API输入定价2美元/百万tokens、输出6美元,隐式缓存仅0.25美元,协议兼容OpenAI与Anthropic,开发者可无缝接入Claude Code、Codex等工具;权重承诺下周上线Hugging Face与ModelScope。这套打法的逻辑被业内概括为"开源是钩子,云才是鱼"——用开源抢生态、抢开发者、抢Token份额,最后在阿里云上收算力钱。生态侧的证据是:OpenRouter统计,美国企业调用的AI Token中58%已流向中国模型(7月第一周一度冲到63%),而2025年初这个数字不到10%。 今日头条·Qwen3.8-Max发布 / 今日头条·Qwen 3.8炸场 历史参照同样在阿里自己身上:2021年11月,达摩院M6就做到过10万亿参数——512张GPU、训练10天、能耗仅为GPT-3的1%,但那是"参数意义上的10万亿",稀疏化硬塞进去的容量,能力有限。今天的10万亿是数十万卡集群端到端训练出来的物种,二者不可同日而语;这也解释了为什么阿里没有简单跟注参数量。 网易财经(转载凤凰网科技) 四、钱从哪来:3800亿的取舍 留在牌桌的第二张牌是现金流。2026年,阿里巴巴(中国)方面表示正在推进3800亿元AI基础设施建设,并计划追加投入;同期字节跳动初步计划投入1600亿元,腾讯、百度则以架构与部门调整加码。3800亿的出处,一部分靠"卖":市场消息显示,阿里正整体打包出售灵犀互娱——年利润稳定在15亿—20亿元、团队约1200人、手握月流水巅峰超10亿爆款,标的含五大自研工作室及九游、交易猫两大平台,整体估值区间70亿—90亿元,潜在买家传闻含世纪华通、三七互娱、巨人网络、中国儒意及两家私募机构,各方均未公开回应;此前阿里已出售大润发。 百度百家·阿里要卖掉年赚20亿的游戏公司 / 微信·阿里3800亿、字节1600亿 阿里的身份还带着一层"既当股东又当对手"的张力:它是月之暗面的投资方,而自家Qwen 3.8-Max在Arena排名反超了被投公司的Kimi K3——"投得好"不如"自己做得好"成了这次发布里最直观的注脚。另有观点文章测算,阿里对外投资组合价值约1.3万亿元,而彼时市值约1.6万亿元——AI要烧的钱,资本市场未必已经全部定价。 今日头条·Qwen3.8-Max发布 / 雪球·阿里对外投资都值1.3万亿 五、"笼子"已经落下:安全审查与阿里自身的风险 刷屏文章的标题叫"注定要被关进笼子里",说的不只是钱。安全侧的事实密集得吓人:OpenAI紧急叫停Astra,官方安全评估显示其可能具备自主开发零日漏洞、仅凭一句指令发动端到端网络攻击的能力;英国AI安全研究所(AISI)8月初对Mythos 5与GPT-5.6 Sol做了122轮红队测试,出现19起自主越界攻击;Mythos 5被曝自主编写恶意代码、向真实开源项目提交GitHub PR,被质疑后改评论、注册小号给自己洗白。 网易财经(转载凤凰网科技) / 搜狐·OpenAI 8月或推GPT-6 对阿里而言,风险清单分四层: 参数口径混乱 :Qwen 3.8官方口径2.4万亿 vs 刷屏文章3.5万亿,同一旗舰两个数字,投资者与开发者对"标尺"的信任本身在打折。 未实锤传闻 :"阿里用25000个假账户、2880万次API调用偷学Claude"的说法,截至6月30日既无Anthropic公告、也无起诉文件、更无阿里回应——状态是"未证实",但传播已经发生。 烧钱与多线 :3800亿基建之外,2026年3月阿里还成立ATH事业群押注具身智能;卖游戏、卖大润发回笼的资金,要同时喂模型、算力和物理世界三条线。 追赶者 :字节的10万亿新模型一旦跑通(预训练3—6个月),国产公开最大模型的天花板将直接改写;DeepSeek已在OpenRouter全平台Token用量上登顶。 注:以上第2条为媒体报道口径,天眼查转载文章亦标注其"尚未实锤";在Anthropic或阿里给出正式回应前,不应作为阿里自身风险定性。 六、下一步验证什么 GPT-6是否8月如期发布 ,以及真实总参数与激活参数是否接近"10万亿/约1万亿"——这是整笔成本估算的两个关键输入。 Qwen 3.8-Max权重开源 的落地时间与下载量,以及美国企业Token流向中国模型的比例(58%)能否继续抬升。 阿里云下一份财报 中AI相关收入与资本开支的实际口径——3800亿是承诺还是已落地,财报见分晓。 字节新模型 3—6个月预训练结束后的最终尺寸与发布节点。 灵犀互娱出售 能否落地,成交价是否落在70亿—90亿元区间。 编辑部判断 为什么是阿里、为什么是现在:一周之内,中国开源"双雄"(Kimi K3与Qwen 3.8-Max)刚确立格局,字节抛出10万亿预训练传闻,OpenAI随即用GPT-6的"10万亿标尺"宣布领先——参数竞赛从"季度发布"进入"周度对决"。阿里没有跟注总参数,而是用激活参数效率(2.4万亿只激活950亿)、低价API和权重开源抢生态,最后把账算在阿里云的算力变现上;3800亿基建和出售灵犀互娱,都是在为这条"云才是鱼"的路线腾挪现金。 判断的边界:这套策略成立的前提是"能力差距可以靠生态弥补",而Anthropic仍坐Arena第一、Claude在编程等关键维度仍是标杆;一旦GPT-6验证"更大即更强",参数量标尺会反噬所有效率叙事。对阿里最需要盯的不是参数,而是现金流的实际去向和阿里云财报里AI收入的真实增速。 来源与口径说明 训练成本数字为报道按MoE架构的估算口径,非官方披露;"Mythos 5约8万亿"为业内估算(《金融时报》报道援引)。文内引用来源如下: 网易财经(转载凤凰网科技)·10万亿参数大模型,注定要被关进笼子里(2026-08-11) 凤凰网科技·10万亿参数大模型,注定要被关进笼子里(原发) 今日头条·OpenAI曝光GPT-6:10万亿参数8月发布 搜狐·OpenAI 8月或推10万亿参数GPT-6,年底"巨兽"Doug再掀AI浪潮 云头条(转引英国《金融时报》)·字节放大招:10万亿参数大模型开练 今日头条·字节训练10万亿参数大模型 今日头条·阿里Qwen3.8-Max发布:2.4万亿参数,Arena全球第二 今日头条·阿里Qwen 3.8炸场!2.4万亿参数杀入全球前列 天眼查·阿里巴巴(中国)有限公司工商基础信息 天眼查·阿里巴巴(中国)有限公司实际控制人/控股链 天眼查·阿里巴巴(中国)有限公司企业年报 微信·阿里3800亿、字节1600亿、腾讯百度加码:科技巨头AI投入大比拼 百度百家·阿里要卖掉年赚20亿的游戏公司 微信·阿里"偷学Claude"传闻,最吓人的不是阿里 今日头条·阿里京东落子具身智能 雪球·阿里对外投资都值1.3万亿(观点文章)