阿里巴巴(中国)网络技术押注千问3.8-Max:榜单反超 Anthropic,客户与份额才是真战场 来源: 搜狐财经 |发布:2026-08-03|事件主体:阿里巴巴(中国)网络技术有限公司(阿里巴巴集团境内核心运营实体) 8月3日,阿里巴巴集团旗下千问团队发布旗舰模型 Qwen3.8-Max,港股当日收涨 7.01%、美股涨超 5%。它的对手盘很明确:17 天前月之暗面刚用 Kimi K3 在硅谷制造轰动,10 天前 Anthropic 又用半价旗舰 Opus 5 抢走"性价比"心智。阿里这次给出的答案是 2.4 万亿总参数、单次推理仅激活 95B 的稀疏 MoE 模型,配上一套对标 Opus 5 打四折的国际价格——榜单反超只是入场券,真正要验证的是:这些分数能不能变成 Token 账单和私有化部署合同。 一、先看硬指标:这场发布会交出了什么 2.4T 总参数量,千问首次突破(单次推理仅激活 95B) 100万 tokens 上下文窗口,原生视觉,可读 200 页财报 PDF +7.01% 港股 09988.HK 收 125.2 港元,成交 239 亿港元,市值约 2.4 万亿港元 下周 Qwen3.8-Max 权重开源,同步开源 Qwen3.8-27B 技术规格上,Qwen3.8-Max 基于 Qwen 3.5 架构,用稀疏 MoE 与混合注意力联合优化,把总参数推到 2.4T、激活参数压到 95B,官方口径是"在保持前沿智能的同时显著降低计算成本与延迟"。阿里还晒出一个长时限执行案例:内部测试中独立完成了一个为期 16 天的软件工程项目。API 今日起在千问 AI 平台上线,并接入同日发布的 Agent 产品"千问办公"。 二、榜单对比:赢了哪几项,输在哪几项 评测 Qwen3.8-Max Anthropic Fable 5 Kimi K3(月之暗面) PaperBench 论文能力 93.0 分 88.8 分 — IFBench 指令遵循 82.8 分 63.5 分 — Vision Arena(视觉) 全球第 2 Claude 系列居前 — Text Arena 全球第 5 Claude 系列居前 — CodeArena(编程智能体) 全球第 4 — — Artificial Analysis 智能指数 — 60 分(第 1) 57 分(第 3) Frontend Code Arena(WebDev) — 1634 分 1679 分(第 1) 注:榜单来自不同第三方平台、不同时间点,并非同一口径横向可比。阿里官方向媒体披露的表述是:编程与通用智能代理指标上与 Fable 5 相当、部分反超,部分基准测试超越 Kimi K3;整体处于全球第一梯队、仅次于 Anthropic Claude 系列。Kimi K3 数据为其发布时点(7月17日)口径,来源见文末。 把数字放回竞争语境:千问在"论文理解"和"指令遵循"两个细分榜上反超 Fable 5,但在综合智能指数(Artificial Analysis)上,全球第一仍是 Fable 5(60 分),Kimi K3 以 57 分居第三、紧咬 GPT-5.6 Sol(59 分)。换句话说,"反超"是单点、有条件的,不是全面碾压——这正是后续客户争夺战里最容易起争议的部分。 三、定价对照:阿里在打一场"性价比"战争 模型 输入价(每百万 tokens) 输出价(每百万 tokens) Qwen3.8-Max(国内) 12 元 36 元(隐式缓存命中 1.5 元) Qwen3.8-Max(国际) 约为 Opus 5 的 40% 约为 Opus 5 的 24% Claude Opus 5(Anthropic) 5 美元 25 美元 Claude Fable 5(Anthropic) 10 美元 50 美元 Kimi K3 API(月之暗面) — 100 元(较 K2.6 的 27 元涨逾 3.5 倍) 按 Opus 5 的 $5/$25 换算,Qwen3.8-Max 国际价约合输入 2 美元、输出 6 美元——输入是 Opus 5 的四折、输出不到四分之一,明显瞄准"相近智能、更低成本"的替代叙事。这正好撞上 Anthropic 10 天前的布局:Opus 5 定价与 Opus 4.8 持平($5/$25),性能逼近 Fable 5、单任务成本减半,Anthropic 已经把"性价比旗舰"写进了自己的产品线。两家的价格战逻辑撞车了。 四、竞争节奏:3 周内四连发,窗口被压缩到极致 7月16–17日 月之暗面发布 Kimi K3:2.8T 参数、100 万 tokens 上下文、原生视觉,发布 48 小时内请求量逼近集群承载极限,一度暂停 C 端新用户订阅;随后 F 轮融资 35 亿美元、投后 350 亿美元,Pre-IPO 轮洽谈投前 500 亿美元。 7月24日 Anthropic 发布 Claude Opus 5:性能接近 Fable 5、价格砍半($5/$25),同日成为 Claude Max 默认模型。 7月末 DeepSeek 上线旗舰模型 V4 Flash 的 API 公开测试版,低价位竞争者入场。 8月3日 阿里发布 Qwen3.8-Max:API 即时上线、接入"千问办公",港股收涨 7.01%,从 6 月下旬 88.65 港元低点反弹超 41%。 下周 Qwen3.8-Max 与 Qwen3.8-27B 权重开源——这是阿里把榜单热度变成开源生态的第一步,也是月之暗面、DeepSeek 都在抢的位置。 这条时间线说明一件事:中国开源模型的"全球第一"叙事每两周被刷新一次。Kimi K3 抢走 7 月的硅谷注意力,阿里选择在 8 月首个交易日发布,卡位的意图明确——用"2.4T 参数 + 反超 Anthropic 的榜单 + 四折价格"三件套,重新把开发者流量和媒体报道拉回千问阵营。 五、为什么是现在:阿里云的账本已经等不及了 阿里云的 AI 商业化已经进入兑现阶段,这是 Qwen3.8-Max 必须此刻发布的财务理由: 截至 2026 年 3 月财季(FY26 Q4),阿里云收入同比 +38%,外部商业化收入 +40%;AI 相关产品单季收入 89.71 亿元,连续 11 个季度三位数增长,年化经常性收入突破 350 亿元(部分报道口径 358 亿元),占外部云收入比重首次突破 30%。 2026 年 4–6 月财季前瞻:机构沟通口径云收入增速约 45%,较上季提速 7 个百分点、创近五年最高;EBITA 利润率从约 9.1% 抬升至低双位数——增长与盈利同步改善,是此前两轮港股大涨的核心催化。 CEO 吴泳铭此前披露:包含百炼 MaaS 在内的 AI 模型与应用服务,ARR 将在 6 月季度突破 100 亿元、年底冲 300 亿元;今年 5–6 月 API Token 需求较去年 11–12 月增长超 10 倍。 生态底座:超 100 万家客户接入通义大模型,百炼平台客户数同比增 8 倍;Gartner 口径下 2025 年阿里云以 32.8% 份额居中国 IaaS 第一、同比提升 2.7 个百分点。 管理层的组织动作同步在收紧:2026 年 3 月 19 日,集团 CEO 吴泳铭发全员信宣布组织架构调整,核心逻辑是"敏捷"与"聚焦";6 月进一步把通义大模型事业部与未来生活实验室合并为 Token Foundry 事业部。千问不再是实验室产品,而是被组织钉在"Token 变现"这条主线上。 主体边界说明:Qwen3.8-Max 由阿里巴巴集团旗下阿里云千问团队发布,MaaS 收入归属阿里云;本次报道档案主体阿里巴巴(中国)网络技术有限公司(1999-09-09 成立,法定代表人蒋芳,注册资本约 59.96 亿美元,2025 年报参保 3573 人)为集团境内核心运营实体,两者为集团内部关联主体,不互为同一法律主体。 六、风险观察:四组并列证据,结论留给数据 1. 榜单是"挑出来"的,不是全面领先 阿里披露的是第三方榜单中对自己有利的细分项(PaperBench、IFBench、三个 Arena),且 Text Arena 第五、CodeArena 第四,并非全面压制;Arena 榜单实时波动,单日排名不足以支撑长期客户决策。综合智能指数上,Fable 5(60 分)仍居第一。 2. Anthropic 的生态壁垒与价格反制 Claude 在企业级 Agent、代码工具链(CursorBench 等)上的生态粘性仍在;Opus 5 刚把"半价准旗舰"变成既定事实,直接对冲千问的性价比叙事。千问国际价四折的底气能否长期维持,取决于推理成本与芯片供给。 3. Kimi K3 的先发与资本加持 月之暗面 K3 参数更大(2.8T)、Frontend Code Arena 居首、已在硅谷形成品牌声量,且手握 F 轮 35 亿美元、Pre-IPO 投前 500 亿美元的资本弹药,最快年内赴港上市——开源社区的"全球最大"标签争夺并未结束。 4. 算力约束与价格战双向挤压 2.4T 参数模型的训练成本与芯片限制是硬约束;激活 95B 缓解了推理成本,但训练端投入仍在财报上体现。同时 DeepSeek V4 Flash API 公测、Kimi API 输出价上探 100 元/百万 token,市场正在被"低价走量"与"高价旗舰"两种策略同时撕扯,千问的 12/36 元国内定价能否守住毛利,要看 8 月财报的 EBITA 数据。 另外,在本次已核验的 company-index 风险模块可见范围内,司法公告均为 2022–2024 年的程序性公告,未发现与本次模型发布直接相关的新增司法事项;这不构成对公司整体风险的评估结论。 七、下一步验证什么 下周开源后 :Qwen3.8-Max / 27B 权重在 Hugging Face 等社区的下载量与采用排名,能否压过 Kimi K3 先发的开源声量。 8 月财报(FY27 Q1) :云收入 45% 增速、EBITA 低双位数、AI 收入占比是否兑现;吴泳铭"6 月季度 MaaS ARR 破 100 亿、年底 300 亿"目标的首个对账点。 榜单稳定性 :Qwen3.8-Max 在 Vision / Text / Code Arena 的位置能否维持,还是发布窗口效应后回落。 客户结构 :百炼平台客户数与海外 API 调用量(token 需求增速 10 倍能否延续),以及"千问办公"Agent 的付费转化。 来源 搜狐财经|千问3.8-Max正式亮相!阿里美股涨超5% 界面新闻(东方财富转载)|千问3.8-Max正式亮相!阿里美股涨超5% 商业周刊(搜狐转载)|阿里巴巴发布千问3.8-Max人工智能模型 性能可与Anthropic相媲美 财闻(新浪财经转载)|阿里巴巴发布千问3.8-Max 中国人工智能模型突破再添新力 彭博社报道(17173转载)|月之暗面 Kimi 投前 500 亿美元估值洽谈 Pre-IPO 科创板日报(老虎社区转载)|月之暗面Kimi F轮融资超35亿美元,投后估值350亿美元 腾讯新闻|Anthropic 发布 Claude Opus 5($5/$25 定价) 今日头条|Claude Opus 5:性能比肩 Fable 5,价格减半 东方财富|阿里云 FY27 Q1 收入增速 45% 前瞻解读 今日头条|阿里云AI收入连续11季度三位数增长,ARR突破350亿 天眼查|阿里巴巴(中国)网络技术有限公司|工商基础信息 天眼查|阿里巴巴(中国)网络技术有限公司|2025企业年报 天眼查|阿里组织架构调整,吴泳铭发布全员信(2026-03)