阿里巴巴(中国)千问3.8-Max卡在中间价位:输出36元,是Kimi K3的三分之一,是DeepSeek V4 Flash的18倍 8月3日,阿里巴巴(中国)旗下通义千问正式发布2.4万亿参数旗舰Qwen3.8-Max:国内API每百万Tokens输入12元、输出36元,隐式缓存命中仅1.5元,并宣布下周开源权重 [1] [2] 。这个价格恰好卡在国产头部的中间档——输出单价是Kimi K3(100元)的约三分之一,却是DeepSeek V4 Flash(2元)的18倍 [3] [4] 。按钛媒体对这场对局的拆解,千问既不打Kimi的"价值定价",也不跟DeepSeek的"成本定价",押的是稳定性与交付质量折算出的综合成本 [1] 。中间价位能不能站住,就看这笔账能否被真实账单验证。 为什么是现在:两个月内四款旗舰密集落地 7月15日 DeepSeek V4正式版全量上线,Pro版1.6万亿总参数、490亿激活,MIT协议开源 [5] 7月16日晚 月之暗面"空降"发布Kimi K3:2.8万亿总参数刷新开源模型规模纪录,Arena综合得分登顶、力压Claude Fable 5与GPT-5.6 Sol [6] [7] 7月19日 WAIC 2026期间,阿里云发布Qwen3.8-Max预览版,官方称"可能是除Fable 5外最强大的模型" [5] 7月31日 DeepSeek V4-Flash正式版上线:284B总参、13B激活,只靠重新后训练就把Agent跑分拉到逼近Claude Opus 4.8,输出价2元/百万Tokens [4] [8] 8月3日 Qwen3.8-Max正式上线,同日公测AI Agent产品"千问办公";发布日阿里巴巴港股早盘涨近6%(ZAKER口径),午盘涨幅超7%、总市值回升至约2.4万亿港元(虎嗅口径) [2] [9] 8月中旬 预计开源Qwen3.8-Max权重及27B轻量版 [10] 2026年国产大模型头名半年内换了至少五次:1—2月Qwen领先、3月中下旬Kimi一度领先、4月下旬DeepSeek V4登顶、6月下旬GLM-5.2上位、7月Kimi K3夺走风头 [7] 。Qwen3.8-Max不是"要不要发"的问题,而是"在这个窗口必须发"的问题。 价格卡位:同一张牌桌上,三套定价逻辑 模型 输入(元/百万Tokens) 输出(元/百万Tokens) 缓存命中输入 总参数/激活参数 Qwen3.8-Max (阿里) 12 36 1.5 2.4万亿 / 95B Kimi K3(月之暗面) 20 100 2 2.8万亿 / 1040亿 DeepSeek V4-Pro 3 6 0.025 1.6万亿 / 490亿 DeepSeek V4-Flash 1 2 0.02 2840亿 / 130亿 价格来源:Qwen/Kimi/DeepSeek V4-Pro三模型同源对比见头条对比文(V4-Pro挂牌价另有横评记录为输入2元/输出8元,两口径并存) [3] [11] ;V4-Flash定价见 [4] [8] 。激活参数:Kimi 1040亿、Qwen 950亿、DeepSeek V4-Pro 490亿 [3] 。 50× Kimi K3输出价(100元)是V4-Flash(2元)的50倍,头部价格带已拉开一个数量级 18× Qwen输出36元是V4-Flash的18倍——这就是"能力全面占优、价格差距远大于能力差距"的落点 [1] 36% Qwen输出价仅为Kimi K3的36%,即K3比Qwen贵近3倍 [10] 三家定价逻辑各不相同。Kimi K3是"价值定价":主动对标Fable 5(10美元/50美元)与GPT-5.6 Sol(5美元/30美元)的价格区间,月之暗面企业业务负责人明确回应"开源模型、中国大模型不该被贴上低价标签" [6] [10] 。DeepSeek是"成本定价":把推理成本压到极致,V4-Pro成本降至前代约27%,Flash则证明小模型+后训练也能打Agent [3] [8] 。Qwen是"差异化定价":介于两者之间,靠自研芯片与超节点降本,不靠价格战抢流量 [3] 。 能力账:跑分好看,实测分化 按官方与第三方榜单,Qwen3.8-Max的成绩单不弱:PaperBench 93.0分(超过Claude Fable 5的88.8)、OSWorld-Verified 86.1分居主流模型首位、CoWorkBench 74.8分(Fable 5为75.9)、Vision Arena全球第二、文本Arena整体仅次于Claude系列 [2] [7] 。Kimi K3则握有Arena综合登顶、BrowseComp 91.2% SOTA、前端编程盲测第一 [6] [7] 。 第三方同尺子实测把差距切得更细:在ZPedia同一套测试下,Qwen3.8-Max预览版首轮交付完整度更高,完成同复杂度网页任务约17分钟、Kimi K3约52分钟,效率差近3倍;但Qwen预览版在长任务中出现过"无提示中断",Kimi K3慢而更稳 [12] [13] 。另一端,Artificial Analysis的数据显示K3完成同套评测生成的Token量是同类模型均值的2倍、输出速度约62 Token/秒(中位约73)——单价贵之外还有效率折损 [3] 。 这就是钛媒体原文抛出"成绩单好看,口碑跟不上跑分"疑问的原因:与Kimi K3对比,Qwen仅在工作流智能体任务上胜出,多数基准落后但差距有限;与DeepSeek V4 Flash对比,能力全面占优,但价差远大于能力差 [1] 。中间档位的每一分钱溢价,都要靠交付质量来还。 中间价位的赌注:垂直整合与生态变现 千问守住中间价的底气,第一层在基础设施。阿里真武M890超节点已适配Qwen3.8:64颗平头哥M890芯片、800GB/s互联、总显存9TB,单节点即可运行模型,Agentic推理场景全链路优化后最高1.5倍性能提升 [2] [3] 。第二层在缓存:隐式缓存命中1.5元/百万Tokens,长文档与Agent高频场景的实际账单更接近DeepSeek一档 [2] 。第三层在变现闭环——和君咨询合伙人沈佳庆的判断是:Kimi作为独立公司必须靠模型业务直接盈利,而千问背靠阿里生态,用低价与开源吸引开发者上云,靠算力租赁、存储等周边服务变现 [12] 。 产品端也在为这个闭环铺路。8月3日公测的"千问办公"整合QoderWork、悟空、MuleRun三款Agent,由钉钉新任CEO陈宇森负责,业务团队与决策层5—6月多次开会后定调"企业级"而非C端 [9] [7] 。参照易观口径,2026年6月国内17款桌面端AI办公平台月访问量破6000万次,腾讯WorkBuddy以2097万次居首,阿里QoderWork排第三 [9] 。企业级是慢生意,但正是阿里云与钉钉沉淀多年的场。 开源底牌:第一次放出Max权重,27B打中小生态 Qwen3.8-Max是千问首次开源Max旗舰权重,并同步放出27B小尺寸版本 [2] [10] 。存量生态是千问最大的差异化资产:截至2026年7月,千问累计开源超400个模型,Hugging Face累计下载量突破10亿次(是其他8家主流开源组织合计的2倍以上),衍生第三方模型超20万个、全球日均新增超200个 [10] [3] 。 对中小团队,许可证差异同样值得看:Kimi K3采用定制分层许可证,C端产品月活达1亿或月营收2000万美元须标注模型来源,云厂商连续12个月营收超2000万美元须单独签约;Qwen3.8的开源协议约束明显更宽松 [14] 。27B瞄准的正是"能本地跑、商用合规摩擦小"的中小开源生态——这是Kimi和DeepSeek当前都没有完整覆盖的一层。 风险观察:四块石头 稳定性缺口待复验。 "押注交付质量"是中间价位的立身之本,但第三方对 预览版 的实测显示长任务存在无提示中断,稳定性弱于Kimi K3;正式版权重开源前,这条叙事缺一次第三方复验 [12] [13] 。 团队与投入的持续性。 今年3月千问团队经历核心技术岗位变动,阿里官方辟谣集体离职传言,由CEO、CTO统筹基础模型支持小组,并确立三年超3800亿元的AI基础设施投入(公司档案亦记录阿里正推进3800亿元AI基建并计划追加) [5] [15] 。投入是护城河,也是必须兑现回报的账本。 关键数据未公开。 Qwen3.8-Max的私有部署最低硬件配置、1M上下文场景显存占用等尚未披露,私有化部署成本仍无法准确评估 [3] 。 口碑与节奏双重压力。 6月"阿里用2.5万假账户、2880万次API调用偷学Claude"的传闻流传,截至档案记录无Anthropic公告、无起诉文件、无阿里回应,属未实锤 [15] ;而头名半年内换五次、OpenRouter 7月调用量前六全是中国开源模型的节奏,意味着每次发布窗口都在缩短 [7] 。资本端,月之暗面计划8月启动上市前最后一轮融资、目标投前估值500亿美元(约3380亿元) [6] ——独立模型公司估值高企,反过来抬高了市场对阿里3800亿投入回报的预期。 下一步验证什么 8月中旬权重落地 ——Max开源后真实部署的门槛、稳定性与缓存命中率能否被第三方同口径复算(DeepSeek缓存命中率第三方实测差异就很大,最低不足50%,Qwen需要自证) [3] 千问办公公测 ——企业级付费留存与钉钉入口导流,决定"模型送进工作流、Token回流成数据"的飞轮是否转得起来 [9] 综合成本账 ——"单价×Token消耗×返工率"才是真实账单,中间价位能否守住,取决于交付质量能不能把18倍价差折算回去 [1] 中间价位从来不是参数表上的事。Qwen3.8-Max的36元能不能站住,不取决于跑分墙上的位置,而取决于下一份真实账单:同样的活,千问是不是真的更省事、更少返工、更少半夜重跑。 来源 钛媒体:千问迎战Kimi、DeepSeek,阿里的胜算在哪? ZAKER:阿里Qwen3.8-Max模型,2.4万亿参数冲进全球第一梯队 头条:Qwen3.8-Max即将开源,万亿级模型部署成本与生态路线有何差异 头条:DeepSeek V4-Flash 正式版来了,百万Token输出只要2元 百家号:Qwen3.8喊出除Fable5外最强!2.4万亿参数即将开源 中国经济网(中国企业家):Kimi冲上3300亿,揭秘杨植麟和他的万亿模型 亿邦动力:阿里Qwen3.8正面硬刚Kimi K3:参数战打到2.4万亿 新浪(深潮):DeepSeek V4 Flash:Agent超Pro,价格屠夫 虎嗅(钛媒体):千问办公,阿里准备用来打谁? 头条:阿里千问Qwen3.8-Max发布:API定价仅Kimi三分之一,下周开源 凹凸圈:2026年国内大模型横评 头条:Qwen3.8-Max对比Kimi K3:长任务快3倍,但稳定性存短板 头条:Qwen3.8-Max发布,编程办公提升,与Kimi K3对比结果出炉 头条:国产两大旗舰对决:Kimi K3 VS Qwen3.8-Max 天眼查:阿里巴巴(中国)有限公司|新闻舆情 天眼查:阿里巴巴(中国)有限公司|工商基础信息 天眼查:阿里巴巴(中国)有限公司|企业年报(2025) 头条:DeepSeekV4-Flash正式版上线:智能体便宜能干活