北京深度求索人工智能基础技术研究:把 Token 打到 6 元还称毛利过半,这杯"奶茶"的账怎么算 新闻扩展 · 基于 2026-08-01 网易财经报道《AI大厂,打起了"Token奶茶大战"》及公开档案整理 过去两个月,OpenAI、Anthropic、DeepSeek、MiniMax 集体"发券",Token 第一次有了奶茶优惠券的既视感。作为这轮价格战的发起者之一,北京深度求索人工智能基础技术研究有限公司(DeepSeek,下称"深度求索")动作最直接:5月22日官宣旗舰模型 V4-Pro 永久降价75%,7月26日又上线 AI 行业首个峰谷定价。一边是百万 Token 输出价打到 6 元,一边是媒体报道其 V4 API 毛利率仍超 50%——低价与"高毛利"同框,正是这场"Token 奶茶大战"里最值得拆开的一笔账。 价格战按下快进键:2026年5月—7月 5月22日 · 深度求索 :官微宣布 V4-Pro 永久降价75%,非高峰输出价 6 元/百万 Token,输入侧缓存命中单价 0.025 元/百万词元,媒体称其为当时全球公开报价最低的顶级能力大模型。 5月27日 · 小米 :MiMo-V2.5 全系列 API 永久下调资费,部分细分调用场景降幅逼近99%。 6月2日 · 腾讯云 :公告自6月3日起对 DeepSeek-V4 全系列同步下调调用价格,最高降幅97.5%。 6月 · MiniMax :旗舰 M3 上线不到两周宣布 API 永久半价,并把 Token 打包成 20/50/120 美元三档套餐,对应"中杯、大杯、超大杯"。 7月26日 · 深度求索 :V4 完成 API 全面切换,行业首个峰谷定价落地——高峰时段(9:00–12:00、14:00–18:00)价格翻倍至 12 元/百万 Token,非高峰 6 元,低谷时段另有折扣(媒体报道称直降七成)。 7月31日 · OpenAI :GPT-5.6 Luna API 输入/输出价格统一下调80%(每百万 Token 分别 0.2 美元/1.2 美元),旗舰 Sol 维持原价。 时间线依据媒体报道整理;各厂商"永久降价"与"半价"口径均以厂商公告为准。 6 元 vs 约 180 元:低价不是补贴,是成本结构 ≈30倍 V4-Pro 非高峰输出 6 元/百万 Token,同档位 GPT-5.5 报价约 180 元(媒体对比口径) >50% The Information 援引知情人士:V4 API 毛利率超50%,靠优化基础设施减少运行模型所需芯片 17.44亿 2026年Q1营收、净利6.84亿元、净利率39.5%(自媒体披露口径,未经公司确认) 7.72万亿 OpenRouter 6月:周调用 Token 量,连续五周全球机构调用量第一 深度求索的底牌在成本侧:V4-Pro 为 2026年4月发布的旗舰模型,总参数 1.6 万亿,媒体称其为全球最大开源混合专家模型;百万级调用场景下单次推理算力消耗降至前代 27%,缓存显存占用仅为前代 1/10,公司此前还曾自曝理论成本利润率一度高达 545%。这意味着它降价 75% 之后仍有空间,而跟随降价的大厂云(腾讯云跟降到97.5%)和纯靠算力差价吃饭的中间商,没有这个空间。 需要提醒:17.44 亿元的单季营收口径与 The Information"近期年化收入 4 亿–5 亿美元(约28亿–35亿元)"并不吻合,两组数字均未获公司确认,引用时须区分口径。 峰谷定价:给"无限量补贴"踩刹车 深度求索在公告中明确"借鉴电力行业定价逻辑"——算力集群不能关机、负载有昼夜节奏,与电网同理。高峰翻倍、低谷降价,本质是把需求从高峰时段挤向低谷,摊薄闲置算力。长江证券与高盛均认为,这反映算力资源紧缺背景下,行业正从激进价格战转向理性竞争。 翻译成大白话:Token 送得越多、算力账单越涨,峰谷定价就是深度求索自己的"刹车片"。它既想用低价圈住开发者,又不想被高峰期的算力成本拖垮——发券拉新与限流保毛利,在这个定价机制里第一次被写进了同一张价目表。 为什么是现在:Agent 把 Token 从"按量计费"卷成"会员运营" Agent 用户暴增 :6月初 Codex 周活跃用户超 500 万,是2月桌面应用推出时的 6 倍多;其中非开发者约占 20%,增速超过开发者的 3 倍。 单次消耗暴增 :到5月,80.6% 的 Codex 个人用户至少提交过一次相当于 30 分钟以上人工任务,25.6% 提交过相当于 8 小时以上的任务。 模型差距缩小 :研究者分析 7156 个由编程 Agent 生成的 GitHub 拉取请求后发现,没有任何一个工具能在所有任务中领先——最好的模型变成一道动态选择题。 迁移成本骤降 :深度求索同时提供 OpenAI 和 Anthropic 兼容接口,开发者不换工作界面就能换底层模型;MiniMax 的 Token 套餐也能直接接入 Claude Code、Cline、OpenClaw。 结论很直接:头部模型在常用任务上越来越像,用户越来越"花心"。厂商争的不是一次调用,而是谁先成为个人工具和企业工作流里的"默认模型"——模型负责把人吸引来,补贴负责说"先别走"。 反面证据:补贴买得到用户,买不到忠诚 企业客户"薅完就走" :据《华尔街日报》报道,AI 客服平台 Pylon 的 CEO 透露,公司今年从一家模型供应商处获得约 160 万美元免费 Token,另两家各送出数万美元额度,甚至有厂商提供数月无限量免费使用权;他的原话是"我完全看不到任何忠诚度"。 研究结论 :微软研究发现,编程 Agent 能否被持续使用,取决于真实需求而非优惠券。 中间商的先例 :硅基流动 2025 年营收 5533 万元、毛利率 -24%(公有云业务 -119%),三年累计净亏 4.4 亿元;它 2025 年发出 5421 万元算力推广补贴,但 2026 年前 4 个月共享算力用户仅 145 万,约为 2025 年全年(545 万)的四分之一——补贴一停,人就走了。 涨价回血的先例 :MiniMax M3 转为 Token 计费后,Starter 套餐月费从 29 元涨至 49 元,同等任务成本飙升 257%,引发开发者抗议。"先低价圈人、再涨价回血"的路径一旦走得太急,用户会用脚投票。 这场大战的"账",最终取决于一个问题的答案:当各家不再送额度、补贴战打完,Pylon 们会定居在哪家模型上?留存率才是比价格更硬的指标——而目前所有公开证据都指向,补贴能买来流量,买不来工作流。 账本与底牌:一家67人的法人独资公司,为何开始对外融资 收入端 :媒体报道年化收入 4 亿–5 亿美元(约 28 亿–35 亿元),主要来自企业与开发者的 API 调用,为后续私募融资和 IPO 计划提供财务支撑。 钱从哪来 :2026年4月,深度求索启动成立以来的首轮外部股权融资,估值超 100 亿美元(约 681.8 亿元),计划募资不少于 3 亿美元(约 20.5 亿元),报道归因于研发成本激增与核心人才流失——研究员罗福莉、郭达雅近期被小米、字节跳动等挖角。7月又有报道称,公司拟启动第二轮约 500 亿元融资,估值约 740 亿美元(另一口径 710 亿美元),并筹划 2027 年科创板上市;而首轮路演时,公司对外口径还是"五年内无 IPO 计划"。 主体结构(天眼查) :北京深度求索成立于 2023年5月16日,注册资本 1000 万元(实缴 1000 万元),有限责任公司(法人独资),法定代表人裴湉,2025 年报参保人数 67 人,为增值税一般纳税人;唯一股东为杭州深度求索人工智能基础技术研究有限公司(持股100%),疑似实际控制人为梁文锋,间接持股比例约 89.46%。 一个注册资金 1000 万、参保 67 人的"瘦"主体,撑着一个 1.6 万亿参数模型和一场全球价格战——这正是它必须从"自我供血"转向对外融资的原因。Token 越送越多、算力账单越涨,这个矛盾最终会落在资产负债表上:要么毛利被补贴吃掉,要么限流把用户推走,深度求索选择用峰谷定价和外部融资两头对冲。 下一步验证什么 峰谷定价跑满一个完整计费周期后,V4 API 毛利率是否还能守住"超 50%"的报道口径。 补贴退坡后企业客户的付费留存率——谁留下,谁才是这场大战的赢家。 第二轮融资与中东美元资本是否落地,约 740 亿美元估值如何验证。 低价是否进一步传导为限流:高峰翻倍定价之后,还有没有更硬的配额、排队或降速控制。 来源 网易财经《AI大厂,打起了"Token奶茶大战"》(原报道,2026-08-01) 证券时报《DeepSeek,大消息!启动首轮外部融资!》 ITBear《DeepSeek年化收入逼近5亿美元》(转引 The Information) ITBear Finance《DeepSeek年化收入近5亿美元 加速融资布局并筹划2027年科创板上市》 头条《DeepSeek V4峰谷定价拆解:Token直降70%,定价权正历史性转移》 头条《2026年5月22日,DeepSeek在官微丢出一条不长不显眼的推送——V4-Pro永久降价75%》 凤凰网/每日财报《硅基流动:三年亏4.4亿,毛利率-24%,这门卖水生意还能做多久》 天眼查|北京深度求索人工智能基础技术研究有限公司(工商信息、股东、实控人、年报、纳税资质)