北京深度求索人工智能基础技术研究官宣API全系涨价:登顶OpenRouter的"价格屠夫",三周后就要收刀 8月6日,北京深度求索人工智能基础技术研究有限公司(DeepSeek)在开发者后台弹出一条通知: 计划近期整体上调全系列API服务定价,"预计涨幅较大" ,并提醒用户合理规划调用量、控制充值金额,具体方案以正式通知为准。 来源:中国经济网 。而三天前,它刚以7.22万亿Token登顶全球最大AI聚合平台OpenRouter的周调用榜 来源:搜狐/IT之家 ——从7月中旬首次引入峰谷差异定价到全系涨价,只隔了约三周 来源:百度百家号 。 为什么偏偏是现在?先把数字摆出来:这家注册资本1000万元、参保仅67人的公司 来源:天眼查 ,正在承受全球大模型市场里最猛烈的用量冲击。 关键数字:低价策略撞上了"用量海啸" 7.22万亿 V4 Flash 单周Token调用量(7月27日—8月2日),登顶OpenRouter全球第一,刷新平台单模型周调用纪录 8万亿 8月1日单日Token处理量(OpenCode披露:5万亿来自免费额度、3万亿来自付费调用) 约6.6万亿 OpenRouter全平台日均Token规模——接入400余款模型的平台,被DeepSeek一款模型在单一入口的单日量反超 2倍 即将落地的峰谷定价:高峰时段(北京时间9:00—12:00、14:00—18:00)价格翻倍,适用所有计费项 用量数据来源: 搜狐/IT之家 、 中国经济网 、 百度百家号 。峰谷定价细节来源: 中国经济网 。 免费额度烧出来的规模,是这次涨价最直接的财务压力。OpenCode平台上8月1日当天8万亿Token中,免费额度占了5万亿 来源:中国经济网 。每一笔调用背后都是实打实的GPU与电力消耗,大模型推理不存在"边际成本归零"——低价换规模的策略,已经走到临界点 来源:AI TOP100 。 账怎么算:现在的价格,涨完还是"地板价" 官方公示的现行价格(每百万Token): 模型 输入·缓存命中 输入·缓存未命中 输出 高峰时段 deepseek-v4-flash 0.02元 1元 2元 各项×2 deepseek-v4-pro 0.025元 3元 6元 来源: 中国经济网 (DeepSeek官网公示)。今年4月V4-Pro上线时把API价格打到2.5折,5月宣布永久降价不再恢复原价 来源:网易号 。 即便高峰时段翻倍,V4-Pro输出价也才12元/百万Token,V4-Flash输出4元/百万Token,对照海外GPT-5.5长上下文版本约374元/百万Token的输出价,仍是其几十分之一 来源:网易号 。也就是说:涨价不等于放弃性价比,而是把"白菜价"调回"合理价"。 梁文锋的定价哲学:需求没有弹性,涨价就不掉量 创始人梁文锋7月在投资者交流会上给出过明确说法:API定价基于"到市场上买一批设备回来,十个月收回成本"的合理利润模型;当前需求几乎没有弹性,"价格翻一半,消耗量区别不大";公司并非追求利润最大化,而是"只赚一个合理的收益" 来源:百度百家号 来源:AI TOP100 。 行业里已有先例:2026年一季度,智谱对GLM系列核心API连续三次提价、累计涨幅83%,同期付费Token调用量反而同比增长400%,API业务年度经常性收入同比增长约60倍 来源:头条号 。但需要提醒:智谱的用户盘是政务、金融、先进制造等对数据安全敏感、对单价不敏感的B端客户,而DeepSeek的调用主力是价格敏感的开发者与Agent应用——"提价不掉量"能否复刻,取决于DeepSeek的能力溢价能否被它的用户群体感知。 分析建议:这是本次调价后最需要观察的变量。 反差:别人在降价,它要涨价 DeepSeek(8月6日) :全系API"预计涨幅较大",叠加峰谷2倍定价。涨价的底气是V4 Flash正式版(2840亿总参数、130亿激活参数、100万Token上下文)7月31日上线公测,是唯一支持Responses API并可接入Codex的V4模型,在TerminalBench、Cybergym等基准测试中表现突出 来源:中国经济网 。 OpenAI(7月底) :GPT-5.6 Luna砍价80%,入门级输入价从1美元降到0.2美元,为OpenAI史上最大单次降价;报道称直接原因是中国开源模型用低价抢走全球开发者,美国企业调用中国模型Token占比一年间从4.5%飙升至46% 来源:头条号 。 阿里云(7月19日) :Token Plan个人版Lite档39元/月;Qwen3.8-Max-Preview白天消耗打1折、夜间0.2折 来源:头条号 。 同一个赛道、同一个月份,动作完全相反。这印证了行业的定价分层:DeepSeek从"极致低价抢生态"转向"提价筛选付费用户",但前提是它的模型能力必须持续跑在对手前面——一旦被反超,定价权会瞬间丢失。 分析建议:相比单次涨幅,行业更该盯的是DeepSeek涨价后调用量的真实走向。 关联方信号:同一实控人名下的幻方量化,7月大幅回撤 涨价公告前夜,私募圈也出了大新闻。私募排排网数据显示,截至2026年7月31日,梁文锋旗下 幻方量化9只展示产品7月单月跌幅全部超过20% ,最大回撤来自幻方中证500量化进取1号(单月下挫22.15%);除1只产品保留0.04%的微弱年内正收益外,其余8只年内收益全部转负 来源:财联社/ZAKER 来源:新浪财经 。 边界提示:幻方量化是独立法人,其回撤不直接等于DeepSeek的财务损失。但按证券时报报道,幻方是DeepSeek的孵化方与早期"现金牛"来源 来源:证券时报 ;同属梁文锋实控体系(天眼查显示梁文锋为北京深度求索最终受益人,综合比例约89.46% 来源:天眼查 ),市场把幻方回撤解读为DeepSeek资金压力的背景音,属于合理推测而非公司披露事实。 公司档案:67人的"小而精",正在告别自我供血 北京深度求索人工智能基础技术研究有限公司成立于2023年5月16日,注册于海淀区科学院南路2号,注册资本1000万元(实缴),由杭州深度求索100%持股,法定代表人裴湉;2025年年报参保人数67人 来源:天眼查 。2026年4月,证券时报援引The Information报道称,DeepSeek正启动成立以来首轮外部股权融资,估值超100亿美元、计划募资不少于3亿美元,主因研发成本激增与核心人才流失(罗福莉、郭达雅被小米、字节跳动挖角),资金将投向算力、V4研发与商业化——消息仍在洽谈中,公司未正式回应 来源:证券时报 。 把时间线连起来看:4月首轮融资传闻 → 6月底峰谷定价预告 → 7月中旬峰谷定价落地 → 7月31日V4 Flash正式版公测 → 8月4日登顶OpenRouter → 8月6日全系涨价预告。这家公司正在完成从"技术黑马"到"商业化主体"的身份切换,涨价的预告只是第一步。 谁会受伤、胜负手在哪:下一步验证什么 直接受影响者: 依赖DeepSeek API的中小创业团队与高消耗Agent类应用——成本模型要全部重算;免费额度用户——公告已提醒"合理规划调用量、控制充值金额",免费额度是否同步收缩尚未明确。 来源:网易号 下一场"肉搏"的胜负手: ①模型效率——每Token能产出多少有效价值,比每Token单价更关键;②高峰时段稳定性——峰谷2倍定价下,用户会把调用挤向谷段,非高峰时段的吞吐与延迟将成为新的口碑分水岭;③B端体验——Responses API、Codex接入这类工程能力,才是留住付费客户的抓手。 可验证清单: 正式调价方案与具体涨幅(是否超市场预期);免费额度是否同步调整;V4-Pro正式版发布时间;涨价后OpenRouter/OpenCode调用量曲线;峰谷定价细则与生效时间。这些信息将以DeepSeek官方通知为准。 "价格屠夫"把刀收了起来,因为再砍下去,先见血的是自己。但涨价只是商业化肉搏的入场券——比价时代结束后,拼的是谁能在涨价之后还让用户觉得"值"。 来源 投资界:DeepSeek大涨价,梁文锋也撑不住了?(原文) 中国经济网/湖南日报:DeepSeek将大幅涨价(现价、峰谷定价、V4 Flash公测、OpenCode数据) 百度百家号:DeepSeek拟上调API服务定价(官方公告、峰谷三周、梁文锋定价哲学) 搜狐/IT之家:OpenRouter称DeepSeek-V4-Flash调用超7.22万亿Token登顶 AI TOP100:涨价原因(幻方回撤、算力成本、需求弹性) 网易号:一觉醒来DeepSeek涨价了(价格战复盘、行业集体"反水") 财联社/ZAKER:幻方量化9只产品7月跌幅超20% 新浪财经:幻方量化7月大幅回撤 头条号:智谱三次提价83%调用量反涨400% 头条号:OpenAI砍价80%、中美模型定价差 头条号:阿里Token Plan个人版、Qwen3.8-Max一折 证券时报:DeepSeek启动首轮外部融资(估值超100亿美元) 天眼查:北京深度求索人工智能基础技术研究有限公司工商档案