事时观察 · AI 定价战 杭州深度求索人工智能基础技术研究:'斩杀线'刷屏当天,官方公告涨价——中端模型先出局? 开发者社区以 DeepSeek V4 Flash 的"能力×价格"为基准划了一条斩杀线:输出价 2 元/百万 Token、能力追到 GLM-5.2 身后 1 分、Agent 基准多项反超、OpenRouter 调用量冲上全球第一。以它为界,市场被切成三块,最危险的中间层被直接点名。然而就在"大模型 API 涨价时代已结束"刷屏的同一天(8月6日),杭州深度求索人工智能基础技术研究(下称 DeepSeek)官方公告:计划近期整体上调 API 服务定价,且"预计涨幅较大"。斩杀线自己先动了。 一、斩杀线是怎么划出来的:一组价格与能力的对照 V4 Flash 正式版于 7 月 31 日上线,总参数 284B、动态激活仅 13B,靠 MoE 稀疏架构把推理成本压到行业地板。 网易财经转载的《恐怖的DeepSeek斩杀线》 给出的数字是:DeepSWE 从上一代 7.3 分飙到 54.4 分,Terminal Bench 2.1 到 82.7,Artificial Analysis 综合智能指数只比 GLM-5.2 低 1 分,代码与智能体指数反超——而 API 输出价仅为 Fable 5 的 1/178、输入价 1/70。 2 元 V4 Flash 输出单价(每百万 Token),输入 1 元、缓存命中仅 0.02 元 85 倍 V4 Flash 与 Claude Opus 4.8 的输出价差(2 元 vs 170 元) 8 万亿 8 月 1 日单日 Token 消耗量,OpenRouter 调用量升至全球第一 4000 亿 DeepSeek A 轮估值(人民币),6 月刚完成 510 亿融资 把各家 API 现行价放在一张表里,斩杀线的位置一目了然(单位:元/百万 Token,据公开定价页整理): 模型 输入(缓存未命中) 输出 缓存命中(输入) 备注 DeepSeek V4 Flash 1 2 0.02 高峰时段(工作日 9–12 点、14–18 点)2 倍 DeepSeek V4 Pro 3 6 0.025 5 月曾永久降价 75%,斩杀线概念的源头 GLM-5.2(智谱) 8 28 约 1.4–1.6 3–7 月累计提价 83% Qwen3.8-Max(阿里) 12 36 1.5 — Kimi K3(月之暗面) 20 100 2 较上一代 K2.6 输入 +208%、输出 +270% GPT-5.6 Luna(OpenAI) 约 1.3(0.2 美元) 约 8(1.2 美元) — 7 月 30 日紧急降价 80% Claude Opus 5(Anthropic) 约 36(5 美元) 约 180(25 美元) — 7 月发布,被称为"半价旗舰" 把"写一段 1 万字代码"(约 1M Token 输入+输出)折算成总成本: 腾讯新闻的实测对比 给出的结果是 Kimi K3 约 120 元、Qwen3.8-Max 约 48 元、V4 Flash 约 3 元——最高与最低差 40 倍。 今日头条援引华泰证券研报 的判断是:Kimi3 代表国产开放权重模型的能力上限,V4 Flash 刷新了 50 分能力区间的成本底线。 二、三阵营切割:中间层被写进"斩杀区" 源文章把市场切成三块,并给出每个阵营的生存逻辑: 阵营 代表模型 能力位 价格位(输出/百万 Token) 处境 高端 暂安全 Claude Opus 5、GPT-5.6 Sol、Kimi K3 不可替代:超长文档推理、复杂数理、多模态 25 美元档及以上(K3 为 100 元) 贵但有人买单;K3 涨价 270% 仍爆单 中端 斩杀区 GLM-5.2、Qwen3.8-Max 等 与 V4 Flash 相近或只强一点 28–36 元(vs Flash 2 元) 切到 DeepSeek 成本大降、体验差距小——最危险 低端 有生意 专用小模型、免费档(如智谱 GLM-4.7-Flash) 够用:翻译、分类、简单问答 0 至数元 成本敏感场景照样有生意 斩杀线的传导逻辑是:今后任何新模型一出生就得跟 V4 Flash 对标,"能力相近、定价更高"的直接进入斩杀区。源文章据此断言"大模型 API 涨价的时代彻底结束了"。 三、时间线:从永久降价 75%,到"涨幅较大"的涨价公告 2026-05-22 DeepSeek 将旗舰 V4-Pro 的 API 价格永久降至原价 1/4(降幅 75%),被业界称为"大模型斩杀线"概念的开端。 潮新闻 2026-06-14 DeepSeek 完成 A 轮:510 亿元、出让 12.75%、估值 4000 亿元,投资方含腾讯投资、宁德时代、网易、京东集团、IDG 资本、正心谷资本、拾象科技、砺思资本、国家人工智能产业投资基金及梁文锋本人。 天眼查 2026-07-09 OpenAI 发布 GPT-5.6 三款模型(Luna/Terra/Sol)。 今日头条 2026-07-16 月之暗面发布 Kimi K3:2.8 万亿参数、开源、原生多模态,定价对标海外旗舰。 今日头条 2026-07-30 OpenAI 宣布 GPT-5.6 Luna API 降价 80%(输入 0.2 美元、输出 1.2 美元),距发布仅三周。 腾讯新闻实测 2026-07-31 DeepSeek V4 Flash 正式版上线:结构、尺寸与预览版一致,仅重做后训练,Agent 基准大幅反超 Pro 预览版;同一天智谱把 GLM 5.2 Coding Plan 订阅价格最高上调 3.6 倍。 腾讯新闻 、 今日头条 2026-08-01 V4 Flash 单日消耗 8 万亿 Token,第三方平台 OpenCode 称其平台当日跑掉 8T tokens;OpenRouter 调用量登顶全球第一。 量子位 2026-08-06 DeepSeek 官方公告:计划近期整体上调 API 服务定价,"预计涨幅较大,具体方案以正式通知为准"。 潮新闻 四、反转:为什么"价格屠夫"自己先涨价 8 月 6 日的公告来得突然:就在前一天,市场还在传 OpenRouter 上 V4 Flash 登顶、"7 分钱一个 3D 游戏"的开发者实测。公告只说"整体上调、涨幅较大",未公布幅度与生效时间。目前 DeepSeek 官方价仍是 V4-Flash 输入 1 元/输出 2 元、V4-Pro 输入 3 元/输出 6 元,且已执行峰谷定价(高峰时段 2 倍)。 对这次涨价, 搜狐科技的分析 给出了两个方向:一是 DeepSeek 贴地飞行的价格"已经便宜到整条产业链都很难站直"——第三方云以官方价数倍转售同一模型,官方低价反而挤压了整个转售生态,涨价可以理解为给链条留出呼吸空间;二是需求洪峰(8 万亿 Token/天)带来的算力与成本压力,需要用价格调节。该文判断:"斩杀线暂时抬高了,但大模型价格战的危机从未解除。" 对照组的反例值得注意:智谱今年走了完全相反的路。 据 今日头条梳理 ,2026 年 3 月至 7 月智谱对 GLM 全系列 API 三次提价、累计 83%,是同期唯一全系列涨价的国内厂商;提价后付费 Token 调用量反而增长 400%,据称 ARR 突破 2.5 亿美元。智谱 7 月 31 日把 GLM 5.2 Coding Plan 最高档从 469 元调到 1078 元(涨 3.6 倍),消息公布后港股开盘上涨 23%。这说明"涨价"本身不是死因——没有不可替代能力的中端才是。 五、公司侧写:参保 20 人的"小公司",为什么敢划这条线 工商登记 2023-07-17 成立,注册资本 1500 万元、实缴 1000 万元,法定代表人裴湉,参保人数 20 人,登记为增值税一般纳税人(2023-08-01 起) 天眼查 股权结构 宁波程恩企业管理咨询合伙企业持股 66%,梁文锋直接持股 34%(认缴 510 万元,出资日期 2026-04-24) 天眼查 实控认定 疑似实际控制人梁文锋,穿透持股比例约 84.3% 天眼查 创始人背景 梁文锋,幻方量化创始人,浙大信息与电子工程学本科、硕士;幻方 2020–2021 年投入建设"萤火一号/二号"AI 超算,2023 年 7 月成立 DeepSeek 天眼查 支撑"价格屠夫"叙事的,正是这家公司的成本结构:4000 亿元估值、A 轮 510 亿元到账,主体参保仅 20 人。源文章引述一份投资人会议纪要称,梁文锋明确"不追求利润最大化,争取 10 个月回本就行",主动把价格降到原价 1/4 后"按 10 个月回本标准还有下降空间"。这也解释了为什么 V4 Flash 敢用"2 元/百万 Token"贴地飞行——它不是烧钱抢市场,而是成本降下来后把红利让出去。但 8 月 6 日的涨价公告同时说明:贴地飞行也有成本底线,或需求洪峰已经触及这条线。 六、风险观察:V4 Pro 落地后,哪个梯队最先出局 结论:最先出局的是"无不可替代场景的纯中间层"——不是高端,也不是低端。 判定标准就一条:能力差距在 5% 以内、价格差在一个数量级以上。按此对照: 中端(斩杀区核心): GLM-5.2 智能指数 51 分仅比 V4 Flash 高 1 分,Terminal Bench 2.1 只有 81.0、反低于 V4 Flash 的 82.7,输出价却是 14 倍(28 元 vs 2 元);Qwen3.8-Max 输出价 18 倍于 V4 Flash。这类模型若没有专属场景(中文、云生态、政企合规),切换成本几乎为零,是最先被斩的对象。 网易财经 、 今日头条 高端(暂无恙): Kimi K3 走"最强"路线,输出涨价 270% 仍爆单,Frontend Code Arena 1679 分登顶、超过 Claude Fable 5 与 GPT-5.6 Sol,多模态不可替代;OpenAI 降价 80% 后, 微博声浪计划引述的数据 是单次任务成本仍比 V4 Flash 高约 60%。高端拼的是"贵但只能用它"。 变量在 DeepSeek 自己: 若涨价落地,斩杀线上移,中端获得喘息窗口;若源文章所称"即将发布"的 V4 Pro 旗舰(1.6 万亿参数、自研 Harness 工具链)以类似低价补刀,斩杀线将再次下移,中端二次承压。值得对照的是,截至 8 月 V4-Pro 已以 1.6 万亿总参、490 亿激活参数现身公开基准,API 按 3 元/6 元计价。 七、下一步验证什么 涨价落地细节: 官方"以正式通知为准",具体涨幅、生效时间、是否涉及峰谷机制调整,是判断斩杀线真实位置的第一验证点。 V4 Pro 正式版与 Harness: 源文章称 1.6 万亿参数旗舰配自研 Harness 工具链即将发布,其定价与 Agent 基准将决定中端被斩的深度。 海外跟进: OpenAI 已降 80%、Anthropic 推出"半价旗舰"Opus 5,若两者继续下探,中端压力反而来自两端。 智谱与月之暗面 Q3 定价动作: 智谱"量价齐升"能否持续、K3 能否守住 100 元/百万 Token 的溢价,决定"能力定价"路线是否成立。 调用量持续性: 8 万亿 Token/天、OpenRouter 第一的峰值能否维持,将检验低价策略是否真的跑出了规模效应。 来源 网易财经(快刀财经):恐怖的DeepSeek斩杀线(2026-08-06) 潮新闻(搜狐转载):DeepSeek上调定价,预计涨幅较大(2026-08-06) 搜狐科技:DeepSeek抬高了斩杀线,但价格战仍无法避免(2026-08-06) 量子位(百家号):"斩杀线"来了!DeepSeek V4 Flash性能逼近顶级(2026-08-05) 微博声浪计划(今日头条):DeepSeek斩杀线由V4-Flash划出(2026-08-05) 今日头条:Kimi K3对决DeepSeek V4:最强vs最便宜(2026-08-03) 今日头条:Kimi3贵但强,DeepSeek V4 Flash便宜到爆(2026-08-06) 腾讯新闻:Kimi K3和DeepSeek V4 Flash,价格相差40倍(2026-08-03) 腾讯新闻:实测DeepSeek V4 Flash正式版(2026-07-31) 今日头条:OpenAI骨折降价,智谱反向涨价(2026-07-31) 今日头条:大模型"集体涨价"真相:仅智谱累计提价83%(2026-07-29) 今日头条:Grok 4.5与智谱GLM-5.2路线重合(2026-07-09) API中转站:智谱 GLM 官方 API 定价指南(2026-07-30) 天眼查:杭州深度求索人工智能基础技术研究有限公司|工商基础信息 天眼查:杭州深度求索人工智能基础技术研究有限公司|股东 天眼查:杭州深度求索人工智能基础技术研究有限公司|疑似实际控制人 天眼查:杭州深度求索人工智能基础技术研究有限公司|融资历史 天眼查:杭州深度求索人工智能基础技术研究有限公司|核心团队 编辑说明:本扩展基于网易财经《恐怖的DeepSeek斩杀线》及同日公开报道整理。涨价公告原文为"计划近期整体上调DeepSeek API服务的定价,预计涨幅较大,具体方案以正式通知为准",具体涨幅与生效时间以官方正式通知为准;网络流传的"涨幅35%–50%"等数字未经官方确认,未予采信。V4 系列参数与发布时间在公开报道中存在口径差异,本文以源文章与公司档案为准并已标注来源。