杭州深度求索人工智能基础技术研究:V4 Flash 刚画完「斩杀线」,就宣布「涨幅较大」 扩展自 搜狐财经《DeepSeek 的「斩杀线」,正在重塑 AI 行业的世界观》|事件窗口:2026-07-27 至 08-07 8 月 4 日,「DeepSeek 斩杀线」冲上微博热搜——杭州深度求索人工智能基础技术研究有限公司(下称 DeepSeek)的 V4 Flash 正式版,在 Artificial Analysis 实测上百款模型后画出的「成本-性能」散点图上站在最优位置,比它贵的没它强,比它便宜的没它强。两天后的 8 月 6 日,同一家公司却在开放平台后台挂出公告:「计划近期整体上调 DeepSeek API 服务的定价,预计涨幅较大,请合理安排您的使用。」 搜狐财经 单日 8 万亿 Token、周调用量登顶全球第一之后,杭州深度求索遇到的瓶颈已从效率问题变成物理问题:请求量以万亿级涌入时,MoE 稀疏激活再怎么省算力,也需要更多机器,而机器要花钱。这篇扩展围绕一条主线展开:万亿级调用冲击下,算力瓶颈如何影响服务稳定性,以及涨价公告背后有多少种剧本。 一、先看数字:一款模型吃掉一个平台的流量 7.22 万亿 Token:V4 Flash 周调用量(7/27–8/2),OpenRouter 全球榜首 8 万亿 Token:OpenCode 平台 8 月 1 日单日处理量(免费 5 万亿+付费 3 万亿) 6.6 万亿 Token:OpenRouter 接入 400 多款模型的全平台日均量(极客公园口径) 1 元 / 2 元 V4 Flash 缓存未命中输入/输出单价(每百万 Token,人民币) 50 : 51 Artificial Analysis 智能指数:V4 Flash 距 GPT-5.6 Luna 仅差 1 分 1 / 105 单次调用成本:V4 Flash 约 0.03 美元,Claude Fable 5 约 3.15 美元 8 月 4 日 V4 Flash API 因「前所未有的访问量」出现容量问题,官方称已修复 8 月 6 日 开放平台公告:整体上调 API 定价,「预计涨幅较大」 口径提示:8 万亿是 OpenCode 单一渠道、8 月 1 日单日处理量,不是 DeepSeek 全球总消耗;5 万亿免费额度占比约 62.5%,付费部分占 37% 以上,说明已进入开发者付费工作流,而不只是「薅羊毛」流量。 界面新闻 、 CSDN 分析 二、时间线:从登顶到涨价只用了一周 4 月 V4 Flash 推出(0423 版),主打平衡推理速度、长上下文与调用成本,面向开发者与商用企业的高吞吐推理服务。 界面新闻 7/16 月之暗面发布 Kimi K3,输入价较前代涨超 3 倍、输出价涨近 4 倍;上线仅三天因请求量超预估暂停 C 端新订阅。 搜狐财经 7/20–26 小米 MiMo-V2.5 以单周 10.5 万亿 Token 登顶 OpenRouter,随后一周回落 52% 至 5.1 万亿。 界面新闻 7/31 OpenAI 宣布 GPT-5.6 系列最高降价 80%(Luna 输入 $1→$0.2、输出 $6→$1.2,Terra 下调 20%),距两款模型推出仅约三周。 CSDN 分析 8/1 OpenCode 平台单日处理 V4 Flash Token 达 8 万亿;OpenCode CEO Jay 称上线后平台使用量单日增长 30%、Go 订阅新用户增长 30%。 CSDN 分析 8/3 OpenCode 团队发文披露单日 8 万亿数据;OpenRouter 周榜(7/27–8/2)确认 V4 Flash 以 7.22 万亿居首。 观点网 8/4 V4 Flash API 响应超时频繁、上午时段一度接近不可用,OpenCode 归因「前所未有的访问量」;DeepSeek 官方披露问题已解决。「DeepSeek 斩杀线」同日冲上微博热搜。 市场资讯 、 搜狐财经 8/5 界面新闻查询确认,V4 Flash 0423 仍居 OpenRouter 周榜首位(截至发稿 6.92 万亿);前五中中国模型占四位,DeepSeek 占前十三个席位。 界面新闻 8/6 DeepSeek 在开放平台后台发布公告:「计划近期整体上调 API 服务的定价,预计涨幅较大」——距离「斩杀线」叙事登顶热搜仅两天。 中国企业家 三、「斩杀线」的账本:便宜是怎么算出来的 V4 Flash 的性价比由三层结构支撑:其一,MoE 架构总参数约 2840 亿、每次推理仅激活约 130 亿参数,把单位推理算力开销压到极致;其二,自研磁盘上下文缓存(Context Caching on Disk)对命中输入仅收 0.014 美元/百万 Token,较未命中 0.14 美元直降 90%;其三,约 100 万 Token 上下文,让整个代码仓库可一次塞入,天然适配编程场景。 CSDN 分析 结果是价格差拉开一个量级:第三方定价汇总显示 V4 Flash 输入约 0.14 美元、输出约 0.28 美元/百万 Token;而 GPT-5.5 定价约 5 美元/百万 Token,价差约 35 倍。即便 OpenAI 降价 80% 后,Luna 输出价(1.2 美元)仍是 V4 Flash 的约 4.3 倍;Kimi K3 的输入 21 元、输出 105 元,比 V4 Flash 贵一个量级不止;Anthropic 旗舰模型价格高出近百倍。 CSDN 分析 、 搜狐财经 单次调用成本对比(Artificial Analysis 7 月底基准测试,据《中国企业家》援引) 模型 单次调用成本(美元) DeepSeek V4 Flash 约 0.03 Kimi K3 约 0.86 GPT-5.6 Sol 约 1.86 Claude Fable 5 约 3.15 有业界人士对上述参照系提出质疑:V4 Flash 的定位更接近 Claude Opus 4.8 层级,而非 Kimi K3 或 Fable 5;据公开信息,Opus 4.8 每百万输出 Token 定价约为 V4 Flash 的 85 倍。 中国企业家 四、算力的物理瓶颈:效率问题变成了机器问题 价格足够低,调用量便以万亿级涌入。但调用结构正在改变:随着 V4 系列支持 100 万 Token 上下文与更深思维链,单次任务的 Token 消耗从对话时代的不足 2000 个跃升至 50 万至 100 万个——Agent 类应用越多,单位请求越「重」。有业内人士测算,V4 Flash 此前「输入 1 元、输出 2 元」的定价大概率低于真实成本,API 毛利率为负。推理成本主要由硬件折旧、电力与运维构成,当处理量达到万亿级,总量就是一笔庞大支出。 中国企业家 8 月 4 日的容量事件是最直接的信号:官方将原因归结为「前所未有的访问量」。同样的画面 2025 年初也出现过——DeepSeek 初代爆红时普通用户一度排队,只是如今对基础设施的要求已不可同日而语。行业里流传的 DeepSeek 定价哲学是「以十个月收回设备等基础设施投入为基准」设定价格(该说法为传闻,未经官方证实);若按此逻辑,当基础设施成本曲线因规模化而上行,涨价就是数学上的必然。 搜狐财经 五、钱从哪来:A 轮 510 亿与「绝对控制权」 涨价公告前两个月,杭州深度求索刚刚完成公司成立以来首轮融资。天眼查融资历史记录显示:A 轮融资金额 510 亿元人民币、估值约 4000 亿元、本轮出让比例 12.75%,投资方含梁文锋、腾讯投资、宁德时代、网易、京东集团、Monolith 砺思资本、IDG 资本、正心谷资本、拾象科技与国家人工智能产业投资基金。 天眼查档案 工商层面同步变动:2026 年 4 月 27 日,注册资本由 1000 万增至 1500 万元,梁文锋出资额相应上调,登记持股比例升至 34%(宁波程恩企业管理咨询合伙企业持股 66%);据新浪财经引述企查查,7 月又新增杭州程砺企业管理咨询合伙企业(8.52%)与国家人工智能产业投资基金(0.28%)两个股东,注册资本增至 1644.75 万元——两套登记数据存在时点差异。 天眼查档案 、 新浪财经 控制权设计是这轮融资的关键细节:新机构通过今年 5 月设立的持股平台「杭州程砺」间接入股——腾讯关联公司持其 33.44%、宁德时代体系 11.71%、网易与京东各 10.03%、Monolith 砺思 9.7%、拾象/溥泉/IDG/正心谷各 5.02%——按证券时报说法,是为了保证梁文锋对公司的绝对控制权。同批报道还提到第二轮融资已开始、以及最快今年内提交 IPO 申请的消息,均为市场传闻,未经公司证实。 新浪财经 与此形成对照的是公司体量:天眼查档案显示杭州深度求索参保人数 20 人、人员规模小于 50 人,注册地杭州拱墅区,全资持有北京深度求索人工智能基础技术研究有限公司(注册资本 1000 万)。另一侧的商业化痕迹则很小:天眼查招投标记录里,它作为中标方为中国海洋大学工程学院提供 110 元的「科研 tokens 报销」、为合肥工业大学资源与环境工程学院提供 300 元的「大模型 API 接口调用」——单笔金额不大,但说明 token 已作为可采购商品进入高校科研预算。 天眼查档案 六、涨价的三档剧本:涨多少,谁在算账 「涨幅较大」到底多大?《中国企业家》援引行业测算给出了三档参照:100%–200% 是市场普遍认为的「温和区间」,大概率不引发大规模流失;300% 时输入价升至 4 元、输出 8 元,API 毛利率有望从负拉回至 30%–40% 区间并清洗低价值爬虫流量;触及 400%(输入 5 元、输出 10 元)时,仍低于国内旗舰模型普遍 5–10 元/10–30 元的价格带,但价差优势已从 10 倍级收窄至约 2 倍,部分高频用户可能认真测试替代品。 中国企业家 两个方向的判断都在场:一边是梁文锋此前在与投资者的交流中透露的判断——极低价格区间内开发者对价格弹性几乎为零,「价格即便翻倍,Token 消耗量也不会明显下降」;另一边是用户的临界点——有科研用户表示「API 价格再涨一倍还可以接受,超过一倍我就走了」,而 Agent 开发者态度更宽容:「翻个倍都能接受,毕竟相比别家已是骨折价。」 中国企业家 七、行业转向:token 正在变成大宗商品 涨价不是杭州深度求索一家的孤立动作,而是中国大模型定价逻辑集体转向的一部分:智谱一季度 API 定价较 2025 年底提升约 83%、调用量仍增长 400%;月之暗面 Kimi K3 输入/输出价分别涨超 3 倍、近 4 倍;阿里云、百度智能云 3 月上调 AI 算力价格 5%–34%/5%–30%,腾讯云年内两次涨价。行业观点是:当模型能力差距收敛(V4 Flash 智能指数仅比 GPT-5.6 Luna 低 1 分,多项 Agent 基准逼近 Claude Opus 4.8),token 越来越像标准化工业原料,定价逻辑回归「成本加合理利润」。 中国企业家 、 搜狐财经 全球流量格局也在重排:中国大模型在 OpenRouter 的周调用量已连续 14 周超过美国(上周 28.13 万亿对 4.38 万亿);中国厂商 Token 份额从一年前不足 2% 升至约 46%,美国厂商从约 70% 回落至 30%–36%。与此同时,免费模型(NVIDIA Nemotron 3 Ultra、Poolside Laguna S 2.1 等)环比涨幅多超 50%,对「付费低价」形成新一层挤压。 界面新闻 、 CSDN 分析 风险观察 稳定性风险(已兑现一次): 8 月 4 日 V4 Flash API 上午时段一度接近不可用;2025 年初爆红时也曾出现排队。万亿级调用下扩容是物理投入,且「机器要花钱」正是涨价公告的注脚。 市场资讯 涨价反噬风险: 「斩杀线」叙事塑造了极致低价心智,公告后开发者社区出现「梁圣降级为牢梁」的戏谑;若涨幅超一倍,科研类中低频用户存在流失可能。 中国企业家 补贴依赖风险: 8 万亿中 62.5% 来自免费试用额度,属于「补贴换心智」;提价后免费政策与订阅转化(OpenCode Go 订阅 +30%)能否接住,需要数据验证。 CSDN 分析 竞争轮换风险: 小米 MiMo-V2.5 曾以 10.5 万亿登顶后一周回落 52%;OpenAI 降价 80% 后 Luna 周调用仍暴增 738%。头部流量轮换加快,单次版本红利难守。 界面新闻 口径与登记差异: 8 万亿为单渠道单日数据,不能外推全球总盘;注册资本存在 1500 万(天眼查,核准 4/27)与 1644.75 万(企查查,7 月报道)两套口径,阅读时需按来源区分。 CSDN 分析 、 新浪财经 治理与传闻项: 第二轮融资、年内提交 IPO 申请均系市场传闻;控制权依赖持股平台设计,若梁文锋让渡或退出持股平台,控制结构需重新核验。 新浪财经 下一步验证什么 涨价公告的具体幅度与生效时间——对照「温和(≤2 倍)/转正(3 倍)/触底(4 倍)」三档剧本判断落点。 涨价后 OpenRouter 周榜与 OpenCode 付费占比变化——验证「价格翻倍、Token 消耗不降」的弹性判断是否成立。 容量问题是否随涨价与扩容缓解,以及 8 月 4 日式故障是否重演。 第二轮融资与 IPO 传闻是否有公司层面的正式确认。 免费试用额度政策是否同步收紧,OpenCode Go 订阅转化能否补上免费流量缺口。 来源 搜狐财经|DeepSeek 的「斩杀线」,正在重塑 AI 行业的世界观(极客公园) 界面新闻|超 7 万亿!DeepSeek V4 Flash 单周调用量登顶全球第一(2026-08-05) 凤凰网财经《中国企业家》|梁文锋,告别「价格屠夫」(2026-08-07) 观点网|DeepSeek V4 Flash 单日处理达 8 万亿 Token 周调用量居首(2026-08-03) CSDN|DeepSeek V4 Flash 单日吞下 8 万亿 Token:一次调用量的「压力测试」(2026-08-04) 市场资讯|DeepSeek V4 Flash API 因前所未有访问量出现容量不足,现已修复(2026-08-04) 新浪财经|DeepSeek 首轮融资落地,梁文锋登顶全球大模型首富(2026-07-24) 天眼查|杭州深度求索人工智能基础技术研究有限公司(工商信息、股东、控制链、融资历史、招投标) 本文为新闻扩展分析:事实部分以已核验来源为准,「斩杀线」等评价性表述均来自公开报道原文;市场测算与融资传闻已逐条标注来源与性质,不构成投资建议。