杭州深度求索人工智能基础技术研究:V4 Flash 单日吞 8 万亿 Token、登顶 OpenRouter 周榜,六成靠免费——低价换量的账怎么算? 2026-08-03 | 基于证券时报报道与公开信息整理 | 主公司:杭州深度求索人工智能基础技术研究(DeepSeek) 北京时间 8 月 3 日,海外 AI 编程工具 OpenCode 披露:其平台上 DeepSeek(杭州深度求索人工智能基础技术研究有限公司)V4 Flash 正式版的单日调用量冲上 8 万亿 Token,其中 5 万亿来自免费试用额度、3 万亿为开发者付费调用。同一周,模型 API 聚合平台 OpenRouter 数据显示,V4 Flash 以 7.22 万亿 Token 的周调用量居全球所有模型第一,环比增长 13%。这一成绩,距离 V4 Flash 正式版 7 月 31 日晚间上线公测,只有约三天。 为什么是现在:就在 V4 Flash 公测的同一天,OpenAI 宣布 GPT-5.6 Luna 降价 80%。一场围绕"低价换量"的攻防进入新阶段——深度求索用免费额度加超低单价把开发者流量拉到全球第一,但 8 万亿里六成是免费,这波增长能转成多少付费收入,才是资本市场真正盯着的数字。 先看数字:两个平台、两种口径 8 万亿 OpenCode 平台单日调用量 5 万亿免费试用 + 3 万亿付费 7.22 万亿 OpenRouter 上周调用量 全球第一,环比 +13% 62.5% 单日调用中免费占比 付费转化是下阶段关键 +30% OpenCode 使用量与订阅增幅 上线首日,CEO Jay 披露 连续 14 周 中国大模型周调用超美国 上周中国 28.13T、美国 4.38T 50 vs 51 Artificial Analysis 智能指数 V4 Flash vs GPT-5.6 Luna 口径提示:8 万亿与 7.22 万亿分属两个平台——OpenCode 是聚焦代码场景的终端编程工具及 Zen、OpenCode Go 网关,OpenRouter 是全场景 API 聚合网关,两者不可直接相加;但方向一致:代码场景的开发者正把 V4 Flash 当作默认编程助手。OpenCode CEO Jay(贾亚库马尔)8 月 1 日称,V4 Flash 上线后平台单日使用量增长 30%、OpenCode Go 新订阅用户增长 30%。截至发稿,深度求索官方未对上述第三方数据公开确认。 全球调用榜:前五名全是国产模型 OpenRouter 上周排名(7.27–8.2) 周调用量 环比 1. DeepSeek-V4-Flash 7.22 万亿 Token +13% 2. 小米 MiMo-V2.5 6.30 万亿 Token -40% 3. 腾讯 Hy3 4.82 万亿 Token +22% 4. DeepSeek-V4-Pro 3.28 万亿 Token +3% 5. 智谱 GLM-5.2 2.89 万亿 Token -12% 更早一周, 央视财经 口径中,小米 MiMo-V2.5 曾以 10.5 万亿 Token 登顶、腾讯混元 3 环比增幅超 999%;本周小米降至 6.3 万亿、环比 -40%,与 10.5 万亿基数自洽(10.5 × 0.6 = 6.3),两个口径应属相邻两周——V4 Flash 的上位,部分来自对上一周榜首的直接替代。总量层面, 财闻测算 上周全球总调用 56.8 万亿 Token(环比 -2.07%),中国 28.13 万亿(环比 -14.76%)、美国 4.38 万亿(环比 +87.18%):总量微降、内部剧烈洗牌,美国在低基数上反弹。 关键疑问:62.5% 的免费额度,付费在哪 8 万亿里 5 万亿免费,占比 62.5%;付费部分 3 万亿仅占 37.5%。免费试用额度是获客工具——把开发者拉进来,再靠"干活质量 + 价格"转付费。问题在于:免费额度能否转化为留存?补贴刺激消退后,调用量是否回落?这是判断"8 万亿"是真实需求还是流量幻觉的核心。 定价端把转化门槛压得很低:V4 Flash 输入缓存命中仅 0.2 元/百万 Token(未命中 1 元、输出 2 元),约 98% 的缓存命中折扣(业内普遍约 90%),命中 Token 只按标价 2% 计费。 第一财经 口径下,即便 OpenAI 已将 Luna 降价 80%,V4 Flash 自有 API 的单任务成本仍比 Luna 低约 60%(换算即 Luna 约为其 2.5 倍); TechWeb 则测算其输出单价约为 Claude Opus 4.8 的 1/90(0.28 美元 vs 25 美元)。 换算之后:高调用量不等于高收入。98% 缓存折扣把单 Token 收入压到极薄,利润依赖"缓存命中率高 + 推理算力成本低"的工程能力——这正是 4000 亿元估值叙事的核心支撑,也是免费转付费压力的直接来源。 价格对照:DeepSeek vs OpenAI,降价也追不上 DeepSeek V4 Flash(7.31 公测) 定价:缓存命中输入 0.2 元/百万 Token、未命中 1 元、输出 2 元(约 0.0028 / 0.14 / 0.28 美元) 缓存折扣:约 98%,远超业内普遍的 90% 单任务成本:比降价后的 Luna 仍低约 60% 智能指数:50 分(可比模型组中位数 17 分) 原生支持 Responses API,针对性适配 Codex OpenAI GPT-5.6 Luna(7.31 降价 80%) 定价:输入 1 → 0.2 美元/百万 Token,输出 6 → 1.2 美元/百万 Token;Terra 同步降 20% 距两款模型正式推出仅约三周即大幅降价 单任务成本约为 V4 Flash 的 2.5 倍(媒体口径换算) 智能指数:51 分,仅高出 1 分 OpenAI 产品负责人 Tibo 在 OpenCode 评论区推销,开发者回:"我们希望得到 DeepSeek 的价格。" 时间线:从 510 亿融资到 8 万亿调用 2026-06-14/15 天眼查 口径:A 轮落地,募资约 510 亿元、投后估值约 4000 亿元,梁文锋领投,腾讯、宁德时代、网易、京东、IDG 资本、国家人工智能产业投资基金等参投,创国内 AI 单轮融资纪录;梁文锋疑似实际控制比例 84.29%。 2026-07-15/16 The Information(腾讯新闻编译) 报道:年化收入 4 亿–5 亿美元、毛利率 50% 以上,正筹备第二轮约 500 亿元融资与科创板 IPO(目标最早 2027 年挂牌);Bloomberg 口径第二轮至少募 100 亿元、投前估值至少 4800 亿元。均为媒体信息,公司未确认。 2026-07-31 OpenAI 宣布 Luna 降价 80%、Terra 降 20%;当晚,DeepSeek V4 Flash 正式版 API 公测——MoE 架构、总参数 284B(激活 13B)、100 万 Token 上下文、思考/非思考双模式,结构与预览版一致,仅重做后训练。 2026-08-01 OpenCode CEO:单日使用量 +30%、新订阅 +30%。 2026-08-02/03 OpenRouter 周榜 V4 Flash 登顶(7.22T,+13%);OpenCode 单日 8T 数据公开。 公司底牌:低价换量的能力从哪来 主体层面,杭州深度求索人工智能基础技术研究有限公司 2023 年 7 月 17 日成立于杭州拱墅区,注册资本 1500 万元、实缴 1000 万元、参保 20 人,法定代表人裴湉;股东为宁波程恩企业管理咨询合伙企业(66%)与梁文锋(34%),杭州主体 100% 控股北京深度求索人工智能基础技术研究有限公司( 天眼查 )。创始人梁文锋(幻方量化创始人)走的是"开源 + 低价 API"路线,把后训练优化与推理成本控制做成护城河:V4 Flash 参数规模没变、仅后训练重做,Agent 基准 DeepSWE 从 7.3 分跳到 54.4 分(约 6 倍),Terminal Bench 2.1 达 82.7 分(逼近 Opus 4.8 的 85 分),长上下文单 Token 推理计算量降至 V3.2 的 27%。 风险观察 免费依赖 62.5% 免费占比意味着增长由补贴与免费额度驱动;OpenRouter 口径中国模型总调用环比 -14.76%、美国 +87.18%,总量见顶、结构分化,免费转付费比例是直接检验指标。 毛利与价格战 单价约为 Claude 的 1/90、98% 缓存折扣,单 Token 收入极薄;媒体口径 API 毛利率 50%–70% 不覆盖整体经营;OpenAI 已把 Luna 砍掉 80%,若对手跟进缓存折扣或二次降价,利润空间进一步压缩。 产品短板 V4 Flash 目前仅 API 公测,网页端/App 未同步更新;指令遵循不稳、Agent 推理语言锁定英文、嵌入式开发仍有瑕疵(开发者实测反馈),直接限制 C 端与部分 B 端场景转化。 算力与资本开支 第二轮融资主要投向自有数据中心、芯片采购与核心研究团队翻倍(The Information 口径);8 万亿级调用若持续,推理算力成本将快速上升,与"低价"模式形成对冲。 竞争反扑 小米 MiMo-V2.5(上上周榜首)、腾讯混元 3(开源即环比 +999%)、智谱 GLM-5.2(港股 02513.HK,2025 年营收 7.24 亿元、+132%,开放平台 API 年经常性收入超 17 亿)都在抢同一批开发者;OpenAI 降价后美国模型周调用环比 +87.18%。 组织与合规 杭州主体参保仅 20 人、注册资本 1500 万,对外 100% 控股北京主体;规模扩张与首轮"5 年锁定期"激励安排存在磨合成本;算法备案、ICP、电信许可(浙B2-20250178)齐全,但出海与数据跨境仍需观察。 分析建议:下一步验证什么 本节为基于上述已核验证据的分析判断,非事实陈述。 免费 → 付费:关注 OpenCode 是否披露免费/付费比例变化;若补贴刺激消退后单日调用量明显回落,说明留存不足。 周榜蝉联:OpenRouter 下周榜单 V4 Flash 能否守第一,小米、腾讯是否反超;V4-Pro(本周第 4)与 Flash 的"高低搭配"能否持续分流。 OpenAI 动作:Luna 推出仅约三周即降价 80%,若开发者继续用脚投票,是否二次降价或推出更低价产品。 产品开放节奏:V4 Flash 网页/App 端上线时间,直接决定 C 端增量与留存场景。 资本动作:第二轮融资与科创板 IPO 的官方确认(当前均为媒体报道),以及年化收入、毛利率口径能否被公司验证。 来源 证券时报《DeepSeek模型单日吞下8万亿Token,OpenAI打折追赶》 第一财经(百度百家号转载)《DeepSeek模型单日吞下8万亿Token,OpenAI打折追赶》 CNMO 科技(UC 转载)《DeepSeek单日吞下8万亿Token OpenAI被迫降价追赶》 TechWeb《DeepSeek-V4-Flash正式API上线!Agent能力暴涨6倍,价格仅为Claude的1/90》 财闻(新浪财经)《56.8万亿Token!上周全球大模型调用出炉》 央视财经(汇通财经转载)《中国产品包揽全球大模型调用量前五》 观点(新浪财经)《OpenRouter周调用量前五均为中国模型》 腾讯新闻(编译 The Information)《DeepSeek年化营收逼近5亿美元,最早2027年上市》 网易新闻(PChome/The Information)《外媒称DeepSeek的年化收入4亿至5亿美元,毛利率超70%》 天眼查|杭州深度求索人工智能基础技术研究有限公司