杭州深度求索人工智能基础技术研究:8.83万亿Token登顶全球第一,流量最高点为何宣布API涨价? 8月10日,OpenRouter发布最新周度数据:8月3日至9日,中国大模型周调用量达34.25万亿Token,连续第15周超过美国;其中杭州深度求索人工智能基础技术研究有限公司(下称“深度求索”)旗下DeepSeek-V4-Flash正式版以8.83万亿Token的单周调用量登顶全球第一,环比暴增570%。就在榜单公布前四天(8月6日),这家公司刚刚宣布将“大幅上调”API服务定价。全球调用量最高的模型正在涨价——这波流量能换回多少真金白银,成为国产大模型商业化当下最值得盯的验证点。当日港股互联网板块同步走强,中证港股通互联网指数收涨1.7%、恒生科技指数涨1.3%( 搜狐财经 )。 先看数字:这一周发生了什么 69万亿Token 全球周调用总量,环比+21.48% 34.25万亿Token 中国合计,环比+21.76%,占全球约49.6% 9.17万亿Token 美国合计,环比+109.36% 8.83万亿Token DeepSeek-V4-Flash正式版,环比+570%,全球第一 63.5% 近28天中国模型占比(美国35.5%) 排名 模型 周调用量 环比 1 DeepSeek-V4-Flash正式版 8.83万亿Token +570% 2 腾讯 Hy3 8.05万亿Token +67% 3 DeepSeek-V4-Flash预览版 5.88万亿Token -19% 4 小米 MiMo-V2.5 5.39万亿Token -14% 5 OpenAI GPT-5.6 Luna — — 全球前四名全为中国模型。深度求索两款模型合计14.71万亿Token,占中国总量的约43%——“榜单主力”的位置非常明确。更早的月度结构也在变化:6月美国模型在OpenRouter的Token请求占比已从一年前的72%降至33%( 观察者网 、 CNMO科技 、 观点网 )。 为什么是现在:一场高度密集的产品与定价节奏 深度求索的登顶并非自然累积,而是产品迭代、计费调整与涨价动作在八周内连环落地: 4月24日 V4系列预览版发布(V4-Pro与V4-Flash预览)。V4-Pro总参数1.6万亿、激活仅490亿,低激活MoE架构把长上下文推理成本压到行业低位。 7月 上线峰谷计费:工作日9:00–12:00、14:00–18:00高峰时段API价格翻倍。 7月31日 V4-Flash正式版API上线公测:总参数284B(激活13B)、支持100万Token上下文,Agent能力大幅增强(Terminal Bench 2.1得82.7分、Cybergym 76.7分),原生支持OpenAI的Responses API格式并针对性适配Codex;自研Harness框架首次亮相( 澎湃新闻 、 上海证券报 、 智东西 、 凤凰网科技 )。 8月1日 海外开发者平台OpenCode披露:V4-Flash单日处理Token达8万亿,其中5万亿来自免费试用额度、3万亿为开发者付费调用。 8月6日 公告将大幅上调API服务定价,覆盖V4-Flash与V4-Pro,“具体方案以正式通知为准”( 今日头条 、 今日头条 )。 8月10日 OpenRouter周榜公布:V4-Flash正式版登顶,前四名全为中国模型。 用轻量模型打爆流量、在流量最高点启动提价——这一节奏本身就是商业化意图的声明。 流量能不能变成钱:三条可核验信号 信号一:付费结构在改善。 媒体口径下,深度求索年度经常性收入(ARR)已达4亿至5亿美元,V4模型API业务毛利率维持在70%至80%高位;2026年一季度API营收环比增长120%,用户覆盖150多个国家,海外调用占比67%。在OpenRouter平台,其Token份额半年内从9%翻倍至约18%(峰值口径18.7%,曾超过Anthropic居全球第二);2026年6月App月活跃用户接近1.3亿( 搜狐财经·商业化报告 、 今日头条 )。 信号二:海外企业开始真金白银切换。 美国AI初创公司Lindy今年6月宣布从Anthropic Claude全面切换至DeepSeek-V4,其CEO称推理成本下降约95%、每年节省数百万美元基础设施开支;Coinbase等美国企业开始直接付费采购(而非仅用开源权重本地部署),深度求索登顶Ramp平台企业软件趋势榜。美国B2B企业对深度求索的使用占比从年初约11%升至30%以上( 观察者网 、 搜狐财经 )。 信号三:定价权开始回收。 8月6日的涨价公告意味着“极致低价”策略转向。现行价格与行业对比: 模型 输入(缓存未命中) 输出 备注 DeepSeek-V4-Flash 1元/百万Token 2元/百万Token 缓存命中低至0.2元/百万Token DeepSeek-V4-Pro 3元/百万Token 6元/百万Token 此前已“永久下调75%”后的价格 中国模型平均(OpenRouter口径) 低至18美分/百万Token,较美国约4美元有约20倍价差 同等任务单次成本(第三方测算) V4-Pro约0.04美元 vs GPT-5.5约1.03美元、Claude Opus 4.8约1.80美元 分析人士认为中国开源模型定价较Anthropic、OpenAI领先模型低60%–90%——涨价之后,深度求索相对海外仍有价格纵深( 今日头条 、 观察者网 )。 公司底牌:轻主体、重产品、强资本 深度求索的公开主体是一张“轻”到极致的工商名片:2023年7月17日成立于杭州拱墅区,注册资本1500万元(7月14日增至1644.75万元)、实缴1000万元;法定代表人裴湉(董事、经理);2024年报口径参保20人;增值税一般纳税人(2023年8月起);2024年报的营收、利润、资产等科目均选择不公示( 天眼查·工商基础信息 、 天眼查·企业年报 、 天眼查·纳税资质 )。 维度 事实 股东结构 宁波程恩企业管理咨询合伙企业(有限合伙)持股66%(认缴990万元);梁文锋直接持股34%(认缴510万元,出资日期2026-04-24) 关联主体 工商档案显示与北京深度求索人工智能基础技术研究有限公司(2023-05-16成立,法定代表人同为裴湉)存在100%股权关联;2024年报对外投资列表含北京深度求索及宁波程采( 天眼查·控股链 、 天眼查·股东 ) 出资设立(2023年8月) 由幻方量化出资设立,当时口径估值约10亿美元( 天眼查·融资历史 ) 首轮融资(2026年6月落地) 天眼查口径:总额510亿元人民币、投后估值近4000亿元、本轮出让12.75%股权;投资方含梁文锋、腾讯投资、宁德时代、网易、京东集团、IDG资本、Monolith砺思资本、正心谷资本、拾象科技、国家人工智能产业投资基金 媒体交叉口径 本轮募资超500亿元人民币(约74亿美元)、投后估值超500亿美元(约3380亿元);梁文锋为最大出资方(约200亿元),腾讯出资约100亿元、宁德时代约50亿元、京东/网易/IDG资本各约30亿元( 澎湃新闻 ) 新一轮(7月中旬) 据知情人士,考虑再度融资以加速基础设施扩张,投前估值约710亿美元(约4800亿元),较上一轮提升约37%,两轮间隔不足六周( 乐居财经 ) 两个值得注意的结构细节:其一,首轮融资采用特殊架构——除国家人工智能产业投资基金直接投资主体并保留投票权外,其余外部资金投向梁文锋管理的有限合伙企业(杭州程砺,2026年5月20日成立、注册资本14.02亿元),并面临五年锁定期、不享有投票权( 乐居财经 );其二,腾讯既是A轮投资方(媒体口径出资约100亿元),其Hy3模型又以8.05万亿Token位列本周调用量第二——投资人与直接对手同台竞技。 生态与算力:流量之外的另一条护城河 开源是流量底座:深度求索全系列模型采用MIT协议,媒体口径全渠道月活超7亿,Hugging Face下载量居国产模型第一;开源社区贡献了78%的新增B端付费用户,开源转付费API转化率约27%,远高于行业平均3%–5%( 今日头条 )。 算力侧绑定国产供应链:V4全系基于自研跨硬件算子语言TileLang开发,实现昇腾Day0同步适配;千卡级国产集群已验证V4-Pro全参数后训练( 搜狐财经·商业化报告 )。“流量+涨价”带来的收入若能投向更低成本的国产算力,将形成成本再下降的循环——这也是新一轮融资投向基础设施的逻辑。 风险观察:流量成色、口径与竞争 流量成色存疑。 OpenCode平台8月1日处理的8万亿Token中,5万亿来自免费试用额度、付费仅3万亿——免费流量占比约62.5%。涨价后免费额度收缩,调用量能否维持,是第一块试金石。 榜单口径局限。 OpenRouter只统计经其网关转发的第三方开发者、海外用户与下游应用调用,不含各厂商自研App、官网、C端产品、内部系统与私有化部署。“全球第一”是平台口径,不等于全行业口径( 观察者网 )。 需求弹性未知。 涨价公告至今未公布新定价细则与生效时间;V4-Pro正式版预告8月初上线,目前仍未落地。 竞争与算力双挤压。 腾讯Hy3环比+67%紧咬第一;智谱GLM-5.2在Vercel上线一周日调用量增长约27倍、客户数增长约80倍;高盛研报提示国内模型需求旺盛而算力供给趋紧。“流量红利”窗口期长短,取决于迭代速度与算力供给( 观察者网 、 时代财经 )。 估值节奏快。 投前估值六周内从约520亿美元升至约710亿美元(+37%),商业化数据需要跟上资本预期。 下一步验证什么 涨价细则: 新定价、生效时间、对缓存命中与错峰调用的引导——公告称“以正式通知为准”。 需求弹性: 涨价后周调用量与付费占比变化,是“流量能否变钱”的第一组真实数据。 V4-Pro正式版: 发布时间与定价,决定旗舰层的商业化空间。 财务兑现: 媒体口径的ARR(4亿–5亿美元)与API毛利率(70%–80%)能否随涨价改善。 海外付费持续性: Lindy、Coinbase等案例能否扩大,验证中国模型在海外企业侧的生态粘性。 来源 搜狐财经|国产大模型周调用量稳居全球首位 观察者网|连续15周霸榜!中国AI大模型调用量缘何跑赢美国? CNMO科技(搜狐转载)|中国AI调用量连续15周全球领跑 观点网|DeepSeek-V4-Flash正式版周调用量8.83万亿Token 澎湃新闻|DeepSeek V4正式版来了! 上海证券报·中国证券网|DeepSeek-V4-Flash正式版来了! 智东西(腾讯新闻)|DeepSeek-V4-Flash正式版上线 凤凰网科技(腾讯新闻)|性价比之王要打Agent仗了 搜狐财经|大模型商业化系列报告:DeepSeek 今日头条|DeepSeek宣布大幅上调API服务定价 今日头条|DeepSeek宣布上调API定价,告别极致低价 今日头条|DeepSeek成本为OpenAI的1/25,如何实现商业闭环 时代财经(新浪财经转载)|中国大模型周调用量全球登顶 乐居财经(新浪财经)|DeepSeek首轮融资阵容曝光 天眼查|杭州深度求索人工智能基础技术研究有限公司|工商基础信息 天眼查|股东 天眼查|实际控制人/控股链 天眼查|融资历史 天眼查|企业年报 天眼查|纳税资质