北京深度求索人工智能基础技术研究:OpenRouter 前五占两席,最便宜的先“转正”——V4-Pro 正式版 8 月见 7 月 20 日至 26 日当周,全球模型聚合平台 OpenRouter 的调用量榜单前五被中国企业包揽,北京深度求索人工智能基础技术研究有限公司(DeepSeek)占第二、第五两席。榜单的真正变量不在名次,而在节奏:最便宜的经济版 V4-Flash 先于旗舰“转正”,旗舰 V4-Pro 正式版要到 8 月初才来。调用量优势能否兑现为对海外闭源模型的性能压制,答案看 8 月。 36氪 先看数字:DeepSeek 两款合计 9.54 万亿 Token 当周榜单里,DeepSeek V4 Flash 以单周 6.37 万亿 Token 位列第二(环比 +18%),V4 Pro 以 3.17 万亿 Token 位列第五(环比 +17%),两款合计 9.54 万亿 Token,约占前五总和的 35%。登顶的是小米 MiMo-V2.5(10.46 万亿 Token,环比 +12%),第三名腾讯混元3 在 7 月 6 日开源后单周环比增幅超 999%。 界面新闻 6.37万亿 DeepSeek V4 Flash 单周调用量(第2名,+18%) 来源:界面新闻 3.17万亿 DeepSeek V4 Pro 单周调用量(第5名,+17%) 来源:界面新闻 约35% DeepSeek 两模型合计占前五总量(9.54/27.11 万亿) 按当周榜单数据测算 63.5% vs 35.5% 近28天中国 vs 美国模型在 OpenRouter 份额(截至7/26) 来源:参考消息 排名 模型 开发方 周调用量(Token) 环比 1 小米 MiMo-V2.5 小米 10.46 万亿 +12% 2 DeepSeek V4 Flash 北京深度求索 6.37 万亿 +18% 3 腾讯混元3(Hy3) 腾讯 3.94 万亿 超 +999% 4 智谱 GLM-5.2 智谱 3.17 万亿 — 5 DeepSeek V4 Pro 北京深度求索 3.17 万亿 +17% 这不是中国厂商“内循环”的结果:OpenRouter 面向全球数万独立开发者与中小企业,计价按模型提供方所属国家统计,与用户所在地无关。自 2026 年 4 月下旬起,中国模型在该平台的 Token 调用量已连续 13 周超过美国模型;7 月月榜前六名(小米、DeepSeek V4 Flash、腾讯、MiniMax、智谱、DeepSeek V4 Pro)全部为中国模型。 头条·榜单分析 头条·平台占比 “高低搭配”怎么打:Flash 吃流量,Pro 卡高端 V4 系列今年 4 月 24 日随预览版一次发布两个版本:Pro 是旗舰,定位重度专业场景——大型代码工程、百万页资料分析、多轮工具智能体,明确对标 GPT-5、Gemini、Claude 顶级闭源;Flash 是经济版,用更小的激活规模换更低延迟与成本。月榜上 Flash 以 23.58 万亿 Token 排第二,是 Pro 的数倍——流量大头在价格端,性能卡位在高端端,这正是 DeepSeek 高低搭配的结构。 参考消息 头条·月榜数据 V4-Pro(旗舰) V4-Flash(经济版) 定位 奥数竞赛、大型代码工程、百万页资料分析、多轮工具智能体 日常高频场景,低延迟、低成本 架构 MoE,总参数 1.6 万亿,激活 490 亿 MoE,总参数 2840 亿,激活 130 亿 上下文 100 万 token 100 万 token 对标 GPT-5、Gemini、Claude 顶级闭源 正式版干活能力已超自家 Pro 预览版、追平 GPT-5.5 同类标杆 API 输入价 约 1.74 美元/百万 token 1 元/百万 token(约 0.14 美元) 版本状态 正式版预告 8 月初上线 7 月 31 日正式版 API 公测 反常信号:经济版先“转正”,干活测试反超自家旗舰 2026-04-24 V4 系列预览版发布,Pro 旗舰与 Flash 经济版同场亮相;官方预告旧接口 7 月 24 日下线。 2026 年 6 月底 官方口径为“正式版 7 月中旬上线”。 2026-07-31 V4-Flash 正式版 API 上线公测:模型结构与预览版完全一致, 仅重做后训练 ;Terminal Bench 2.1 得分 82.7,超过自家 V4-Pro 预览版(Terminal Bench 2.0 得分 67.9),并追平当年标杆 GPT-5.5(82.7)。同一份发布日志末尾写着:V4-Pro 正式版将“尽快”发布。 头条·Flash 正式版解读 2026 年 8 月初(预告) 据智东西报道,V4-Pro 正式版预计 8 月初上线;官方目前只有“尽快”二字。 这个顺序值得琢磨:按常理旗舰先“转正”,这次偏偏反过来了。官方明确说 Flash 正式版“干活能力”大幅增强、在基准测试里远超自家 Pro 预览版——结构、尺寸一点没变,只是重新做了一遍后训练,Agent 相关能力却大幅提升。这说明两件事:一是后训练优化的空间比外界想象的大;二是旗舰 Pro 的兑现节奏存在拖延(6 月底说 7 月中旬,7 月 31 日只来了 Flash)。Pro 接口和 App、网页端目前都未动,普通用户手机里的 DeepSeek 用的仍是预览版。 头条·Flash 正式版解读 钱的逻辑:252 美元 vs 1.2 万美元,价格战已打到闭源家门口 调用量领先的底层是定价。按一个典型编程 Agent 每天消耗 5000 万 Token 输入、500 万 Token 输出测算,月度成本 GPT-5.6 Sol 约 1.2 万美元,而 DeepSeek V4 Flash 仅 252 美元,相差约 48 倍。 头条·成本测算 7 月 9 日 OpenAI 发布 GPT-5.6,首次对旗舰线采用三档分层定价(Sol/Terra/Luna),奥特曼公开承认降价是被 DeepSeek 等厂商倒逼,“OpenAI 很乐意降价 75%”;据分析口径,GPT-5.6 Sol 的输入定价仍约为 DeepSeek V4-Pro 的 55 倍、输出约 166 倍。同周,Anthropic 的 Claude Opus 4.7/4.8 首次全线跌出 OpenRouter Top10——榜单上仅剩的美国模型是英伟达免费版。 头条·榜单分析 但价格战依赖推理成本。瑞银估算中国头部大模型训练成本约为海外龙头的 1/10,API 平均定价约为海外可比模型的 10%-20%;MIT Sloan 2026 年 1 月的研究显示,开放模型(以中国开源模型为主)发布时的平均性能约为闭源模型的 89.6%,平均推理价格低 87%。第一财经引述分析师观点称,中美模型在硬核综合推理上仍有 15%-20% 差距,但正在收窄。 头条·成本与性能 头条·榜单分析 为什么是这家公司:模型声量全球前五,公司本体刚启动首次外部融资 工商信息显示,北京深度求索成立于 2023 年 5 月 16 日,注册资本与实缴资本均为 1000 万元,由杭州深度求索 100% 持股;天眼查将梁文锋标注为疑似实际控制人(多层穿透合计约 89.46%)。2025 年年报(2026 年 6 月 12 日公示)显示参保人数 67 人,财务数据全部选择不公示。 天眼查·工商基础信息 天眼查·疑似实际控制人 天眼查·2025年报 “模型声量与公司体量”之间存在明显错位:一边是 OpenRouter 前五占两席,一边是公司今年 4 月才启动成立以来的首次外部股权融资。据证券时报 4 月 18 日报道(公司尚未正式回应),DeepSeek 正以超 100 亿美元(约 681.8 亿元)估值募集不少于 3 亿美元,原因被归结为两大压力:研发成本激增、核心人才流失——多位核心研究员(罗福莉、郭达雅)被小米、字节跳动挖角。融资资金计划投向算力、V4 研发、稳定团队与商业化。同期国内通用大模型一季度融资额同比下滑 72%,资金向头部集中。 证券时报 这与榜单走势互为因果:调用量优势需要靠低价维持,低价需要极致的推理成本,而继续压低成本需要算力与人才——首轮融资和 V4 正式版,都是把流量优势变成可持续竞争壁垒的补给线。 风险观察:兑现节奏、榜单口径与性能天花板 兑现风险。 V4-Pro 正式版从 6 月底“7 月中旬”推到 7 月 31 日只发布 Flash,官方再称“尽快”;8 月初能否如期上线、上线后基准分数能否再上台阶,是当下最大变量。预告跳票本身已在开发者社区引发“姗姗来迟”的质疑。 头条·Flash 正式版解读 口径风险。 OpenRouter 是价格敏感型渠道——平台按开发者设定的价格上限、质量偏好与任务类型自动路由到“当前最便宜且可用”的模型。调用量反映的是性价比与生态,不直接等于性能天花板;Claude 跌出 Top10、榜单只剩英伟达免费版,更多体现价格弹性而非性能倒挂。 性能差距仍在。 硬核推理口径下中美差距约 15%-20%(第一财经引分析师),开放模型发布时平均性能约为闭源的 89.6%(MIT Sloan)。Flash 正式版追平的是“当年”标杆 GPT-5.5(82.7),而 2026 年 7 月的闭源最新旗舰是 GPT-5.6 与 Claude 新一代产品,坐标系的差异要分清。 资本与人才。 融资仍处洽谈阶段、公司未正式回应;核心研究员被小米、字节挖角的背景下,V4-Pro(1.6 万亿参数)的训练与推理都需要更大算力,现金流与团队稳定是硬约束。 商业化转化。 低价策略吃下流量,但毛利率取决于推理成本控制(瑞银口径中国模型可维持 20%-40% 毛利率);一旦算力成本上升或闭源厂商跟进降价,价格优势可能被压缩。 下一步验证什么 8 月初:V4-Pro 正式版是否如期上线。 验证其 Agentic Coding、Terminal Bench 等“干活”基准相对 Flash 正式版能否再上台阶——这是“性能压制”命题的核心证据。 8 月周榜/月榜。 Pro 正式版上线后,Flash 与 Pro 合计调用量能否守住前五两席;中国模型近 28 天份额能否维持 60% 以上。 融资是否官宣。 估值、募资额是否匹配“超 100 亿美元、不少于 3 亿美元”的报道口径,资金投向是否兑现算力承诺。 第三方基准差距。 Artificial Analysis 等独立榜单上,Pro 正式版与 GPT-5.6 Sol、Claude 新一代旗舰的推理差距是否从 15%-20% 收窄至个位数。 来源 36氪转载·中国产品包揽全球大模型调用量前五(原引自人民财讯) 界面新闻·周榜分项数据(DeepSeek 两款模型调用量及环比) 参考消息·7月前五名单与中国模型份额 63.5% 头条·月榜数据(MiMo-V2.5 31.20T vs V4 Flash 23.58T) 头条·GPT-5.6 三档定价与编程 Agent 月度成本测算 头条·中国模型平台占比 66.5% 与训练/推理成本口径 头条·中美周调用量对比与 DeepSeek API 定价 头条·V4-Flash 正式版上线与 Terminal Bench 数据 证券时报·DeepSeek 启动首轮外部融资(估值超 100 亿美元、募资不少于 3 亿美元) 天眼查·工商基础信息 天眼查·疑似实际控制人 天眼查·2025 年企业年报 天眼查·企业天眼风险(投资人变更)