北京深度求索人工智能基础技术研究:OpenAI、Anthropic 两周内相继降价,「卖效率」路线被硅谷验证,3500 亿估值靠什么撑住? 2026 年 7 月的最后两周,全球大模型定价体系被连续改写:7 月 25 日 Anthropic 发布 Claude Opus 5,统一定价 2.5 美元/百万 Token,性能逼近自家旗舰 Fable 5;7 月 31 日 OpenAI 把入门款 Luna 砍价 80%、主力 Terra 降 20%,旗舰 Sol 维持原价、只新增一个「Fast 模式」 头条号 今日头条 。两家的共同动作是:旗舰负责证明技术上限,走量交给中低端。 这条路, 北京深度求索人工智能基础技术研究(DeepSeek) 比硅谷早走了一年多——5 月 22 日它刚把 V4-Pro 永久降至原价 1/4 大众网 。市场已用数据回应:OpenRouter 平台上,美国企业调用中国模型的 Token 占比从 2025 年上半年的 4.5% 冲到 2026 年 2–7 月的峰值 46% 百家号 。 一句话看懂 :先手——DeepSeek 用 V4-Pro 把价格打到原价 1/4,一个月内四次调价;验证——硅谷两周内相继降价跟进;悬念——约 3500 亿元估值、有流量没营收、第二轮融资与 2027 年 IPO 传闻,护城河到底在哪。 事实脉络:从「R1 一战封神」到「硅谷抄作业」 2025-01 DeepSeek R1 发布:用美国头部模型约 5% 的训练成本达到约 95% 的性能,为中国大模型定下「效率至上」基调 头条号 。 2026-04-24 DeepSeek-V4 发布并开源,华为云首发适配;V4-Pro 与 V4-Flash 同时上线,支持百万级 Token 超长上下文 大众网 。 2026-04-25 至 04-28 调价组合拳:V4-Pro 开启 2.5 折限时优惠(原定 5 月 5 日截止);4 月 26 日全系输入缓存命中价降至首发价 1/10;4 月 28 日优惠延长至 5 月 31 日——一个月内第四次调价 大众网 。 2026-05-22 V4-Pro 官宣永久降价:输入(缓存命中)0.025 元、输入(缓存未命中)3 元、输出 6 元(每百万 Token),官方称创全球大模型价格新低、不设时限 大众网 。 2026-07-10 OpenAI 发布 GPT-5.6 系列:旗舰 Sol(5/30 美元)、均衡 Terra(2.5/15 美元)、入门 Luna(1/6 美元) ITBear 。 2026-07-16 奥特曼放话:Sol 定价已是 Claude Fable 5 的一半,OpenAI「很乐意降价 75%」——被解读为对中国低价模型与 Anthropic 企业扩张的直接回应 ITBear 。 2026-07-25 Anthropic 发布 Claude Opus 5,统一 2.5 美元/百万 Token,多项基准逼近甚至反超旗舰 Fable 5——高端市场「半价卖旗舰级能力」 今日头条 。 2026-07-31 OpenAI 跟进:Luna 降 80%(0.2/1.2 美元)、Terra 降 20%,Sol 维持原价但新增 Fast 模式(2 倍价格、最高 2.5 倍速度);同日披露降本来自 Sol 自主优化——重写 GPU 内核使服务成本降 20%、推测解码使 Token 生成效率提升超 15% 头条号 。 2026-08-03 钛媒体发文《OpenAI 不靠最贵的模型卖钱了》:旗舰证明上限、中低端走量,AI 厂商开始卖效率不卖智能 钛媒体 。 价格对照:降了 80%,还是打不赢 252 美元的月账单 把同一负载放在同一把尺子上量,差距更直观。以编程 Agent 每月消耗 5000 万输入 Token + 500 万输出 Token 计算:用 GPT-5.6 Sol 月成本约 1.2 万美元,用 DeepSeek V4 Flash(非高峰时段)仅约 252 美元,相差近 48 倍;即便 Luna 降价 80%,月账单约 480 美元,仍高于 V4 Flash 的约 252 美元 今日头条 。 模型 输入价(每百万 Token) 输出价(每百万 Token) 备注 DeepSeek V4-Pro 缓存命中 0.025 元 / 缓存未命中 3 元 6 元 2026-05-31 起永久生效;杰富瑞口径输出约 0.87 美元 DeepSeek V4-Flash 约 0.18 美元(折算口径) — 编程 Agent 月成本约 252 美元(非高峰) GPT-5.6 Luna(降价后) 0.2 美元 1.2 美元 降幅 80%,7 月 31 日生效 GPT-5.6 Sol 5 美元 30 美元 旗舰维持原价,新增 Fast 模式 Claude Opus 5 2.5 美元(统一价) 2.5 美元 性能接近旗舰 Fable 5 价格口径说明:DeepSeek 官方人民币价格来自公开调价公告 大众网 ;美元口径(0.87 美元、0.18 美元)来自杰富瑞统计与第三方平台折算 ITBear 百家号 ,不同来源口径存在差异,并列呈现。 「用脚投票」的数据:调用量如何转移 4.5% → 46% 美国企业经 OpenRouter 调用中国模型的 Token 占比:2025 上半年均值 → 2026 年 2–7 月峰值(2025 年 7 月前 12 个月均值仅 11%) 66.5% 7 月 20–26 日当周中国模型占 OpenRouter 全平台 Token 量(约 38.6 万亿),连续 13 周超过美国模型 <1% → 17% DeepSeek 在 Vercel AI Gateway 的 Token 份额:2026 年 5 月单月跃迁,成为平台第三大来源 34% → 65% OpenRouter 开源模型 Token 占比(花旗口径,2026 年 1 月 → 6 月) 数据来源: 今日头条(OpenRouter/九派统计) 百家号(Vercel/花旗) 。个案参照:AI 初创公司 Lindy 在 2026 年 6 月将 100% 流量从 Anthropic Claude 切换至 DeepSeek,其 CEO 称「性能和过去没有差别,数月就能节省数百万美元」;国产开源大模型在 Hugging Face 下载量占全球 41%,Top 10 开源模型 8 款来自中国,近 200 家硅谷初创企业联名致信白宫反对封禁中国模型 百家号 头条号 。 主角的基本面:从「拒绝资本」到 3500 亿估值 这家公司 2023 年 5 月 16 日成立于北京海淀,注册资本 1000 万元,法定代表人裴湉;北京主体由杭州深度求索人工智能基础技术研究有限公司 100% 持股,天眼查将梁文锋标注为疑似实际控制人(综合受益比例约 89.46%);2025 年报参保 67 人(2024 年报为 37 人),年报财务数据均选择不公示 天眼查 天眼查·实控人 。 2026 年,这家曾长期「自我供血」、多次婉拒外部投资的公司在两个月内完成转身:4 月 17 日外媒报道其启动首轮外部股权融资(估值超 100 亿美元、募资不少于 3 亿美元),融资动因被归结为研发成本激增与核心人才流失(罗福莉、郭达雅被小米、字节跳动等挖角) 证券时报网 ;7 月融资落地,消息口径规模约 510 亿元,投后估值约 3500 亿元——开润股份公告穿透计算为约 3509 亿元 雷递网 开机实验室 。 交易后股权结构(杭州主体):宁波程恩 60.19%、梁文锋 31.01%、杭州程砺 8.52%、国家人工智能产业投资基金 0.28%;新设持股平台杭州程砺背后是腾讯(33.44%)、宁德时代(11.71%)、网易(10.03%)、京东(10.03%)及 IDG 等机构——机构不直接投 DeepSeek 主体,是为保证梁文锋的绝对控制权 雷递网 开机实验室 。7 月 16 日彭博亿万富翁指数显示,梁文锋以 360 亿美元净资产成为全球纯 AI 大模型创业者中身家最高者,超过王传福、雷军 开机实验室 。市场消息称第二轮融资磋商已启动(交易前估值目标约 710 亿美元),并酝酿 2027 年上市 雷递网 。 定价逻辑:为什么敢卖这么便宜 梁文锋在 5 月一场 3 小时 44 分钟的投资人闭门会上给出的答案:C 端流量、B 端收入都是「芝麻」,AGI 才是「西瓜」;API 定价按设备折旧算——买一批服务器 10 个月收回设备成本、对应约 6 倍利润率「就够了」,且最强模型也会开源,「不会搞开源低配、自用高配」;他判断 DeepSeek 落后美国 12–18 个月,但用约二十分之一的算力达到当前能力,当前约两万张 H 等效算力,华为 950 的产能是唯一瓶颈 头条号 。融资后员工拿到期权,此前被点名的人才流失风险得到部分缓解;「最坏情况卖 API,也够支撑一个上市公司」是他给投资人的底线承诺。 风险观察:便宜路线也有三块硬骨头 商业化剪刀差 ——调用量暴涨与营收不匹配。「有流量却没拿到对应营收」被多家报道点名 百家号 ;C 端不发力、B 端「不追」,收入结构在融资时几乎不存在,投资人需要为 AGI 长周期买单。 巨头反扑有技术支撑 ——OpenAI 披露的 Sol 自优化(成本降 20%、Token 效率提升 15%)意味着降价不是一次性促销,而是可持续的成本曲线 头条号 ;前沿性能上 Sol、Fable 5 仍是综合智能指数的天花板,中国模型整体差距约 6–9 个月(布鲁金斯学会口径)。 地缘政治与生态反制 ——白宫科技政策办公室主任指责中国开源模型「窃取美国专有技术」,OpenAI 战略负责人被曝建议通过制造「恐慌」阻止企业使用中国模型;美国监管趋严是悬在调用量增长之上的变量 百家号 。 估值与组织匹配性 ——AGI 长周期与约 3500 亿元估值之间、商业化滞后可能被对手用收入反哺迭代反超、「无强组织」管理模式在扩张阶段的可持续性,均被投资人视角列为待验证项 头条号 。 关键疑问:下一个护城河是生态粘性吗? 当旗舰智能优势被算力开支抹平、价格两年跌近两个数量级(中国模型以美国同行边际成本十分之一甚至百分之一参与竞争,已获杰富瑞统计佐证 ITBear ),竞争焦点正从「谁最聪明」转向「每任务多少钱、ROI 多高」。对北京深度求索而言,可能的护城河由两条腿组成: 开源生态粘性 ——开发者把 DeepSeek 嵌进技术栈、模型权重可本地部署,切换成本高于换一家 API; 全栈自研效率 ——从 DSA 稀疏注意力到 TileLang 重写算子生态,把「算力劣势」转化为「成本优势」 头条号 。 但护城河的宽度需要三个验证点:① OpenAI、Anthropic 降价后,OpenRouter 上的调用量是否会回流美国模型——这直接检验「效率路线」是趋势还是窗口;② DeepSeek 第二轮融资与 2027 年 IPO 传闻能否兑现,约 6 倍利润的定价策略在上市公司口径下是否够用;③ 华为 950 产能能否支撑下一代模型——梁文锋称这是唯一瓶颈,也是「效率优势」能否复制的命门。 来源 钛媒体|OpenAI 不靠最贵的模型卖钱了(2026-08-03) 今日头条|OpenAI、Anthropic 大降价:中国模型在美调用占比飙至近半(2026-08-01) 头条号|OpenAI 宣布 Luna 降价 80%:竞品暂未跟进,靠模型自优化降本(2026-07-31) ITBear|OpenAI 面临中美双重竞争压力,奥特曼放话降价 75%(2026-07-17) 大众网(长安街知事)|DeepSeek 宣布:永久降价(2026-05-23) 雷递网|DeepSeek 完成首轮融资:估值超 3500 亿,梁文锋个人持股 31%(2026-07-19) 开机实验室|DeepSeek 首轮融资落地,梁文锋登顶全球大模型首富(2026-07-16) 百家号|从 4.5% 飙到 46%!DeepSeek 领衔中国模型为何让美国企业集体转向(2026-07-26) 头条号|成本仅美国 1/10,中国 AI 大模型凭什么拿下 63.5% 调用量(2026-07-28) 头条号|DeepSeek 估值 500 亿美元,创始人却说 C 端流量和 B 端收入都是芝麻(2026-07-23) 证券时报网|DeepSeek,大消息!启动首轮外部融资!(2026-04-18) 天眼查|北京深度求索人工智能基础技术研究有限公司|工商信息/年报/股权/纳税资质