事时观察 · 大模型商业化 | 2026-08-07 北京深度求索人工智能基础技术研究宣布API整体涨价,OpenAI反向放开免费:“价格屠夫”要收刀了? 8月6日,北京深度求索人工智能基础技术研究有限公司(DeepSeek)在开放平台挂出公告:计划近期整体上调API服务定价,“预计涨幅较大”,具体方案以正式通知为准。两天前,它的V4-Flash刚因“前所未有的访问量”触发API容量不足;一天后,OpenAI宣布免费用户与ChatGPT的文字聊天不再受限。两个方向,48小时内同时反转。 0.02元 V4-Flash缓存命中输入价(每百万Token,涨价前基准) 8万亿Token V4-Flash 8月1日单日处理量(OpenCode披露:5万亿免费+3万亿付费) 500亿元 第二轮拟募资额,投前估值约5000亿元,计划8月下旬签约 148倍 按年化收入5亿美元测算,740亿美元目标估值约为年化收入的148倍 50%+ The Information口径综合毛利率;旗舰V4毛利率达70%–80% 10亿 ChatGPT全球周活用户,OpenAI宣布免费放开的节点背景 这次涨价,卡在三个时间点上 公告只说了方向,没说数字:“计划近期整体上调DeepSeek API服务的定价,预计涨幅较大,请合理安排您的使用。具体方案以正式通知为准。” 中国网转载的公告全文 显示,这是继6月底引入峰谷计费后, 澎湃新闻梳理的DeepSeek第二轮明确涨价信号 。 调价卡在三个叠加节点上: 产品节点 ——V4-Flash正式版7月31日刚上线公测,V4-Pro正式版“尽快发布”,涨价常是新品发布前奏; 资本节点 ——第二轮融资计划8月下旬签约,拟募500亿元、投前估值约5000亿元; 竞争节点 ——OpenAI在同一周放开了免费文字聊天。涨价的每一分,都会被这三件事同时定价。 涨价前夜的价格表:低到“不像在做生意” 现行价格按“输入/输出Token”和“缓存是否命中”分别计费,2026年4月起执行“原定价四分之一”的新基准: 模型 输入·缓存命中 输入·缓存未命中 输出(每百万Token) V4-Flash(高并发/高性价比) 0.02元 1元 2元 V4-Pro(复杂推理/高性能) 0.025元 3元 6元 峰谷机制已落地:工作日9:00–12:00、14:00–18:00全部计费项翻倍,即V4-Flash输出最高4元、V4-Pro输出最高12元。本次公告是在峰谷之上再抬基础价—— 无论何时调用,成本都会显著上升 。价格数据见 中国网 与 澎湃新闻 。 两年降价史的“回撤”时间线 2024-04 价格打到地板 :API降至输入1元/输出2元/百万Token的行业低位,逼得各大厂商集体跟降,V4-Flash一度登顶OpenRouter周榜第一 2026-04 再降四分之一 :限时2.5折后,正式定价调整为原定价的四分之一(即现行基准) 2026-06底 首次转向 :邮件预告V4正式版引入峰谷定价,高峰时段翻倍 2026-07-14 融资传闻 :英国《金融时报》称第二轮融资洽谈启动,投前估值约710亿美元 2026-07-16 首轮估值坐实 :开润股份公告倒推,首轮投后估值约3510亿元(约520亿美元) 2026-07-31 V4-Flash公测 :正式版API上线,Agent基准分25.2,接近Claude Opus 4.8的25.7 2026-08-01 用量爆发 :OpenCode披露单日处理8万亿Token,其中3万亿为付费调用 2026-08-04 容量告急 :API因“前所未有的访问量”容量不足 2026-08-05 融资重启 :第二轮拟募500亿元、投前约5000亿元,8月下旬签约 2026-08-06 涨价 公告整体上调API定价 ,涨幅未定 2026-08-07 放开 OpenAI取消免费文字聊天限制 ,默认模型升级GPT-5.6 Luna 时间线依据: 澎湃新闻 (调价轨迹)、 什么值得买 (用量与容量)、 UC号文章 (V4公测与Agent分数)、 都市快报 (FT融资报道)。 为什么是现在:用量、算力与补贴的三角 涨价的第一重理由是 用量压垮了便宜 。V4-Flash公测一周内,8月1日单日处理量达8万亿Token(5万亿免费额度、3万亿付费调用),8月4日API直接容量不足—— “用亏损换规模”的账,量一大就平不了了 。行业侧,有自媒体援引数据称中国日均Token调用量两年从1000亿飙至140万亿(涨约1000倍),该数据未经官方确认,但方向与DeepSeek的容量告急一致。 第二重理由是 成本端在涨 :GPU、存储等硬件供给紧张、价格上升,算力集群建设与电力、折旧成本走高。工信部信息通信经济专家委员会委员盘和林对 澎湃新闻 判断,涨价主要源于成本上升,“是否持续上涨,要看后续AI算力成本”。 第三重理由是 行业已经从“拼便宜”转向“拼涨价资格” 。高盛7月18日《中国AI模型导航》报告明确判断:中国AI竞争正从“谁更便宜”转向“谁有资格涨价”,DeepSeek把百万Token打到0.18美元、把行业毛利压到地板之后,涨价不代表需求变弱,反而说明需求旺盛、算力紧张、行业回归理性定价。 高盛报告要点(媒体转载) 与 “斩杀线”复盘文章 都指向同一结论:低价补贴阶段正在结束。年内已有智谱AI三次提价(GLM Coding Plan涨幅30%起、GLM-5-Turbo API涨20%、GLM4涨10%),腾讯云、阿里云、百度智能云也同步上调AI算力服务价格——DeepSeek不是孤例,而是最后一个松口的大牌。 涨价的底气:API已是真金白银的生意 DeepSeek敢在涨价前放出融资信号,底账并不难看。据The Information援引知情人士( 虎嗅/芯智讯转述 ):DeepSeek年化收入已达4亿至5亿美元(约27亿至34亿元人民币),主要来自云端API调用;综合毛利率超过50%,旗舰V4毛利率高达70%–80%—— 在API价格比Anthropic、OpenAI同级模型更便宜的前提下维持高毛利 ,靠的是推理侧优化:稀疏激活架构推理仅启用3%–5%总参数,KV Cache占用压缩至同行7%–10%。这正是高盛报告点名的“成本优势”护城河( 高盛深度报告要点 )。 但这笔账同时有另一面:DeepSeek靠低价长出的生态,本身就是涨价的软肋—— 分析文章测算 ,即使高峰翻倍后,V4-Flash仍比Claude便宜约50倍;但涨价对缓存命中率低、实时调用多的中小团队冲击最大,平价AI小工具可能迎来洗牌。 融资节奏:500亿首轮刚交割,500亿第二轮就来 节点 金额与估值 口径说明 首轮(2026年4月启动、6月交割) 募资500亿元;投后估值超3500亿元 快科技/新浪财经 ;The Information口径为估值突破500亿美元(约3379亿元) 首轮锚点(2026-07-16) 约3510亿元(约520亿美元) 开润股份公告倒推:宁波浦润出资4000万元认购砺思星灵,穿透持股0.0114% 第二轮(7月中旬启动、7月底暂停、8月重启) 拟募500亿元;投前估值约5000亿元(约740亿美元) 快科技 / 搜狐 ;7月14日FT口径为投前约710亿美元,一个月内估值上浮约37%–40% 首轮投资方名单( 快科技 、 都市快报 ):梁文锋出资约200亿元为最大单一出资方,腾讯约100亿元,宁德时代体系约50亿元,京东、网易、IDG资本各约30亿元,正心谷、拾象各约15亿元,国家人工智能产业投资基金约9.8亿元。融资通过梁文锋控制的杭州程砺持股平台注入,标的为关联主体杭州深度求索——北京深度求索由杭州深度求索100%持股( 天眼查股东信息 ),估值与融资属于同一品牌体系层面。 第二轮的关键变量在两点:一是 7月底曾临时暂停 ,起因据称为投资人会议实录外泄引发管理层不满,重启后各方倾向低调推进;二是 引入境外美元资金 ,计划通过QFLP机制吸引中东资本,这与首轮“纯人民币、纯中国机构”的结构明显不同( 搜狐 )。若完成,DeepSeek累计融资将突破千亿元,成为国内融资体量最大的大模型创业公司。 估值风险提示: 按5亿美元年化收入测算,740亿美元目标估值约为年化收入的148倍,远高于OpenAI、Anthropic等同行( 虎嗅引The Information分析 )。涨价若能落地为收入与毛利率的兑现,是支撑这一倍数最直接的证据;反之,若涨价引发开发者流失,估值叙事将同时承压。 DeepSeek vs OpenAI:一个涨价,一个放开免费 维度 DeepSeek(北京深度求索) OpenAI 本周动作 8月6日宣布API整体涨价,涨幅未定 8月7日宣布免费文字聊天不限次 面向对象 B端开发者、API调用方 C端用户为主(免费+Plus/Pro) 模型节奏 V4-Flash公测中,V4-Pro待发布 免费/Go默认GPT-5.6 Luna,Plus/Pro用GPT-5.6 Sol+思考滑块 规模底盘 OpenCode单日8万亿Token;年化收入4–5亿美元 周活破10亿;3月完成1220亿美元融资、投后估值8520亿美元 商业逻辑 成本回归、盈利优先,涨价支撑融资与估值 免费拉新、用规模换生态(文件/图像/语音/绘图仍保留配额) OpenAI的动作细节( 今日头条 、 财联社/头条 、 搜狐 ):免费用户及每月8美元Go套餐用户新增“思考”按钮,官方称GPT-5.6 Luna对比GPT-5.5-Instant事实错误率降低62%,Sol降68%;核心功能下周全面开放。值得注意的是,OpenAI保留了对文件处理、图像分析、语音、绘图等重算力功能的配额—— 放开的是轻量文字,锁住的仍是算力 ,与DeepSeek对API“按成本定价”的逻辑殊途同归。 谁受影响,下一步验证什么 受影响最大: 中小团队与个人开发者。缓存命中率低、实时调用多,涨价后月度开销抬升;平价AI小工具或洗牌。 开发者应对方向 :错峰调用(00:30–08:30、周末)、提升缓存命中率(命中价与未命中价差50倍)、控制预充值、评估文心一言/Kimi/通义千问替代方案。 影响有限: 中大型企业,更在意稳定性与服务,可通过批处理对冲。 待验证①: 正式调价方案——幅度、生效时间、峰谷机制是否延续。公告称“以正式通知为准”,目前无任何数字。 待验证②: 8月下旬第二轮融资签约是否落地,500亿元、投前5000亿元、QFLP美元资金是否兑现。 待验证③: V4-Pro正式版发布节奏与定价—— 分析认为 涨价是新品发布前奏,V4-Pro的毛利率(70%–80%)是高价的基础。 待验证④: OpenAI免费放开后的付费转化,以及是否反向压制API价格——此前媒体报道DeepSeek曾“逼OpenAI降价80%”(自媒体口径,未经官方确认)。 公司底牌与证据边界 北京深度求索人工智能基础技术研究有限公司成立于2023年5月16日,注册资本与实缴均为1000万元,法定代表人裴湉(执行董事、经理)、监事王苗军,参保人数67人,注册地为海淀区科学院南路2号C座5层N501( 天眼查工商信息 、 2025年报 )。公司由幻方量化2023年孵化,天眼查 疑似实际控制人 为梁文锋,综合持股比例约89.46%( 天眼查实控人路径 );大语言模型算法于2024年4月通过国家网信办备案,备案号110108970550101240011号( 百度百科 )。 证据边界: 本文公司风险结论基于业务与财务证据(用量、毛利、估值、融资节奏),不涉及司法负面推断。本次已核验的公司档案可见范围内,风险模块记录集中于股东、投资人、注册资本、注册地址等常规工商变更( 天眼查 );未在已核验材料中找到指向北京公司的行政处罚、经营异常或重大诉讼结果的可引用证据——这不构成“不存在”的否定结论,完整负面记录核查超出本次范围。彭博亿万富翁指数(7月15日)显示梁文锋净资产约360亿美元(约2440亿元),年初至今增长约199亿美元、增幅超120%( 上海证券报/搜狐 ),其财富与DeepSeek估值高度绑定,也是本轮涨价叙事绕不开的背景。 事件与价格 · 中国网:DeepSeek API即将大幅涨价 · 澎湃新闻:DeepSeek宣布将上调定价 · 什么值得买:价格屠夫要提价了 · UC号:开发者注意,DeepSeek API即将全线提价 · 今日头条:世界最便宜的大模型也要涨价了 融资与财务 · 快科技/新浪财经:DeepSeek重启第二轮融资 · 搜狐:DeepSeek重启第二轮融资细节 · 虎嗅/芯智讯:首轮融资完成,估值3510亿 · 都市快报:一个月飙升37%,估值710亿美元 · 证券时报:DeepSeek启动首轮外部融资 · 上海证券报/搜狐:最新市场估值超3500亿元 行业与对手 · 高盛《中国AI模型导航》要点(媒体转载) · 高盛深度报告:谁是中国AI大模型长期赢家(媒体转载) · 今日头条:OpenAI移除ChatGPT文本聊天限制 · 财联社/头条:OpenAI开放免费用户畅聊 · 搜狐:GPT-5.6 Luna无限制免费使用 公司档案 · 天眼查:工商基础信息 | 股东 | 疑似实际控制人 | 2025年报 · 百度百科:北京深度求索