AI 价格战 · 2026年8月2日 · 事时观察 北京深度求索人工智能基础技术研究:1元/百万Token引爆周末,视频生成价格战烧到0.8元/秒 7月31日下午,北京深度求索人工智能基础技术研究有限公司(DeepSeek)以一份 API 发布日志,低调放出 DeepSeek-V4-Flash 正式版公测(版本号 V4-Flash-0731):输入 1 元/百万 Token、输出 2 元/百万 Token,缓存命中低至 0.02 元。随后不到 48 小时,MiniMax 发布首款开源多模态模型 H3(2K 视频 0.8 元/秒),字节跳动发布 Seedance 2.5(单次生成 30 秒),OpenAI 同日宣布 GPT-5.6 Luna 降价 80%。国产 AI 从文本到视频全线进入价格战,AI 内容创作的成本门槛被系统性压低—— 网易财经 将其列为周末影响下周 A 股的关键信号之一。 周末三连发:谁在降价、降了多少 发布方 产品 时间 核心变化 价格 DeepSeek 北京深度求索 V4-Flash 正式版 API 7月31日下午 284B 总参数 MoE、激活 13B,结构不变,仅重做后训练;Agent 能力大幅提升;MIT 开源权重 输入 ¥1、输出 ¥2/百万 Token,缓存命中 ¥0.02 MiniMax 上海稀宇极智科技 H3 多模态生成模型 7月31日 首款开源多模态模型:文本/图片/音频/视频,2K 直出,最长 15 秒音画 2K 视频 0.8 元/秒,约同类旗舰三分之一 字节跳动 Seedance 2.5 7月31日 单次生成 30 秒视频、支持多轮延长;即梦 AI 与豆包专业版陆续上线,API 近期接入火山方舟 API 定价未公布 OpenAI GPT-5.6 Luna 同日 宣布降价 80%,被市场解读为对国产低价的回应 降价后单任务成本仍据测算比 V4-Flash 高约 60% V4-Flash 为什么炸:没动参数,动了“脑子” 这次升级最反直觉的一点是:模型结构、尺寸与预览版完全一致,官方只重做了后训练。据 AI Tool Lab 整理,DeepSWE 软件工程基准从预览版 7.3 分升至 54.4 分(提升约 7 倍);Terminal-Bench 2.1 终端操作得分 82.7,逼近 Claude Opus 4.8 的 85.0;Cybergym 网络安全基准 76.7,较预览版翻倍。在 TechWeb 报道中,Artificial Analysis 智能指数得 50 分(同类可比模型中位数仅 17 分),输出价约 0.28 美元/百万 Token,约为 Claude Opus 4.8 输出价(25 美元)的 1/90。 工程侧同样激进:原生支持 OpenAI 的 Responses API 格式并适配 Codex 工具链,开发者可直接迁移; 新浪科技 整理的用户实测显示,有开发者 4 小时消耗约 1 亿 Token、缓存命中率 99%,也有开发者在 Kimi K3 上花 200 多元的任务在 V4-Flash 上只花 3.67 元。代价是明确的:目前仅 API 公测,App 与网页端仍是旧模型;备受期待的 V4-Pro 正式版“尽快发布”,时间表未定且不开源。 这家公司:1000万注册资本,67人参保,梁文锋间接持股约89% 北京深度求索人工智能基础技术研究有限公司成立于 2023 年 5 月 16 日,注册资本 1000 万元、实缴 1000 万元,由杭州深度求索人工智能基础技术研究有限公司 100% 持股(法人独资),法定代表人裴湉。据 天眼查·工商基础信息 ,注册地址为北京市海淀区科学院南路 2 号 C 座 5 层 N501; 天眼查·2025 年企业年报 (2026 年 6 月 12 日发布)显示参保人数 67 人,营收、利润等财务数据“企业选择不公示”。 控制权高度集中: 天眼查·最终受益人 显示梁文锋间接持股比例 89.4623%,路径包括直接持股杭州主体 34%、经宁波程恩(持股 66%)及宁波程信柔兆两条合伙企业链增厚。早前 天眼查收录的报道 称,北京、杭州两个主体成立后架构曾经历“身份对调”,形成当前杭州控股北京的格局;公司自 2023 年 6 月起为增值税一般纳税人( 天眼查·纳税资质 )。 一边把价格打到地板,一边准备 1GW 算力:钱从哪来 降价不是没有代价。据 证券时报 4 月 18 日报道 ,DeepSeek 正启动成立以来首轮外部股权融资:以超 100 亿美元估值计划募集不少于 3 亿美元,主要压力来自研发成本激增与核心人才流失——罗福莉、郭达雅等核心研究员被小米、字节跳动挖角。报道同时披露竞争环境:OpenAI 3 月完成 1220 亿美元融资(投后估值 8520 亿美元),Anthropic 2 月 300 亿美元 G 轮(估值 3800 亿美元),而 2026 年一季度国内通用大模型融资额同比下滑 72%。该报道注明消息仍在洽谈、公司未正式回应。 7 月 31 日, IT时代网援引彭博社 称,DeepSeek 计划在距北京西北约 350 公里的内蒙古乌兰察布新建 1GW 算力数据中心,部分算力拟于 2027 年底至 2028 年初投运,同时对外租赁额外算力;今年 4 月已放出乌兰察布的数据中心岗位(月薪 15–30K、14 薪)。参照英伟达 CEO 黄仁勋估算,1GW 级数据中心若配顶级加速器,投资可能高达约 500 亿美元——中国建设成本通常更低( 搜狐转载报道 估约低 30%)。“模型做省、算力做大”的路线,与 OpenAI、Anthropic 的“越大越贵”形成鲜明对照,但也意味着:价格战压收入、基建扩张压现金流,融资落地节奏是这轮故事的真正胜负手。 0.8元/秒之后,哪条赛道先放量 MiniMax H3 与字节 Seedance 2.5 给出了各自的答案,证据指向两条共同路径: 广告与电商素材最先受益。 新华财经 报道,H3 重点提升复杂指令遵循、画面文字与品牌信息呈现、视频到视频动作迁移,明确用于广告营销、电商展示、产品设计、UI/UX 和游戏开发;2K 视频 0.8 元/秒后,一支 15 秒信息流广告素材成本仅 12 元。 网易科技报道 指出,Seedance 2.5 的 30 秒恰好覆盖标准信息流/贴片广告时长(15–30 秒)与微短剧单机位长镜头——这是从“B-roll 辅助素材”到“成片级直出”的分水岭。 B 端 API 化与开源本地部署是共同通道。 Seedance 2.5 的 API 将接入火山方舟,H3 未来几天内开源( 上证报 ),企业可本地部署规避合规与数据出境问题;DeepSeek V4-Flash 则用 MIT 开源 + 原生 Responses API 把文本/Agent 侧底座成本打下来,让下游内容生产线的算力账整体变薄。 但放量的前提还没完全兑现:字节官方承认复杂物理交互与多主体稳定性“仍有提升空间”,长视频单次生成推理成本呈指数级增长;火山方舟的 API 定价、并发与单次耗时将直接决定 B 端渗透率( 网易科技 )。换言之,0.8 元/秒只砍掉了“生成单价”,还没砍掉“返工成本”和“算力账单”。 风险观察:五个待验证点 风险/压力 证据 价格战反噬收入模型 V4-Flash 价格低至缓存命中 0.02 元/百万 Token,而 2025 年报营收、利润均“选择不公示”,收入结构无法核验 融资尚未落地 4 月证券时报报道估值超 100 亿美元、拟募 ≥3 亿美元,注明“消息仍在洽谈、公司未正式回应” 算力扩张的资金缺口 乌兰察布 1GW 数据中心投资或达数百亿美元级(黄仁勋口径 500 亿美元),芯片选型未定 核心人才流失 罗福莉、郭达雅等被小米、字节跳动挖角,融资用途明确含“稳定团队” 产品节奏与体验缺口 V4-Pro 时间表未定且不开源;仅 API 公测,App/网页端未更新;Agent 模式推理语言被锁定为英文 下一步验证什么 8 月初: V4-Pro 是否按 TechWeb 报道的时间表接入 Responses API;MiniMax H3 开源落地与本地部署效果。 近期: 火山方舟 Seedance 2.5 的 API 定价与高并发表现;字节“长叙事”在多主体交互上的实测。 季度级: DeepSeek 首轮融资的投资方与估值兑现;乌兰察布项目的芯片选型与投资规模;国产大模型厂商是否跟进 0.8 元/秒级视频定价。 回到最初的提问:视频生成单价砍到 0.8 元/秒后,商业化会先在哪条赛道放量?按当前证据,先放量的是 广告素材与电商展示 ——单价低、交付周期短、指令遵循与品牌信息呈现已有模型背书; 微短剧与影视预演 紧随其后,但受制于物理一致性与算力成本; 游戏开发与 UI/UX 则取决于开源生态的适配速度。而对北京深度求索人工智能基础技术研究有限公司而言,周末这一枪的真正含义是:它把“智能的单位成本”定成了新的行业锚点,接下来整个链条——从 API 定价、融资节奏到 1GW 算力的投运时间——都在为这个锚点买单。 网易财经 据此将下周 A 股视为关键窗口:AI 应用端的成本曲线拐点,正在把叙事从“模型发布”推向“商业兑现”。 来源 网易财经:周末密集释放多重信号!下周A股将迎关键窗口! 天眼查:北京深度求索人工智能基础技术研究有限公司·工商基础信息 天眼查:股东信息 天眼查:2025年企业年报 天眼查:最终受益人 天眼查:疑似实际控制人 天眼查:纳税资质 证券时报:DeepSeek,大消息!启动首轮外部融资! AI Tool Lab:DeepSeek V4-Flash 公测解析 TechWeb:DeepSeek-V4-Flash正式API上线 新浪科技:V4 Flash价格屠夫,性能直逼GPT-5.6 新华财经:MiniMax发布首款开源多模态生成模型H3 上证报(搜狐转载):MiniMax H3发布,视频模型走向商业级生产 网易科技(新浪财经转载):字节跳动发布Seedance 2.5,单次生成时长升至30秒 IT时代网(百家号):DeepSeek拟在乌兰察布新增1GW算力 搜狐:DeepSeek拟于内蒙古建大型AI数据中心