北京深度求索人工智能基础技术研究:V4峰谷定价叠加Harness内测,企业用户使用成本成最大未知数 2026-07-29 · 编辑自 投资界 等来源 2026年7月29日,一张DeepSeek Harness内部测试招募截图在AI社区流传。截图称Harness"本周晚些时候"开启内测,入选者需签署《保密承诺函》。若消息属实,这意味着由前Jane Street量化交易专家崔添翼带队、已秘密研发五个月的DeepSeek Harness即将揭开面纱——同时也意味着V4正式版的发布窗口正在收窄。 Harness负责人崔添翼此前明确表示,Harness将与V4正式版同步发布。但V4正式版已从"7月中旬上线"的承诺中跳票。截至7月29日,官方仍未公布具体日期。旧版API接口deepseek-chat和deepseek-reasoner已于7月24日停用,全部流量强制切换至V4体系——模型本身仍是预览版,但定价体系即将迎来最大的一次结构性变革。 核心矛盾: 峰谷定价将在工作日主要时段让API价格翻倍;Harness作为Agent编排工具链,天然消耗更多推理token;两者叠加后,企业用户每完成一个复杂任务的综合成本——目前没人算得清。 一、峰谷定价:企业白天调用成本直接翻倍 DeepSeek于6月29日通过邮件向API用户预告V4正式版将同步引入峰谷定价机制。高峰时段(北京时间每日9:00-12:00、14:00-18:00)API价格为平时价格的2倍;非高峰时段价格与2026年5月永久降价后的预览版持平。 模型 计费项 平时价格 元/百万token 高峰价格 元/百万token V4-Pro 输入(缓存命中) 0.025 0.05 输入(缓存未命中) 3 6 输出 6 12 V4-Flash 输入(缓存命中) 0.02 0.04 输入(缓存未命中) 1 2 输出 2 4 数据来源: 新浪财经|DeepSeek V4峰谷定价具体规则 V4-Pro在高峰期的输出成本达到12元/百万token,V4-Flash达到4元/百万token。尽管即便翻倍后仍远低于Claude Fable 5(据德意志银行分析师测算,V4-Pro执行同等任务成本约为Anthropic的1.5%),但对于习惯在白天主要工作时段密集调用API的国内企业开发团队而言,成本压力是实实在在的。 二、这不是第一次调价:DeepSeek三次定价变动的逻辑 峰谷定价是DeepSeek近一年来的第三次价格策略调整,一次比一次精细,也一次比一次复杂: 2025年9月 V3.1发布,取消夜间优惠,输出涨价50%。 输出价格从8元涨至12元/百万token,输入缓存未命中从2元涨至4元。这是DeepSeek首次主动提价,也是此前"价格屠夫"形象的第一次转向。 2026年4月 V4 Preview上线,初始定价偏高。 V4-Pro输出24元/百万token,Flash输出2元。Pro版定价较V3.1翻倍,引发社区讨论。 2026年5月 永久降价75%。 V4-Pro输出从24元降至6元,Flash维持在2元。原定6月到期的限时优惠直接转为永久价格,缓存命中输入最低降至0.025元。这被认为是应对Kimi K2、GLM 5等竞品压力的防御性动作。 2026年7月(即将生效) 峰谷定价:非高峰维持降价后价格,高峰翻倍。 这是DeepSeek首次引入分时段计费,参考电力行业"峰谷电价"模式,用价格杠杆分流算力负载。 ❓ 关键疑问: 连续调价的共同指向是什么?从"一口价"到"夜间优惠"再到"取消优惠+涨价"再到"峰谷分时",DeepSeek的定价正在从简单粗暴走向精细运营。背后的信号是: 算力供给正在变得紧张,公司需要更精确地控制负载分布。 而Harness工具链的推出,将让算力消耗从"线性调用"变成"多轮Agent循环"——这对定价模型的挑战远大于简单翻倍。 三、Harness内测:Agent工具链的隐形成本 Harness到底是什么?从DeepSeek招聘JD和崔添翼的量化背景推断,它不是一个简单的代码助手,而是一个 深度绑定V4模型的Agent编排框架 : JD中提及的关键能力包括:KV Cache与长上下文裁剪压缩、向量存储与对话持久化、Tool Use链式调用与自动重试、多Agent通信协议设计、任务规划图生成与执行路径在线优化。核心思路是把量化交易系统中的"毫秒级执行-自动容错-全链路可追溯-状态一致性"方法论映射到Agent循环中。 但问题在于:Agent循环天然消耗更多token。 第三方测试显示,用DeepSeek V4 Flash跑同样的代码任务,不同Harness工具(Claude Code、OpenCode、Pi)的token消耗差异显著——工具链越强,推理步数越多,token飞得越快。 DeepSeek官方JD中明确提到"模型与Harness共同进化"——意味着Harness将深度利用V4的稀疏注意力和前缀缓存能力来降低冗余计算。但其实际token优化效果,要等内测数据出来才能验证。目前一切都是黑箱。 四、V4为何跳票?来自Kimi K3的侧翼压力 V4正式版从"7月中旬"拖到7月底仍未上线,官方解释是"修复稳定性漏洞"。但社区普遍认为,更直接的外部变量是 月之暗面于7月17日发布的Kimi K3 ——参数量2.8万亿,综合评测得分74.7(Vals AI),仅次于Claude Fable 5,超越GPT-5.6,且实现开源模型首次在Frontend Code Arena登顶。 据参与灰度测试的开发者反馈,V4正式版整体表现"接近Opus 4.8级别",编码能力"不弱于GPT-5.6 Sol"。这与Kimi K3的"Fable 5级"叙事存在可感知的差距。在竞品已重新定义行业标杆的时间点上推出一个"够好但不惊艳"的版本——战略上并不划算。 DeepSeek在V4预览版发布时曾引用《荀子》:"不诱于誉,不恐于诽,率道而行"。跳票是战略选择,而非工程事故。 五、公司基本面:500亿融资后的新节奏 14→67人 员工社保数(2023→2025) $50B+ 2026年6月融资后估值 500亿+元 首轮外部融资规模 梁文锋 最终受益人(持股约89.5%) 数据来源: 天眼查|企业年报 (2023-2025) · 证券时报 北京深度求索人工智能基础技术研究有限公司由杭州深度求索100%控股,梁文锋通过多层架构合计持股约89.5%,为公司最终受益人。2026年6月完成首轮外部融资,总规模超500亿元人民币,估值突破500亿美元。员工社保人数从2023年的14人增至2025年的67人,团队仍在快速扩张。 但压力同样真实。公司此前长期依赖幻方量化的自有资金运转,2026年首次对外融资的主要原因之一就是 "核心人才流失" ——多位核心研究员(如罗福莉、郭达雅)被小米、字节跳动挖角。峰谷定价+Harness的商业化组合拳,某种程度上也是向投资者证明"模型能力可以转化为持续收入"的必要叙事。 六、下一步看什么 以下几个信号值得持续跟踪: 1. Harness内测的token消耗数据。 这是目前最大的成本变量。如果Harness的KV缓存和前缀缓存优化能抵消Agent多轮调用的额外开销,则峰谷定价对成本的影响可控;否则,企业综合使用成本可能远超预期。 2. V4正式版发布时间与能力天花板。 官方灰度测试已铺开(可通过思维链开头"I'll"而非"Let me"判断是否GA版本),业界预计最晚8月初发布。如果正式版的Agent能力和多模态(首次原生支持图像推理)有明显跳升,峰谷定价的接受度会更高。 3. 竞品定价的连锁反应。 Kimi K3(开源)、智谱GLM 5.2(据杰富瑞称"在企业市场几乎等同于Anthropic,成本仅四分之一")均在向DeepSeek的核心定价区间施压。峰谷机制能否真正带来"低谷期算力利用率提升",还是只会推动用户迁移到其他平台,需要观察后续API调用量分布。 4. 融资后的算力扩张节奏。 500亿融资将用于算力投入和模型研发,但算力基础设施的交付周期通常以季度计。短期内的算力供给约束,或许是峰谷定价最直接的驱动力。 来源: · 投资界|DeepSeek Harness开启内测?看来V4正式版也不远了 · 新浪财经|DeepSeek V4峰谷定价具体规则是什么? · 证券时报|DeepSeek,大消息!启动首轮外部融资 · 21世纪经济报道|R2没等来,DeepSeek V3.1发布:价格涨了 · 凤凰科技|腾讯京东们掏500亿,DeepSeek离赚钱还有多远? · 天眼查|北京深度求索人工智能基础技术研究有限公司|企业年报 · Edgen|DeepSeek V4正式版7月上线,高峰时段API价格翻倍 · CSDN|DeepSeek V4正式版跳票:当"中国速度"撞上理想主义