北京深度求索人工智能基础技术研究:V4-Flash公测即上国家超算互联网,1元/百万token的低价碰上峰谷翻倍 8月2日起, DeepSeek-V4-Flash正式版API 公测的消息在开发者社区刷屏。 36氪快讯 称,国家超算互联网已“第一时间”同步上线该模型的API调用与模型下载服务。对北京深度求索人工智能基础技术研究有限公司(下称深度求索)来说,这既是V4系列三个月来的第一次正式放量,也是分发渠道的一次关键扩张:从自家API和云厂商,延伸到集成超1700款开源大模型的国家级算力平台。公测期的实际调用体验、峰谷定价的执行效果,将是检验其“性价比打法”能否延续的两个观察点。 事件:DeepSeek-V4-Flash-0731正式版上线公测|渠道:国家超算互联网同步开放API调用与模型文件|时间:2026年7月31日上线,8月2–3日消息扩散 关键指标速览 维度 数据 说明 模型版本 DeepSeek-V4-Flash-0731 2026-07-31上线,正式版开启公测 价格(缓存未命中) 输入1元 / 输出2元(每百万token) 与预览版一致,未因升级涨价 价格(缓存命中) 输入0.02元 / 百万token 缓存命中折扣约98% 峰谷定价 高峰时段翻倍 每日9:00–12:00、14:00–18:00(北京时间) 上下文 / 模式 1M tokens 思考/非思考双模式;原生支持OpenAI Responses API与Codex适配 参数口径 一说总参数2840亿、激活130亿(MoE) 另有报道口径称304B轻量级,两说并存 关键基准 TerminalBench 2.1:61.8 → 82.7 DeepSWE:7.3 → 54.4 ,全面反超V4-Pro预览版(媒体口径) 开源状态 模型权重开源 发布后在HuggingFace趋势榜列第二,仅次于Kimi K3 分发渠道 官方API + 国家超算互联网 官网“模型服务”专区一键调用;AI社区提供模型文件下载与Notebook微调 口径说明:总参数2840亿/激活130亿出自公开评测整理,304B出自另一篇报道,两处来源不同、差异约7%,在本文并列呈现,不作合并结论;基准成绩均为媒体转述口径,正式版与第三方复现的差异待公测验证。 时间线:为什么是现在 2023-05-16 北京深度求索成立,注册资本1000万元; 天眼查工商信息 显示公司现为法人独资(唯一股东:杭州深度求索人工智能基础技术研究有限公司,持股100%)。 2026-04-18 证券时报援引The Information :DeepSeek启动成立以来首轮外部股权融资,估值超100亿美元(约681.8亿元),计划募资不少于3亿美元,资金指向算力投入、新一代模型(V4)研发、稳定团队与商业化。 2026-04-24 V4系列预览版发布(Pro主打性能上限、Flash主打低成本低延迟),标配1M上下文;4月26日全系API输入缓存命中价降至首发价的十分之一。 2026-06-16 界面新闻称首轮融资已完成 :募资总额超500亿元、投后估值突破3380亿元,梁文锋为最大单一出资方(约200亿元),腾讯约100亿元,宁德时代体系约50亿元——媒体报道口径,公司尚未正式确认。 2026-06-29 DeepSeek邮件预告V4正式版上线,并宣布引入峰谷定价:高峰时段调用价格直接翻倍,调整前24小时邮件告知。 2026-07-31 V4-Flash正式版(0731)上线公测;同日OpenAI宣布GPT-5.6 Luna API价格下调约80%;国家超算互联网同步上线该模型API调用与模型文件。 2026-08-02/03 消息公开扩散:企业及开发者登录国家超算互联网官网PC端“服务→模型服务”专区即可一键调用,无需配置环境。 技术看点:结构没变,只重做了后训练 按 腾讯新闻(爱范儿)实测报道 ,V4-Flash-0731与预览版 模型结构、尺寸完全一致,这次只重新进行了后训练 ——相当于“身板没变,做事的习惯变了”。官方给出的提升幅度很大,甚至宣称“远超V4-Pro-Preview”:TerminalBench 2.1从61.8分涨到82.7分,DeepSWE软件工程测试从7.3分涨到54.4分。 这意味着两点:一是 后训练优化的边际空间被证明比预想更大 ,不用重训基础模型就能“越级”换代,单位研发投入的产出更高;二是这也把竞争压力直接推给了同行——同样是做后训练和推理优化,谁能把成本压得更低。 但要注意边界:上述对比是官方与媒体口径,网页版和App目前均未更新,正式版只能通过API使用;权重虽已开源(HuggingFace趋势榜第二、仅次于Kimi K3,见 腾讯新闻报道 ),但“全面反超Pro预览版”需要在真实Agent任务里复现才算数。另外,V4-Pro正式版已“在路上”,Flash的反超能否延续,是下一轮看点。 钱的问题:不涨价,但高峰翻倍 这是这次公测最值得盯的地方: 低价打法没有变,账本却悄悄变了。 计费项(每百万token) 平时 高峰时段(9:00–12:00、14:00–18:00) 输入·缓存命中 0.02元 0.04元 输入·缓存未命中 1元 2元 输出 2元 4元 第三方美元口径 输入0.14美元 / 输出0.28美元;缓存命中0.0028美元 按 公开整理 ,V4-Flash缓存命中折扣约98%(业界常见为90%),国际对比下价格约为Anthropic Opus 4.8的百分之一左右;即便OpenAI已把上线仅3周的GPT-5.6 Luna降价约80%(降价后输入0.2美元、输出1.2美元),V4-Flash的单任务成本仍比Luna低约60%。 有机构测算 ,一个2000万token的Agent任务折前约3.5美元。 低价是真的,压力也是真的。 界面新闻报道 披露,OpenRouter聚合平台数据显示V4-Flash单模型周调用量已突破4.66万亿tokens,连续六周登顶全球单模型调用榜首,但环比下滑6%;此前多次线上服务波动、接口超时频发,根因正是“低价策略吸引海量流量,算力集群负载长期触及红线”。峰谷定价本质是用价格杠杆把可离线处理的任务挤出高峰,保金融、代码研发、实时智能体等高优先级业务——也就是说, 公测放量后的稳定性,要看这套调度机制能不能真的接住流量。 渠道看点:国家超算互联网为什么“第一时间”接单 国家超算互联网的接单,不只是多一个入口。按 DoNews报道 ,该平台已集成超1700款开源大模型、建成全国首个十万卡级超智融合算力资源池; 凤凰网·快科技报道 称,其AI社区覆盖DeepSeek、GLM、Qwen、Kimi等主流系列,本次上线“无需配置环境,一键调用”。对深度求索,这是把“下载即用”的触角伸进国家级算力供给体系,摊薄获客与部署成本;对平台,则是补上头部国产开源旗舰模型的即时供给——两头都有利可图。 渠道打法并非首次。早在2025年2月,华为云ModelArts Studio就上线过DeepSeek(昇腾适配版),当时公开信息显示DeepSeek-V3生成速度60tps、训练成本仅557.6万美元(见 今日头条·华为云部署文章 )。从云厂商到国家级算力平台,渠道的多元化意味着对单一云厂商依赖的下降,也意味着“低价放量”不再受制于自家机房与单一合作方。 公司底色:法人独资、实控人梁文锋、扩编与融资同步 股权 北京深度求索现为法人独资,杭州深度求索持股100%; 天眼查变更记录 显示2023-09-04投资人由梁文锋、宁波程采变更为杭州深度求索(新进)。 疑似实控人 仍为梁文锋,穿透持股比例约89.46%。 人员 天眼查年报 显示参保人数从2024年报的37人增至2025年报的67人(+81%);界面新闻另报道公司正大规模招人,计划将各部门规模扩大至少一倍(7大类33个岗位,覆盖北京、杭州)。 财务 2023—2025连续三年年报对营收、利润、总资产均“企业选择不公示”,公司真实盈利状况无从核验——这也是“低价可持续性”问题无法靠公开报表回答的原因。 融资 从4月“启动洽谈”(估值超100亿美元、募资≥3亿美元)到6月“传完成”(募资超500亿元、投后估值3380亿元),两个口径相差悬殊但处于不同阶段:前为外媒报道的启动估值,后为界面新闻披露的投后口径,均非公司正式公告。若外部资本落地,现有“法人独资”架构将出现变化。 把这些串起来看,深度求索正在同时做三件事:以“不涨价的后训练换代”维持性价比心智;以峰谷定价和国家级渠道对冲算力与获客成本;以融资和扩招补研发与人才。风险在于三件事互为条件——低价放量依赖算力与资本,资本依赖产品口碑,而核心研究员的持续流失(界面新闻披露罗福莉、郭达雅已被小米、字节跳动等挖角)正在考验后训练人才梯队的厚度。 下一步验证什么 公测放量后的真实延迟与并发:官方未公布SLA承诺,此前“接口超时频发”的历史是否重演,看公测期第三方实测。 峰谷定价的执行效果:高峰翻倍能否真正分流非紧急任务,开发者对“低价心智”被分时打破的接受度。 V4-Pro正式版的时间与定价:预览版Pro缓存命中0.025元、未命中3元、输出6元,正式版是否兑现“下半年昇腾超节点上市后Pro大幅降价”的预告。 融资落地与股权结构:500亿元募资、3380亿元投后估值的媒体报道是否获公司确认,法人独资架构何时改变。 网页版/App的跟进时点:目前仅API可用,C端入口尚未接入V4-Flash。 参数口径与基准复现:2840亿/130亿激活与304B两种口径并存,官方基准与第三方复现的差距。 来源与核验 (链接可点击;公司登记信息来自天眼查公开数据) 36氪快讯|DeepSeek-V4-Flash正式版API登陆国家超算互联网 新浪财经(转)|DeepSeek-V4-Flash正式版API登陆国家超算互联网 凤凰网·快科技|国家超算互联网上线DeepSeek-V4-Flash正式版API:一键调用、无需配置 DoNews|DeepSeek-V4-Flash正式版API上线公测 腾讯新闻|实测DeepSeek V4 Flash正式版:3块钱干完5件事 腾讯新闻|DeepSeek-V4-Flash正式版发布并开源,全面超越V4-Pro预览版 界面新闻(新浪转载)|DeepSeek V4正式版要来了,API高峰时段价格翻倍 新浪|DeepSeek V4-Flash正式版API价格与性能整理 东方财富·有连云|DeepSeek发布V4-Flash正式版,持续拉动国产算力需求 证券时报|DeepSeek,大消息!启动首轮外部融资 天眼查|北京深度求索人工智能基础技术研究有限公司|工商基础信息 天眼查|企业年报(2024、2025) 天眼查|股东及疑似实际控制人 天眼查|企业天眼风险(投资人变更) 今日头条|在华为云上快速体验、调用和部署DeepSeek(昇腾适配版)