北京月之暗面刚造出全球最大开源模型,行业奖励的已是「成本效率」 Kimi K3 以 2.8 万亿参数登顶开源规模榜首,但同月内 xAI 拉低 API 价格至 2 美元/百万 token,DeepSeek 推出峰谷定价低至 0.18 美元,OpenAI 拆分三档模型——大模型竞赛的计分板正在重写。 📅 2026年7月29日 · 事时观察 · 基于 钛媒体 、 彭博社 、 公开报道 等来源 一个矛盾的行业节点 2026年7月16日, 北京月之暗面科技有限公司 (下称"月之暗面")发布新一代旗舰大模型 Kimi K3 ,总参数规模达 2.8 万亿,创全球开源模型之最。但就在同一个月内,xAI 发布 Grok 4.5 强调"更低价格提供接近顶级的推理能力",OpenAI 将 GPT-5.6 拆分为 Sol、Terra、Luna 三个成本层级,DeepSeek 则推出峰谷计费机制,谷段价格低至每百万 token 仅约 0.18 美元。 三家头部公司——加上月之暗面自己——在同一个月内的发布,指向同一个转折信号: 大模型竞争的核心指标,正在从"谁能训练出最大的模型"变成"谁能以最低成本提供最可用的能力"。 这不意味着参数规模失去意义。但单纯堆算力的边际收益正在递减,而 MoE 架构效率、推理 token 利用率、API 分层定价能力,正在成为新的赛点。 Kimi K3:最大的开源模型,也是压力最大的 2.8万亿 总参数规模 / 全球开源最大 896/16 MoE 专家池 / 每次激活 100万 Token 上下文窗口 57分 Artificial Analysis 智能指数 / 全球第3 Kimi K3 的核心技术路线是" 大而不笨 "。它采用自研 KDA 混合线性注意力机制和注意力残差结构,在 896 个 MoE 专家中仅激活 16 个参与每次推理。官方数据显示,百万 Token 解码速度最高提升 6.3 倍,训练效率提升 25%,新增运行成本不足 2%。在 Arena Frontend Code Arena 编程盲测中,K3 以 1679 分超越 Claude Fable 5(1631 分)和 GPT-5.6 Sol(1618 分),排名榜首。 但发布 48 小时内,由于用户并发请求量短时间内冲至 GPU 集群承载极限,月之暗面官方在 7 月 19 日 暂停了 C 端新用户订阅服务 ——这可能是 AI 行业第一个因"模型太火"而主动限流的案例。 马斯克在相关评测下留言 "Impressive" ,并透露其团队正在训练 2 万亿参数的新模型。 📊 关键对比:K3 API 定价 vs 竞品 月之暗面给出的 Kimi K3 API 定价为:缓存命中时输入 2 元/百万 token,未命中时 20 元/百万 token,输出统一 100 元/百万 token(约合 14 美元)。同期 DeepSeek V4-Pro 谷段输出仅 6 元/百万 token(约 0.87 美元),Grok 4.5 输出为 6 美元/百万 token。K3 的输出价格是 DeepSeek 的约 16 倍 ,是 Grok 4.5 的约 2.3 倍 。 一场由 DeepSeek 引爆的成本革命 2025 年初,DeepSeek 以模型架构优化和训练方法改进,率先打破大模型训练必定烧钱的行业认知。到 2026 年 7 月, DeepSeek V4-Pro 的 API 价格 在缓存命中时已低至每百万 token 仅 0.025 元(约 0.0035 美元),输出仅 6 元/百万 token(约 0.87 美元),较 GPT-5.5 便宜超过 100 倍。 这带来了连锁反应: xAI(SpaceXAI) 于 7 月 8 日发布 Grok 4.5,API 输入 2 美元/百万 token、输出 6 美元/百万 token,较同级别 Claude Opus 4.8 便宜约 60%, 推理速度达 80 TPS 。 OpenAI 于 7 月 9 日发布 GPT-5.6 三档模型:Sol(5/30 美元)、Terra(2.5/15 美元)、Luna(1/6 美元), 将轻量场景成本降至旗舰版的 1/5 。 DeepSeek 于 7 月中旬引入峰谷计费,谷段输出低至 0.87 美元,较海外旗舰模型整体低约 90%。据 OpenRouter 数据 ,2026 年 6 月其周调用量已达 6.75 万亿 token,超越 Anthropic。 在高盛 2026 年 7 月的行业研报中,这被定性为"价格战走向理性化的早期信号"——大模型定价正在从"一刀切低价"转向"按算力使用时段精细化分层"。 月之暗面:资本弹药充足,但效率压力同样巨大 在成本效率战的语境下,月之暗面拥有一个显著优势: 弹药储备 。 根据天眼查记录,月之暗面自 2023 年成立以来的融资轨迹如下: 时间 轮次 金额 投后估值 主要投资方 2023年6月 天使轮 近20亿人民币 — 红杉中国、真格基金、今日资本等 2024年2月 A+轮 超10亿美元 25亿美元 阿里、红杉、小红书、美团等 2024年8月 B轮 超3亿美元 33亿美元 腾讯、高榕创投等 2025年12月 C轮 5亿美元 43亿美元 IDG、阿里、腾讯等 2026年2月 C+轮 超7亿美元 55亿美元 阿里、腾讯、五源等 2026年5月 D轮 20亿美元 破200亿美元 美团龙珠、中国移动、CPE 2026年7月 新一轮 约20-30亿美元 约315亿美元 多家国际长线基金 据 彭博社 7 月 22 日报道 ,月之暗面计划于 8 月启动 Pre-IPO 轮融资谈判,目标投前估值高达 500 亿美元 ,较 2025 年底的 43 亿美元不到 8 个月增长超 10 倍。公司最快预计 6 个月内赴港上市。 支撑这一估值的核心商业化数据是:截至 2026 年 6 月,月之暗面年度经常性收入(ARR)已达 3 亿美元 ——3 月首次破 1 亿美元,5 月破 2 亿,6 月站稳 3 亿,其中 API 收入占比超七成。 ⚠️ 风险信号:150+ 倍市销率 以 315 亿美元投前估值计算,月之暗面当前市销率超过 150 倍。对比已上市的智谱(港股)和 MiniMax(港股),以及启动科创板 IPO 筹备的 DeepSeek,这一估值水平在同类公司中处于高位。若行业价格战进一步压缩 API 毛利率,市场对高估值持续性的质疑可能加剧。 竞争格局正在重组:效率 vs 规模,并非二选一 月之暗面处于一个独特的位置:它同时在"规模路线"和"效率路线"上下了注。 一方面,Kimi K3 用 2.8 万亿参数捍卫了"模型越大能力越强"的逻辑——在 Artificial Analysis 综合评测 中,K3 智能指数 57 分,排名全球第 3-4 位,仅次于 Claude Fable 5 和 GPT-5.6 Sol。另一方面,其 MoE 稀疏架构、KDA 注意力机制、100 万 Token 上下文等设计,都是在为商业化落地铺路——让超大规模模型在有限算力下也能跑起来。 但直接对比 API 价格,压力是明显的: 模型 输入价格(每百万 token) 输出价格(每百万 token) 参数规模 开源 Kimi K3 2-20 元(约 0.28-2.8 美元) 100 元(约 14 美元) 2.8万亿 ✅ 是 DeepSeek V4-Pro 0.025-2 元(约 0.0035-0.28 美元) 6 元(约 0.87 美元) 1.6万亿 ✅ 是 Grok 4.5 2 美元 6 美元 1.5万亿 ❌ 否 GPT-5.6 Luna(入门) 1 美元 6 美元 未公开 ❌ 否 GPT-5.6 Sol(旗舰) 5 美元 30 美元 未公开 ❌ 否 数据来源:各公司官方 API 定价页面及 行业综合对比 。 在此背景下,K3 在编程领域的领先优势可能成为差异化切口。月之暗面官方披露的实测案例显示,K3 曾在少量人工监督下连续 48 小时自主运行,独立完成了一款 4 平方毫米芯片的完整设计——这种端到端的长周期自主任务能力,在目前的大模型中属于稀缺能力。 三个待验证的问题 🔍 待验证信号 1 算力瓶颈何时缓解? K3 发布后因算力紧缺暂停新用户订阅,本质上是一个供给侧能力的压力测试。月之暗面账上有超百亿人民币(杨植麟 2025 年底公开披露),但推理算力的弹性供给仍是瓶颈。公司能否在 Pre-IPO 前证明其算力供应链的稳定性,直接关系到 500 亿美元估值能否兑现。 🔍 待验证信号 2 API 价格能否下探? K3 的 API 输出定价约 14 美元/百万 token,是 DeepSeek 的 16 倍。在企业客户大规模部署的场景中,如果推理成本不能快速收敛,商业化的规模天花板会被提前锁定。MoE 架构的设计优势能否转化为成本优势,是下一阶段的观察焦点。 🔍 待验证信号 3 开源策略 vs 商业化变现的张力 K3 的完整模型权重定于 7 月 27 日前发布。完全开源可以拉拢开发者生态(这是月之暗面目前相对 DeepSeek 较弱的环节),但也可能削弱 API 服务的定价能力和差异化壁垒。月之暗面需要在"开放"和"变现"之间找到平衡点。 从军备竞赛到算力经济学 2020 年 GPT-3 的 1750 亿参数让行业第一次见识了"越大越好"的魔力。6 年后的今天,Kimi K3 的 2.8 万亿参数和 DeepSeek 的 0.0035 美元/百万 token 同时存在于同一个市场——这本身就是一个行业从混沌走向分层的标志。 大模型不再是一个比拼单一维度的游戏。月之暗面在参数规模上登顶,但它的长期价值取决于三个变量: 推理成本的下降速度、开发者生态的扩张速度、以及商业化收入的增长能否跑赢估值扩张 。 下一个阶段的赢家,不是模型最大的那一个,也不是价格最低的那一个,而是能把模型能力转化为可规模化的产业价值的那一个。 参考来源 钛媒体:大模型不再比谁更大 (2026-07-29) 头条科技:Kimi K3 发布,国产大模型迎来新突破? (2026-07-27) 全球最大规模开源模型 Kimi K3 发布 (2026-07-17) 月之暗面发布 K3,马斯克点赞并称将推出竞品 (2026-07-21) 彭博社:月之暗面计划 8 月启动 Pre-IPO,目标估值 500 亿美元 (2026-07-22) 天眼查:北京月之暗面科技有限公司档案 月之暗面拟 8 月开启 IPO 前最后一轮融资 (2026-07-29) DeepSeek 峰谷定价:API 低至 0.18 美元(行业综合报道) (2026-07-16) GPT-5.6 分三档,AI 比拼进入"算账"时代 (2026-07-13) Grok 4.5 发布:完整规格、定价与 API 接入 (2026-07-10)