北京月之暗面K3登顶SOTA后48小时被迫刹车:开源史上最大模型撞上算力天花板 2.8万亿参数、前端代码全球第一、综合智能仅次于Claude Fable 5和GPT-5.6——但用户请求两天内压垮集群,月之暗面首次暂停C端新用户订阅。投资人Kiwi坦言:"所有AGI公司都缺算力。" 模型动态 资本 算力风险 2026-07-29 来源: 钛媒体 · 硅谷101 2.8T 总参数 / 全球最大开源 #1 前端代码竞技场 · 超越Fable 5 91.2 BrowseComp长程检索 · 全球第一 48h 发布→算力告急暂停新用户 北京月之暗面科技有限公司 (以下简称"月之暗面")在2026年7月经历了一场冰火两重天。7月16日,其新一代开源基座模型Kimi K3以2.8万亿参数规模横空出世,成为全球首个迈入3万亿级别的开源模型,在前端编程、长程检索等多项基准测试中超越或追平Anthropic Claude Fable 5和OpenAI GPT-5.6 Sol等顶级闭源模型。然而仅仅48小时后,这家公司就因算力告急暂停了全部C端新用户订阅——这是中国大模型行业首次因"需求过载"主动限流。 投资人Kiwi(叶奇意)在最新播客访谈中回顾称,K3在训练过程中"已超越当时所有SOTA闭源模型(Opus 4.8全系)",中国开源模型"第一次不是靠性价比而是靠绝对能力接近硅谷前沿"。但她也坦承:"所有AGI公司都缺算力。月之暗面2024年因GPU匮乏一度限制新客户,资源瓶颈仍是最大隐忧。"( 钛媒体对话叶奇意 ) K3的技术登顶:用参数和架构踩出一条新路 Kimi K3采用月之暗面自研的 Stable LatentMoE稀疏架构 ,在896个专家中每次推理仅激活16个,兼顾庞大的知识容量与推理效率。其底层引入Kimi Delta Attention(KDA)混合线性注意力机制与注意力残差技术,原生支持视觉理解,支持 100万token上下文窗口 ,整体扩展效率较前代K2提升约2.5倍。( 东方财富 ) 在能力表现上,K3在多项测评中交出了中国开源模型迄今最强的成绩单: 基准测试 Kimi K3 Claude Fable 5 GPT-5.6 Sol 排名 Frontend Code Arena 1679 1631 1618 🥇全球第一 BrowseComp(长程检索) 91.2 — — 🥇全球第一 Artificial Analysis智力榜 全球第三 第一 第二 🥉中国最高 AA-Briefcase私有代理基准 1527 — — 反超GPT-5.6 Sol 数据来源: 新浪财经 、 科创板日报 在展示案例中,K3在连续48小时自主Agent运行中,基于开源EDA工具和Nangate 45nm工艺库独立完成了芯片构建、优化与验证;还从零构建了一套GPU编程系统,并用一次对391个引力波事件的分析展示了深度研究能力。月之暗面自承,K3综合智能仍落后于Fable 5和GPT-5.6 Sol,但"稳定超越其他所有开源及商用模型"。 "Kimi时刻":投资人视角的叙事翻转 投资人Kiwi(叶奇意)曾在美团龙珠主导对月之暗面的A1轮领投。在 钛媒体/硅谷101对话 中,她给出了一个关键判断: K3在训练过程中已超越当时所有SOTA闭源模型(Opus 4.8全系),中国开源模型第一次不是靠性价比而是靠绝对能力接近硅谷前沿。 这与18个月前"DeepSeek时刻"形成了鲜明对照——彼时DeepSeek以"开源+极低价格"打破了美国闭源模型的定价权;而K3则在能力天花板层面正面昭示:中国模型不再只配做"平替"。 但Kiwi也揭示了硬币的另一面: 算力缺口依然是追赶快车最大的赌点。 "所有AGI公司都缺算力,"她说,"月之暗面2024年因GPU匮乏一度限制新客户。"即使在K3发布前夕,资源瓶颈仍是月之暗面创始团队每晚都在焦虑的核心问题。 关键判断: "K3打破了'中国模型只配做平替'的叙事。但AGI公司的算力缺口是系统性的——这不只是月之暗面的问题,是整个赛道的问题。" ——Kiwi(叶奇意),美团龙珠前投资人 48小时反转:从登顶全球到紧急刹车 2026-07-16 K3发布,2.8万亿参数全球最大开源模型 WAIC前夕,K3登顶前端代码榜;马斯克在X上回复"Impressive" 2026-07-17 → 07-19 用户请求量"远超预期" 全球开发者涌入,百万上下文长文本、代码生成等高消耗请求压垮集群 2026-07-19 深夜 月之暗面公告:暂停C端新用户订阅 "过去48小时内用户请求量大幅超出预估,逼近现有集群承载极限"——国产大模型首次因需求过载主动限流。已有算力全部用于服务已订阅用户。 2026-07-20 中软国际签署"登月计划" 自建行业算力中心优先满足月之暗面需求,当日股价涨22.97% 2026-07-27 深夜 K3正式开源权重 完整模型权重、技术报告、支撑训练的Infra技术(MoonEP/FlashKDA/AgentEnv)全部公开发布,30分钟登顶HuggingFace趋势榜 在中国AI产业的语境中,这次"被迫刹车"被业界称为"Kimi时刻"——与2025年1月的"DeepSeek时刻"形成镜像:那次中国模型靠性价比打破了定价权,这次中国模型证明了"可以很强",但更强意味着更贵、也更吃算力。有测算显示,单一重度用户每日两次百万上下文深度对话的推理侧算力折旧与电费已超过59元月度会员定价。( 头部 ) 融资狂飙:半年估值涨超700%,国家资本入局 K3的技术爆发不是孤立事件。它是月之暗面过去18个月里用超过39亿美元融资"喂养"出的果实: 时间 轮次 金额 投后估值 主要投资方 2023.06 天使轮 ≈20亿人民币 — 红杉中国、真格基金、今日资本 2024.02 A+轮 超10亿美元 25亿美元 阿里、红杉、小红书、美团龙珠 2024.08 B轮 超3亿美元 33亿美元 腾讯领投、高榕、阿里 2025.12 C轮 5亿美元 43亿美元 IDG资本、阿里、腾讯 2026.01 C轮追加 5亿美元 100亿美元 — 2026.02 C+轮 7亿美元 180亿美元 阿里、腾讯、五源资本 2026.05 D轮 20亿美元 200亿美元 美团龙珠领投、CPE、中国移动 数据来源: 天眼查融资历史 (合并公开报道) 值得注意的是,2026年7月的工商变更显示,月之暗面新增了包括社保基金(通过深圳和谐成长三期持股11.76%)、中国移动等国资背景股东,创始人杨植麟持股比例从100%稀释至51.83%。半年时间,估值从43亿美元飙升至200亿美元+,增幅超700%。更激进的信号是: 6月传出新一轮融资投前估值已达315亿美元。 ( 新浪财经 ) 支撑这一估值的商业化数据同样惊人:截至2026年6月中旬,月之暗面 年度经常性收入(ARR)突破3亿美元 ——3月才刚破1亿美元,5月破2亿美元。其中API收入占比超70%,海外付费用户增长400%。 K3的API定价为输入每百万token 3美元、输出15美元 ,较K2系列提升近3倍,直接对标Claude Sonnet。 下一个赌点:算力扩容的速度能跑赢估值吗? 暂停C端新用户订阅的公告,暴露了月之暗面最真实的脆弱面:技术可以做到全球前三,但算力供给跟不上需求曲线。 月之暗面CEO杨植麟在2025年末的内部信中曾公布2026年战略——"K3模型通过技术改进和进一步scaling,提升等效FLOPs至少一个数量级,在预训练水平上追平世界前沿模型。"这个战略的前提是:算力必须到位。 目前已知的算力缓解路径包括: 中软国际"登月计划" :7月20日签署Token分成及联合创新合作协议,中软国际自建算力中心将优先满足月之暗面需求。( 搜狐 ) 华为昇腾生态 :WAIC上华为首次展出昇腾950超节点,单系统算力达1EFLOPS。K3官方推荐配置为64张以上加速卡组成的超节点。 K3权益拆分 :月之暗面计划将Kimi主权益与Kimi Code权益拆分独立计费,精准匹配算力分配。 🔍 下一步验证窗口 K3 C端新用户订阅能否在2026年8月底前恢复?若延期至Q4,算力扩容受阻信号将加剧市场担忧。下一轮融资估值能否守住300亿美元+,将成为资本市场对"高端模型+算力扩容"叙事信任度的风向标。 外部视线:硅谷的警惕与OpenAI的认可 K3在国际上引发的关注超出了预期。OpenAI总裁Greg Brockman罕见正面评价K3"相当不错",并称中国模型开发或仅落后美国4个月。( 观点网 )近200家硅谷初创企业创始人致信特朗普政府,敦促不要切断美国企业获取中国开源AI模型的渠道——侧面印证了中国开源模型对全球产业生态的渗透力。 (头部分析) 与此同时,海外也有质疑声音。OpenAI相关人士曾公开质疑K3的发展路径;Anthropic此前指控月之暗面等中国公司蒸馏其模型。但Brockman在最新表态中表示,现在判断月之暗面是否蒸馏"为时尚早"。 历史对照:从AI四小龙到大模型新贵的十年传承 在钛媒体的播客对话中,Kiwi把这场变革置于一个更长的坐标系中:过去十年,中国AI经历了两代"四小龙"——上一代是以计算机视觉为代表的商汤、旷视、依图、云从;这一代是智谱、月之暗面、MiniMax、DeepSeek。 两代公司之间存在隐形的传承链条——人才、资本、实验室经验、乃至上一轮创业的创伤,都在影响今天的大模型竞争。Kiwi回忆,她在为月之暗面招人时,80%的上一代AI人才选择了拒绝,"因为经历过一波理想主义的破灭"。但那一小撮"不计较回报、只被AGI本身兴奋"的人,最终成了月之暗面从算法突破走向Infra工程化的关键拼图。 写在最后 月之暗面K3的故事,是当前中国AI产业最具张力的缩影: 技术能力已摸到全球最前沿的天花板,但算力、资金、组织效率的三角缺口仍在闭环中。 从"DeepSeek时刻"(性价比颠覆)到"Kimi时刻"(能力天花板突破),中国大模型在18个月内完成了两次叙事升级。但两次突破之后,共同指向同一个问题:算力不再只是成本项,而是核心护城河。 K3在7月27日深夜如期开源权重,30分钟登顶HuggingFace趋势榜。HuggingFace联创兼CEO称"这是迄今为止发布增长速度最快的一次"。开源社区中的狂欢与算力机房里的焦虑之间,月之暗面正站在一个新平衡点上——前方是Opus 5和下一代GPT,身后是GPU的灯还在闪着红灯。 引用来源: 1. 钛媒体:对话叶奇意——"寻找"月之暗面杨植麟、中国两代AI与AGI信仰 2. 硅谷101/网易科技:对话叶奇意全文 3. 东方财富:月之暗面发布Kimi K3——2.8万亿参数原生多模态开源模型 4. 新浪财经:月之暗面开源Kimi K3——全球首个开源3万亿级模型 5. 科创板日报:月之暗面Kimi K3上线 6. 新浪科技:Kimi——算力紧缺,即日起暂停C端新用户订阅 7. 头部:月之暗面Kimi K3算力告急,首次因需求过载暂停新用户订阅 8. 搜狐/齐鲁晚报:云姨夜话——算力之下,"摇滚"的月之暗面 9. 天眼查:北京月之暗面科技有限公司融资历史 10. 观点网:OpenAI总裁称月之暗面Kimi K3"相当不错" 11. 海克财经:Kimi离DeepSeek时刻还有多远?