丘脑智能科技(深圳)联合英伟达开源MEMLENS:上下文越长越会“编”,独立记忆层是标配还是过渡? 成立第8个月、注册资本只有50万元的深圳南山公司,刚刚把两件事放在同一周:数千万元种子轮落地,以及一份给整个行业“泼冷水”的开源Benchmark。2026年5月, 丘脑智能科技(深圳)有限公司 联合英伟达、香港科技大学、香港中文大学发布MEMLENS,自称“全球首个多模态长记忆基准”,首次把27个视觉语言大模型和7个记忆Agent放进同一套多模态数据下同台对照( 36氪 )。 结论毫不客气:基模把长上下文全量塞进窗口,长度越长表现越差、越爱编;而记忆层该干的活,基模干不好。问题也随之而来——上下文窗口越拉越长,独立的记忆层会被基模“吸收”,还是反过来成为行业标配? 一、MEMLENS:给“全量塞上下文”算了一笔总账 34款 27个视觉语言大模型+7个记忆Agent同台( 36氪 ) 4档 上下文长度压力档位,最高256K( Agent创世纪 ) 789道 多模态考题,覆盖信息提取、跨会话推理、知识更新、时序推理与拒答5类任务( Agent创世纪 ) 128K 分水岭:除Gemini外,多数模型准确率在此档近乎归零( Agent创世纪 ) 注:四档长度的具体数值存在口径差异——36氪报道为“32、100、128、256K”,评测解说口径为“32、64、128、256K”,本刊并列呈现,待论文原文核对。 Benchmark的核心发现有四条( 36氪 ): 基模不做压缩。 视觉语言大模型把内容全量塞入上下文窗口,随着长度增加表现急剧下滑; 记忆Agent“稳定但粗糙”。 其表现相对长度不敏感,但大量视觉与多模态数据在写入阶段就已损失,整体精度仅维持在约30%( Agent创世纪 ); 越长越会编。 无论哪条路线,上下文增长后都更倾向产生幻觉,面对证据不足的问题时更自信地胡说; 后训练适得其反。 许多针对Memory的后训练方法削弱了模型拒绝回答的能力,反而抬高幻觉风险。 评测设计的“狠”处在于堵死文字捷径:考题把具体名称替换为图像占位符,必须看图才能作答。移除图片后,GPT-5.4准确率从93.13%跌至1.74%,Gemini-3.1-Pro从89.42%跌至1.89%;全部错误中89%来自视觉定位失败( Agent创世纪 )。 由此推出的结论是“分工论”:基模做好视觉感知、图文对齐和底层推理;记忆企业做好跨模态信息检索、证据组织和状态更新( 36氪 )。 二、这家公司是谁:8个月、50万注册资本、93.85%控制权 项目 信息 公司全称 丘脑智能科技(深圳)有限公司 成立日期 2025-11-19,经营状态存续 注册资本 50万元人民币(认缴,约定出资日2030-11-17) 法定代表人/董事 张源(监事:陈泽军) 注册地址 深圳市南山区桃源街道,南山智园崇文园区 统一社会信用代码 91440300MAK1NJDD0D 行业标签 软件和信息技术服务业;小微企业、种子轮 来源: 天眼查|工商基础信息 股权结构经历了两轮变化:2025年11月成立时张源100%持股(自然人独资);2026年6月11日引入深圳市智熵佳源科技合伙企业30%,企业类型变更为有限责任公司;2026年7月3日再引入深圳市智墒齐力科技合伙企业15%,张源直接持股降至55%( 天眼查|股东 、 天眼查|工商变更 )。 股东 认缴出资 比例 张源 27.5万元 55% 深圳市智熵佳源科技合伙企业(有限合伙) 15万元 30% 深圳市智墒齐力科技合伙企业(有限合伙) 7.5万元 15% 来源: 天眼查|股东 关键点在控制链:张源对智熵佳源持股80%、对智墒齐力持股99%,天眼查“疑似实际控制人”口径显示其直接+间接合计比例约93.85%——两轮引入平台股东后,创始人控制权几乎未被稀释( 天眼查|疑似实际控制人 )。两家合伙企业的其他合伙人是否代表投资人或员工持股,其结构未在当前可见档案中展开。 2025-11-19 公司注册成立,张源100%持股 2025-12 第一代时空知识图谱STKG在LoCoMo、LongMemEval两项测试拿到SOTA( 36氪 ) 2026-01 开放内测(早期市场报道口径,产品名为OmniMemory, 今日头条早期报道 ) 2026-05 联合英伟达、港科大、港中文发布并开源MEMLENS,获Hugging Face AI领域Daily Paper前三( 36氪 ) 2026-06-11 智熵佳源以30%入股,企业类型由自然人独资变更为有限责任公司( 天眼查 ) 2026-06 第二代仿生记忆架构MemAura上线,提供ADK与API( 36氪 ) 2026-07-03 智墒齐力以15%入股,张源直接持股降至55%( 天眼查 ) 2026-07-28前后 数千万元种子轮消息落地,投资方口径为“深圳一线基金+产业资本”( 天眼查|融资历史 、 DeepTech深科技访谈 ) 创始人兼CEO张源毕业于北京大学,电子与经济双学科背景,曾在自动驾驶公司任COO,并有创投与具身智能经历;团队平均年龄约26岁,核心成员来自阿里达摩院、腾讯、商汤、港中文、港中深、北大、西交大、KIT、复旦等( 36氪 )。 三、生意:卖记忆API,赌主动智能 目前的主产品是2026年6月上线的MemAura记忆基座,按API调用量加场景授权组合收费,客户集中在出货量较大的陪伴硬件(如陪伴机器人)与垂类Agent(AI客服、数字员工)。公司自述的性能口径:输入侧Token综合消耗降低40%—49%,记忆检索延迟控制在400毫秒以内,端到端首次回答1秒以内,综合准确率80%以上( 36氪 )。 技术三代演进(36氪口径) 第一代 STKG :时空知识图谱,物理层放时间空间、感知层放多模态信息、认知层做前向推理,Benchmark拿到SOTA,但客户更在意延迟与Token支出。 第二代 MemAura :仿生记忆,事件识别→编码→隐私分区三步,配冷热存储;对比传统线上客服约10秒、陪伴场景约2秒的延迟,宣称做到400毫秒内。 第三代 E2P :Embedding-to-Prefix加Transformer微调,目前处于实验室阶段。 竞争格局:空白还是低估? 张源称公司是“国内唯一做多模态长记忆”,多模态记忆是“万亿级赛道”,估值最高的公司不到20亿元、竞争不激烈( 36氪 )。 对照面:海外开源记忆项目Mem0、MemGPT/Letta、MemOS等已具规模,评测中Mem0、MemOS被归入“纯文本记忆Agent”阵营( Agent创世纪 );张源认为这类向量原生/GraphRAG方案缺关联建模、本质是“外挂向量库”,只能应对一问一答( 36氪 )。 口径提醒:更早的市场报道(2026年2月)以“OmniMemory”为产品名,称其在LoCoMo拿下82.5%综合准确率、检索延迟压到2秒以内( 今日头条早期报道 )——与36氪报道的MemAura口径(400毫秒以内)存在明显差异,是否同一产品线、指标如何统一,公司未公开说明。本文性能数据均为公司或媒体报道自述口径,尚无第三方复测。 四、核心争议:独立记忆层会被基模“吸收”吗 基模阵营的压力 DeepSeek V4已把上下文窗口做到1M( 创始人访谈口径 )。长上下文加KV cache持续优化,“塞得下”本身就在削弱“外挂记忆”的刚需叙事;一旦头部基模把记忆能力内建,第三方记忆层的生态位会被直接压缩。 市场对“记忆层独立”的定价也偏低:按张源自己的说法,赛道估值最高公司不到20亿元。 记忆阵营的论证 记忆孤岛:用户在不同厂商基模间切换,记忆无法互通;跨session、跨任务对话难以衔接;Transformer架构存在持续时序错乱,大模型本身不理解时间( 36氪 )。 MEMLENS的数据说:基模全量塞窗在长上下文下更差、更爱编——所以跨模态检索、证据组织和状态更新该由记忆层承接( 36氪 )。 必须点名的立场风险: MEMLENS由记忆赛道玩家牵头发布,结论天然服务于“记忆层必须独立存在”的商业叙事。所谓“首个多模态长记忆基准”的空白,正是被发布方定义出来的——现有基准MemoryBank、LoCoMo、MM-NIAH、LongMemEval等在多模态覆盖、标准长度控制与同台对比上各有短板( Agent创世纪 )。“Hugging Face Daily Paper前三”是流量指标而非学术背书;Benchmark能否被第三方复现,才是这场叙事成立与否的关键。 五、风险观察 公司层面 :成立仅8个月、注册资本50万元且全部认缴、团队平均年龄约26岁,处于典型早期阶段。当前可见风险模块仅记录两条“投资人变更”提示(2026-06-11、2026-07-03),属预警提醒类而非负面记录( 天眼查|企业天眼风险 );在本次已核验的当前可见范围内,未发现诉讼、行政处罚或经营异常条目——这只说明档案未收录,不构成对缺失项的否定。 商业层面 :张源承认“大部分客户还聚焦在纯文本或文本加语音”,多模态付费客户尚未规模化;性能指标缺第三方复测;以API调用量加场景授权收费的模式,付费意愿与留存数据尚无公开验证。 行业层面 :基模长上下文迭代速度、开源记忆框架的快速演进、具身智能落地节奏(张源称家庭机器人落地前期记忆需求会暴增, 36氪 )三者共同决定叙事兑现时间。时间窗口是这家公司最大的变量,也是最大的赌注。 六、下一步验证什么 种子轮具体投资方与金额 ——目前只有“数千万元、深圳一线基金+产业资本”口径,未点名。 MEMLENS的第三方复现 ——关注论文是否进入正式会议评审、是否有独立团队跑通同套数据。 MemAura的付费客户与调用量 ——陪伴硬件出货量、客服场景续费数据是商业模式成色的试金石。 第三代E2P的商用时间表 ——实验室里的“近似持续学习”能否产品化。 大模型长上下文军备竞赛节奏 ——1M窗口之后,记忆层的独立价值是被强化还是被压缩。 来源 1. 36氪|国内唯一做多模态长记忆的公司,融资数千万,押注主动智能 2. DeepTech深科技|丘脑智能完成数千万元种子轮融资,打造连接模型与用户的多模态长记忆(对话创始人张源) 3. Agent创世纪|谁能让大模型过目不忘?港科大等推出256K长记忆基准MemLens 4. 今日头条(2026-02)|丘脑智能与OmniMemory早期报道 5. 天眼查|丘脑智能科技(深圳)有限公司|工商基础信息 6. 天眼查|股东 7. 天眼查|疑似实际控制人 8. 天眼查|工商变更 9. 天眼查|融资历史 10. 天眼查|企业天眼风险