多模态长记忆公司「丘脑智能」获数千万融资,推原生多模态记忆基座 MemAura
国内唯一专注多模态长记忆的 AI 基础设施公司——丘脑智能,完成数千万元种子轮融资,推出原生多模态记忆基座 MemAura,在 Token 消耗、检索延迟、准确率等核心指标上实现代际跃升,押注 AI 从通用走向个性化,最终抵达主动智能。
国内唯一专注多模态长记忆的 AI 基础设施公司——丘脑智能,完成数千万元种子轮融资,推出原生多模态记忆基座 MemAura,在 Token 消耗、检索延迟、准确率等核心指标上实现代际跃升,押注 AI 从通用走向个性化,最终抵达主动智能。
丘脑智能创立于 2025 年 11 月,创始人兼 CEO 张源毕业于北京大学,电子与经济双学科背景,曾任职自动驾驶公司 COO,兼具创投与具身智能经验。团队平均年龄 26 岁,核心成员来自阿里达摩院、腾讯、商汤、港中文、北大、KIT 等机构。
公司定位极其明确:国内唯一做多模态长记忆的 AI 基础设施公司。不做基模,不做应用,只做让 AI 持续学习、记住用户的中间层。
注:技术迭代从第一代 STKG 时空知识图谱演进至第二代仿生记忆架构 MemAura,第三代 E2P 技术已在实验室验证中。
大多数记忆方案仍停留在纯文本 + 向量检索的范式里——本质上是一个外挂知识库。MemAura 从架构上重新设计:原生多模态,视觉、音频、文本在写入阶段就融合编码,而非先转文本再存储。
抽取 → 压缩 → 摘要 → 存入向量库 → Agent 模式检索;模态缺失(仅文本),跨 session 断裂,成本高昂。
事件识别 → 多模态编码 → 隐私分区 → 冷热分层存储;模仿人类海马体与皮质层协作机制,延迟骤降。
数据不会说谎。
注:传统客服场景延迟约 10s,陪伴场景约 2s,MemAura 将延迟压缩至 400ms 以内,且 Token 支出大幅降低。
值得留意的是冷热存储策略:高频访问的记忆采用热存储快速检索,低频数据冷存储节约资源。这不是简单的缓存,而是基于访问频率 + 时间衰减的动态分级,在保证核心数据实时可用的同时控制成本。
丘脑智能在两项权威记忆评测中拿下第一:LoCoMo(推理与时序)和 LongMemEval(交互与偏好),均获 SOTA。但更值得关注的是他们联合英伟达、港科大、港中文在 2026 年 5 月发布的 MEMLENS——全球首个多模态长记忆 Benchmark。
注:MEMLENS 将 27 个视觉语言大模型与 7 个 Memory Agent 放在同一套多模态数据下,分 4 档上下文长度(32K–256K)进行对照实验,已获 Hugging Face Daily Paper 前三。
MEMLENS 带来了三个反直觉的发现:
这是张源在面对投资人时被问得最多的问题:「基模会不会自己把记忆做了?」她的回答非常坚定:
「记忆层一定会作为独立的基础设施长期存在。不同基模的基因与训练语料各有差异,用户不断在几家模型之间切换,记忆孤岛问题长期存在。AI 从通用走向个性化,缺少一个能持续学习、记住用户的中间层。以用户为中心的第三方记忆层,必然独立于基模。」
她进一步拆解了 Memory 的本质:核心不是存储,而是决策。
传统数据库早已能存储,AI 记忆的真正价值在于做出一系列判断:是否写入、哪部分写入、召回什么、何时主动召回。基于此,Memory 承载两大价值:
基模上限到 AI 实际触达的上限之间,存在一个关键中间层——个性化的数据闭环。Memory 就是这个闭环。
AI 的落脚点始终在人身上。主动智能的本质是决策——在充分理解用户数据的基础上,决定何时、如何、发起什么交互。
一个诚实的注脚:
目前大部分 Memory 企业还在用 GraphRAG 或向量原生方案,本质上仍是外挂知识库,只能应对简单一问一答。真正的记忆需要追踪动态变化的时间线与用户意图,不断更新调整。MemAura 的仿生架构是目前业内少数从底层重新设计的产品。
主动智能不会率先出现在基模厂商,而会出现在做 Memory 的公司——因为真正的个性化数据闭环,不在模型参数里,而在持续学习、动态更新的记忆层里。
MemAura 已以 ADK + API 形式提供服务,覆盖陪伴机器人、AI 客服、数字员工等场景。客户可按需选择不同层级的记忆能力,按 API 调用量及场景授权组合付费。
了解 MemAura → 企业合作注:本文不构成投资建议,产品体验请以官方信息为准。