Memories.ai 打造可穿戴设备与机器人的视觉记忆层

内容管家 新闻 AI领域评论38字数 894阅读2分58秒阅读模式

Memories.ai 打造可穿戴设备与机器人的视觉记忆层

Meta 前工程师创立 Memories.ai:用视觉记忆赋能 AI 穿戴设备与机器人

Shawn Shen 认为,要让 AI 在物理世界取得成功,必须具备“记住所见所闻”的能力。他的公司 Memories.ai 正借助 Nvidia 的 AI 工具,为可穿戴设备和机器人构建视觉记忆基础设施。

与 Nvidia 达成合作

本周一,Memories.ai 在 Nvidia GTC 大会上宣布了与这家芯片巨头的合作。通过这一合作,Memories.ai 将使用 Nvidia 的 Cosmos-Reason 2(推理视觉语言模型)以及 Metropolis(视频搜索与摘要应用),持续开发其视觉记忆技术。

Shen 向 TechCrunch 透露,他与联合创始人兼 CTO Ben Zhou 是在为 Meta Ray-Ban 眼镜开发 AI 系统时萌生了创业想法。他们意识到,如果用户无法回忆录制过的视频数据,这款 AI 眼镜在现实生活中将难以发挥真正价值。

“AI 在数字世界已经做得很好,那物理世界呢?AI 穿戴设备、机器人都需要记忆能力……最终,你需要 AI 拥有视觉记忆。我们相信这个未来。”

从文本记忆到视觉记忆

AI 系统具备记忆能力本身是相对较新的领域。OpenAI 于 2024 年更新了 ChatGPT,使其能够记住过往对话,并在 2025 年进一步优化了这一功能。Elon Musk 的 xAI 和 Google Gemini 也在过去两年推出了各自的记忆工具。

但 Shen 指出,这些进展主要聚焦于文本记忆。文本记忆结构化程度更高、更容易索引,却无法满足主要通过视觉与世界交互的物理 AI 应用需求。

公司发展与融资

Memories.ai 于 2024 年成立,目前已累计融资 1600 万美元:2025 年 7 月完成 800 万美元种子轮,随后完成 800 万美元扩展轮。投资方包括 Susa Ventures 领投,以及 Seedcamp、Fusion Fund、Crane Venture Partners 等机构。

要成功构建视觉记忆层,Shen 表示需要解决两个关键问题:一是构建必要的基础设施,将视频嵌入并索引为可存储和检索的数据格式;二是获取训练模型所需的视频数据。

自研硬件与模型发布

2025 年 7 月,Memories.ai 推出了大型视觉记忆模型(LVMM)。Shen 将其比作更小版本的 Gemini Embedding 2——Google 于本月初发布的多模态索引与检索模型。

在数据采集方面,公司自主研发了名为 LUCI 的硬件设备,由“数据采集员”佩戴录制视频,用于模型训练。Shen 强调他们不打算成为硬件公司或销售这些设备,只是市面上的视频录制设备都侧重高清和续航,无法满足其需求。

近日,公司发布了 LVMM 第二代,并宣布与高通达成合作,计划今年晚些时候在高通处理器上运行该模型。

目前,Memories.ai 已与多家大型可穿戴设备厂商展开合作(具体名称未披露)。尽管当下已有市场需求,Shen 认为穿戴设备和机器人领域的更大机遇还在后面。

“在商业化方面,我们更专注于模型和基础设施,因为我们认为穿戴设备和机器人市场终将到来,只是可能还不是现在。”

延伸阅读

 最后更新:2026-3-18
内容管家

发表评论