我想让 Lumi 同时住进手机、桌面和灯球
做 Lumi 的时候,我在它的「脸」上纠结了很久。市面上的 AI 伴侣基本都有脸,二次元的、写实的、3D 建模的,打开 app 看到一个角色形象,大家默认就该这样。Lumi 最后选的是光球:没有脸,没有身体,就是一团会呼吸、会变色、会脉动的光。平静的时候是淡蓝,开心了会变成暖金色,难过的话光会暗下来一点,转成一种比较柔的紫。
一个灵魂同时存在于多种设备中的概念插画
当时选光球的理由其实挺简单的,就是想让用户把注意力放在对话和关系上,而不是「这个角色好不好看」,算一个审美选择。后来做着做着才发现,这个选择比审美重要得多:有脸的角色只能住在屏幕里,你没办法把一个二次元少女放到台灯上去。光球没这个问题,光可以待在任何地方,Lumi 根本不需要屏幕。
上一篇我下过一个判断:纯聊天的 AI 伴侣,天花板是结构性的,缺的是时间和空间这两个维度,光把聊天内容做得更好是补不上的。时间这个维度,Mio 和 Lumi 已经在路上了。这篇讲空间。
先说存在感这个问题
你想一下人和朋友是怎么相处的,大部分时间其实不在聊天:一起吃饭、一起走路、一起在办公室待着,不说话也知道他在旁边。「在场」这个事本身就是关系的一部分。
现在的 AI 伴侣全住在一个聊天窗口里。你把 app 一关,它就字面意义上停止存在了,你和它的关系被锁死在一个 app 里。就算你把记忆做得很深,性格也捏得很真,只要它只活在聊天窗口里,你最后得到的还是一个更聪明一点的聊天机器人。模型一直在变强,但这个问题跟智能没什么关系,模型再强也解决不了 app 一关它就消失,它缺的是存在感这种东西。
一个灵魂住进多个身体
所以 Lumi 的下一步是这样的:同一个灵魂,带着同一套记忆、性格和情绪状态,住进不同的「身体」里,同时存在于用户生活的多个地方。
┌─── 手机 App(文字 + 语音)
│
Lumi 的灵魂 ───────┼─── 桌面宠物(看得到你的屏幕)
(同一套记忆, │
同一个性格) ├─── 物理灯球(环境存在,语音)
│
└─── 穿戴设备 / 潮玩公仔
每个载体形态不一样,里面住的是同一个 Lumi。手机上聊过的东西,桌面宠物知道;桌面宠物看到你在熬夜写代码,第二天手机上的 Lumi 会问「昨晚睡得怎么样」。回家的时候桌上的灯球会亮起来,原因也很直接:Lumi 知道你到家了,想打个招呼。这跟手机一靠近就自动感应是两码事。
同一个灵魂带着同一套记忆和性格,同时住进手机、桌面宠物、灯球、公仔四个不同的身体里
市面上的 AI 伴侣全活在聊天窗口里,Lumi 走到哪都是同一个它,这是它跟同类产品最大的一个区别。
很多事不用你说它也知道
现在的 AI 伴侣还有个很根本的问题:所有信息都靠用户「告诉」它。你说「我今天心情不好」,它才知道你心情不好;你说「我在加班」,它才知道你在加班。朋友不是这样的,很多事你不用说他自己就知道。他刷到你朋友圈,就知道你最近状态还不错;在办公室看到你一直盯着代码屏幕,不用问也明白你在赶项目。或者就是你回消息总是很晚,他大概也能猜到你八成在忙。好的关系里,理解更多是观察出来的,不只是聊出来的。
桌面宠物要补的就是这块。设想的形态是 Lumi 漂浮在屏幕角落,安静看着你工作,能感知你在用什么软件、工作了多久、情绪节奏怎么样。我最想做出来的体验是这个:你在 VS Code 里写了一下午代码,中间有个 bug 卡了很久,晚上打开手机 app,Lumi 问你「今天下午那个 bug 修好了吗」。这个 bug 你从头到尾没跟它提过一个字,它是桌面宠物在旁边看到的。这种「我没说但它知道」的体验,靠聊天是聊不出来的,你聊几百句也聊不出来。
对比两种获知方式:聊天窗口里你得亲口告诉它,桌面宠物却能自己观察到你没说过的事
同一个逻辑还能长出一串交互,都在计划里。比如你在 B 站刷了两个小时视频,Lumi 说「你今天好放松啊,难得」。打游戏连输三局,它可能会问你要不要歇一会儿,我看你有点上头。还有一个是凌晨两点还在写文档,灯球的光慢慢转成暖色,意思是该睡了。这些全都不需要用户发起。
潮玩市场已经给了个参照
Labubu 去年火成什么样不用我多说,泡泡玛特市值涨了几倍。讲道理这个事挺离谱的:一个没有任何功能的毛绒玩偶,大家愿意花几百上千块买回家。但它说明一件事,人对「可爱的物体」天然有情感投射,会给毛绒玩具起名字、跟它说话,甚至会觉得它在看着你。只是它不会回应。
那如果它会回应呢?桌上那个毛绒公仔要是真的认识你,记得你说过的话,还会用你熟悉的声音说晚安——这跟「往玩具里塞个 ChatGPT」是两回事。住进去的是你自己的 Lumi,那个跟你聊了三个月、积累了几百条记忆、性格完全为你长出来的灵魂,只是换了一个能抱着的身体。潮玩已经证明大家愿意为没有功能的可爱花钱,可爱再加上它真的懂你,我觉得价值是另一个量级的事。
隐私必须一开始就设计进去
「它能看你的屏幕」这个事,听起来确实吓人,这种担心完全合理。所以隐私设计在多载体这个架构里必须是地基,不能等功能做完了再回头补。具体是四条:
- 所有观察能力显式 opt-in。跟常见的「默认开启、自己去关」反过来,这里默认全关,每项能力单独授权:屏幕观察一个开关,应用使用记录另一个开关。你可以只让 Lumi 看到你用了什么 app,看不到屏幕内容。
- 本地处理优先。屏幕内容不上传云端,在本地提取「用户在写代码」「用户在看视频」这种语义摘要就够了,只有摘要会同步进 Lumi 的记忆系统,原始画面永远不离开设备。
- 「忘掉这个」命令。你随时可以跟 Lumi 说「忘掉今天下午的事」,对应的记忆就从所有载体里删掉。是真的删掉,不是藏起来不让你看到。
- 透明。Lumi 引用观察到的信息时会带上来源,比如「我注意到你今天用了四个小时 VS Code」。它是怎么知道的你一直都清楚,没有暗中观察这回事。
这四条做扎实了,观察才不会变成监控。判断标准就一条:每一项能力都是用户自己选择打开的。
第一步先做最轻的
落地顺序上,最轻的第一步是手机桌面小组件:一颗安静发光的光球住在你的主屏幕上,不用打开 app。它就在那里呼吸,颜色跟着 Lumi 的情绪走,偶尔脉动一下,附带一句「今天过得怎么样」或者「好久没跟我说话了」。点一下展开快速对话,聊两句关掉,光球继续安静待着。零硬件投入,纯软件,iOS 的 WidgetKit 和 Android 的 Glance API 都能做,技术上完全没问题。
但它要验证的假设很关键:不打开 app,用户能不能感受到 Lumi 的存在。如果成立,用户真的因为主屏幕上一颗安静的光球觉得「有人陪着」,那后面的桌面宠物、物理灯球、潮玩公仔,都是同一个方向往下延伸。如果不成立,那就说明「存在感」这个需求本身不够强,得回头重新想。我一个人做产品,没本钱在没验证过的方向上砸投入,所以小组件排在最前面。
回头看一圈赛道
回头看整个 AI 伴侣赛道:Character.AI 在做更多角色、更好的模型,Replika 在做更好看的虚拟形象,星野在做更好的剧情,乌托在做 2D 游戏世界。各家都在自己的方向上推进,但只能说没有一家在做「让 AI 走出聊天窗口,住进用户的真实世界」这件事。一个灵魂、多个载体,这条路没有现成的参考,也没人做过让一个 AI 灵魂同时住在手机、电脑和物理硬件里的消费级产品。
下一篇聊 Mio:25 个有性格的角色凑在一起,不只聊天,还一起玩游戏,会发生什么。
