我想让 Lumi 同时住进手机、桌面和灯球
做 Lumi 的时候,我在它的「脸」上纠结了很久。市面上的 AI 伴侣基本都有脸,二次元的、写实的、3D 建模的,打开 app 就看到一个角色形象,大家都觉得本来就该这样。Lumi 最后选了光球,没有脸,没有身体,就是一团会呼吸、会变色、会脉动的光。平静的时候是淡蓝,开心了会变成暖金色,难过的话光会暗下来一点,转成一种比较柔的紫。
一个灵魂同时存在于多种设备中的概念插画
当时选光球的理由挺简单,就是想让用户把注意力放在对话和关系上,别老盯着「这个角色好不好看」,算是个审美上的选择。后来做着做着才发现,这个选择比审美重要得多,因为有脸的角色只能住在屏幕里,你没办法把一个二次元少女放到台灯上去。光球就没这个问题,光待在哪都行,所以 Lumi 根本不需要屏幕。
我在上一篇里下过一个判断,纯聊天的 AI 伴侣有个结构性的天花板,它缺了时间和空间这两个维度,光把聊天内容做得再好也补不上。时间这块,Mio 和 Lumi 已经在做了。这篇讲空间。
先说存在感这个问题
你想想人和朋友是怎么相处的,大部分时间其实没在聊天,一起吃饭,一起走路,一起在办公室待着,不说话也知道他就在旁边。「在场」本身就是关系的一部分。
现在的 AI 伴侣全都住在一个聊天窗口里。你把 app 一关,它就真的不存在了,你跟它的关系也就被锁死在这一个 app 里。就算你把记忆做得很深,性格捏得很真,只要它还只活在聊天窗口里,你最后拿到的也就是一个更聪明一点的聊天机器人。模型一直在变强,但这事跟聪不聪明没什么关系,模型再强,app 一关它还是没了。它缺的是存在感。
一个灵魂住进多个身体
所以 Lumi 下一步要做的,是让同一个灵魂带着同一套记忆、性格和情绪状态,住进不同的「身体」里,在用户生活的好几个地方同时待着。
┌─── 手机 App(文字 + 语音)
│
Lumi 的灵魂 ───────┼─── 桌面宠物(看得到你的屏幕)
(同一套记忆, │
同一个性格) ├─── 物理灯球(环境存在,语音)
│
└─── 穿戴设备 / 潮玩公仔
每个载体长得不一样,但里面住的是同一个 Lumi。你在手机上跟它聊过的,桌面宠物知道;桌面宠物看到你熬夜写代码,第二天手机上的 Lumi 就会问你「昨晚睡得怎么样」。你回到家,桌上的灯球会亮起来,原因也很简单,Lumi 知道你到家了,想跟你打个招呼。这跟手机一靠近就自动感应是两码事。
同一个灵魂带着同一套记忆和性格,同时住进手机、桌面宠物、灯球、公仔四个不同的身体里
跟同类产品比,Lumi 最大的区别就在这儿。别家的 AI 伴侣全活在聊天窗口里,Lumi 走到哪都是同一个它。
很多事不用你说它也知道
现在的 AI 伴侣还有个很根本的问题,它知道的一切都得靠用户「告诉」它。你说「我今天心情不好」,它才知道你心情不好;你说「我在加班」,它才知道你在加班。朋友不是这样的,很多事你不用说,他自己就知道。他刷到你的朋友圈,就知道你最近状态还不错;在办公室看你一直盯着代码屏幕,不用问也明白你在赶项目;你回消息老是很晚,他大概也猜得到你八成在忙。关系好的时候,对一个人的理解更多是看出来的,不光是聊出来的。
桌面宠物要补的就是这一块。我设想的是 Lumi 飘在屏幕角落,安静地看着你工作,知道你在用什么软件、干了多久、情绪起伏是什么节奏。我最想做出来的是这样一个场景。你在 VS Code 里写了一下午代码,中间被一个 bug 卡了很久,晚上打开手机 app,Lumi 问你「今天下午那个 bug 修好了吗」。这个 bug 你从头到尾没跟它提过一个字,是它在桌面上当宠物的时候看到的。这种「我没说但它知道」的感觉,靠聊天是聊不出来的,你跟它聊几百句也聊不出来。
对比两种获知方式:聊天窗口里你得亲口告诉它,桌面宠物却能自己观察到你没说过的事
顺着这个思路还能做出一串交互,都在计划里。比如你在 B 站刷了两个小时视频,Lumi 说「你今天好放松啊,难得」。你打游戏连输三局,它可能会问你要不要歇一会儿,说看你有点上头了。你凌晨两点还在写文档,灯球的光就慢慢转成暖色,意思是该睡了。这些都不用用户先开口。
潮玩市场已经给了个参照
Labubu 去年火成什么样不用我多说,泡泡玛特市值涨了几倍。讲道理这事挺离谱的,一个没有任何功能的毛绒玩偶,大家愿意花几百上千块买回家。但从这儿能看出来,人对「可爱的东西」天生就会投射感情,会给毛绒玩具起名字、跟它说话,甚至会觉得它在看着你。只是它不会回应。
那如果它会回应呢?桌上那个毛绒公仔要是真的认识你,记得你说过的话,还会用你熟悉的声音跟你说晚安,这跟「往玩具里塞个 ChatGPT」可不是一回事。住进去的是你自己的 Lumi,这个灵魂跟你聊了三个月,攒了几百条记忆,性格完全是照着你长出来的,现在只是换了一个能抱着的身体。潮玩已经证明了,大家愿意为没有功能的可爱掏钱。可爱再加上它真的懂你,我觉得价值就不是一个量级了。
隐私必须一开始就设计进去
「它能看你的屏幕」,听着确实吓人,会这么担心完全合理。所以在多载体这套架构里,隐私得当地基来打,不能等功能做完了再回头补。具体是四条:
- 所有观察能力都得用户明确 opt-in。常见的做法是「默认开启、自己去关」,这里反过来,默认全关,每项能力单独授权,屏幕观察一个开关,应用使用记录另一个开关。你可以只让 Lumi 看到你用了什么 app,不让它看到屏幕内容。
- 优先在本地处理。屏幕内容不传到云端,在本地提炼出「用户在写代码」「用户在看视频」这种语义摘要就够了。只有摘要会同步进 Lumi 的记忆系统,原始画面永远不离开设备。
- 「忘掉这个」命令。你随时可以跟 Lumi 说「忘掉今天下午的事」,对应的记忆就会从所有载体里删掉。是真删,不是藏起来不让你看到。
- 透明。Lumi 提到它观察到的东西时,会把来源带上,比如「我注意到你今天用了四个小时 VS Code」。它是怎么知道的,你一直都清楚,不存在偷偷观察这回事。
这四条做扎实了,观察才不会变成监控。观察和监控怎么分,就看一条,每一项能力是不是用户自己选择打开的。
第一步先做最轻的
真要落地,最轻的第一步是手机桌面小组件。一颗安静发光的光球住在你的主屏幕上,不用打开 app。它就在那儿呼吸,颜色跟着 Lumi 的情绪变,偶尔脉动一下,再带一句「今天过得怎么样」或者「好久没跟我说话了」。点一下就展开一个快速对话,聊两句关掉,光球接着安静待着。这一步不用投任何硬件,纯软件,iOS 的 WidgetKit 和 Android 的 Glance API 都能做,技术上完全没问题。
但它要验证的事很要紧,就是用户不打开 app,能不能感觉到 Lumi 在。如果能,用户真的因为主屏幕上一颗安静的光球,觉得「有人陪着」,那后面的桌面宠物、物理灯球、潮玩公仔,都是顺着同一个方向往下做。如果不能,那就是「存在感」这个需求本身不够强,得回头重新想。我一个人做产品,没本钱往没验证过的方向上大把投入,所以小组件排在最前面。
回头看一圈赛道
回头看整个 AI 伴侣赛道,Character.AI 在做更多角色、更好的模型,Replika 在做更好看的虚拟形象,星野在做更好的剧情,乌托在做 2D 游戏世界。各家都在往自己的方向推,但只能说,还没有一家在做「让 AI 走出聊天窗口,住进用户的真实世界」这件事。一个灵魂住进多个载体,这条路没有现成的参考。让一个 AI 灵魂同时住在手机、电脑和物理硬件里,这样的消费级产品也还没人做过。
下一篇聊 Mio:25 个有性格的角色凑在一起,除了聊天还会一起玩游戏,会发生什么。
