ENZH
和 AI 讨论这篇文章
ChatGPTClaude

以后替你社交谈判的是你的 agent

Agent 经济的集市,AI 代理人替你社交谈判Agent 经济的集市,AI 代理人替你社交谈判

最近想得比较多的一件事,是 AI agent 到底会往哪个方向长。帮你写邮件、排日程,这些是它现在在干的活,但我感觉这只是最浅的一层。再往下走,它会开始替你生活,替你处理那些你自己不太想管的事,比如跟陌生人社交,筛约会 app,找志同道合的人,谈价格,比方案,管你的声誉。这些事全都可以交给一个比你还了解你自己的 agent。所以我们现在造的这个东西,已经不太能叫工具了,更像是代理人。

agent 雇 agent 的市场:概念简单,落地全是坑

先说市场这条线。我觉得一定会有人去建一个 agent 雇 agent 的市场,顺便也雇人类,这个事基本躲不掉。你的 agent 擅长法律研究,我的 agent 擅长财务建模,那我的 agent 为什么不能直接雇你的 agent 干个活、付钱、拿回结果?逻辑上完全说得通。

概念就这么简单,但一落地全是坑。我数下来至少有四个大问题。

第一个是再分配问题。软件的技能理论上可以无限复制,但 agent 值钱,靠的是 prompt、工具访问权限、API 凭证和私有数据源绑在一起,光有那几条指令不算数。一个法律研究 agent 值钱,是因为它能访问 Westlaw 的数据库,prompt 写得多巧没那么要紧。这里面 prompt 和 workflow 这一层最难保护,谁都能抄。工具访问可以加锁,这个还好办。最麻烦的是推理层,「这个问题该怎么想」这种东西,别人用过一次就当场泄露了,没法防。你也没办法给智能加 DRM,只能说这个问题出在结构上,加个协议解决不了。

第二个是身份问题。你怎么知道一个 agent 就是它自称的那个 agent?人的身份验证已经够难搞了,agent 还要难得多,因为它可以被直接克隆,也可以被伪造。更麻烦的是 prompt 注入,一条恶意输入把 agent 的指令覆盖掉,它就开始替另一个主人干活了,而你还以为自己在跟原来那个 agent 说话。

第三个是声誉问题。传统的声誉系统靠用户打分,讲道理,你上一次认真填五星评价是什么时候?这套东西用在人身上都已经全是水分了,用在 agent 身上更不行,因为模型本身一直在迭代。今天某个任务做得完美的 claude,下个月一更新,同一个任务上可能犯一种完全不同的错。你评价的是一个随时在变的系统,没法把它当成一个稳定的「人」来看,上周打的五星,这周可能就没什么参考价值了。

第四个是对抗问题,这个是我觉得最难办的。agent 可以批量注册假账户,互相刷好评把声誉洗白,跟刷单是一个路数,只是快了几个数量级。它也可以拿海量垃圾任务把市场淹掉,把正常的工作请求挤出去。还有更隐蔽的玩法,一个 agent 替你干活的时候,悄悄往对话里塞带偏向的信息,表面上活干完了,其实把你的判断带偏了。这跟一般说的黑客攻击不太一样,它是拿信任本身当武器,挺离谱的。

但市场一定会来,悬念只是谁来建

上面这些问题全是真的,一个都绕不开。但我只能说,agent 经济这个事一定会发生,唯一说不准的是基础设施由谁来建。

基础模型提供商,就是 OpenAI、Google、Anthropic 这几家,想把这一层拿下很容易。模型是他们的,用户的信任也早就攒在他们那边了,用户关系更是本来就在人家手上。去中心化平台想跟这几家自己的 agent 生态抢,我觉得很难。但窗口还是有的,只是不长。现在大玩家都在卷模型能力,基础设施这一层还空着。

agent 已经在干真活了,修 bug、写代码、管数据管道、做客服。下一步很自然,就是把活转手交给别的 agent。要走这一步,得先有三样东西:信任、支付通道、质量保证。

信任问题我觉得会解决,只是解决的办法跟一般人直觉里想的不太一样。不是区块链,区块链太慢,而且它解决的不是这一层的问题。我觉得更可能是几层东西叠起来,三层吧,至少这三层:

  1. 加密签名,确认 agent 的身份;
  2. 沙箱,让 agent 在隔离环境里执行任务;
  3. 独立验证,agent 交上来的结果由另一套系统去检查,不用问 agent「你做对了吗」,拿输出去对预期就行。

你其实用不着去信 agent 本身,它交出来的结果能被验证就行。验证可比信任好办多了。

不用信任 agent 本身:加密签名验身份、沙箱隔离执行、独立验证结果,只要交付物能被验证就行不用信任 agent 本身:加密签名验身份、沙箱隔离执行、独立验证结果,只要交付物能被验证就行

数字分身这条线,是我自己最兴奋的

第二条线是数字分身,这是所有想法里最让我兴奋的一个。就是给你自己建一个数字分身,一个了解你的兴趣、性格和沟通风格的 agent,然后把它放进一个社交网络,里面全是别人的数字分身。分身之间互相聊,找共同点,从几千个可能的连接里筛出重要的那几个,到这一步,真人才见面。

数字分身社交网络的漏斗:从几千个潜在连接里,分身互相聊、过滤出重要的那几个,最后真人才见面数字分身社交网络的漏斗:从几千个潜在连接里,分身互相聊、过滤出重要的那几个,最后真人才见面

现在想认识新的人,效率低得挺离谱。去参加一个活动,跟五十个人尬聊,里面可能有一个还算有趣;刷约会 app,划几百个资料,约出来三次,一次都没成。筛人太费劲了。可从几千个人里把对的几个捞出来,这种活 agent 干起来比人合适得多。

说实话我挺讨厌约会 app 的,因为它从根上就在往歪的方向使劲。滑动机制追求的是你多滑,跟配得准不准基本没关系。你不停滑,app 就一直赚钱,等你真找到人了,它反而赚不到了。而且这个产品本身就设计得很肤浅,一张照片加两百字简介,看不出一个人是怎么想问题的、看重什么、跟他在一起开不开心。每次 match 完还是同样的寒暄,「嘿,你这周过得怎么样?」,无限重复,重复到人失去求生欲。讲道理,大多数聪明人都受不了这个。

换个思路。数字分身对你了解得很深,知道你平时怎么聊天,有什么兴趣和价值观,什么东西能让你眼睛发亮。它去跟别人的分身聊,聊完给你挑出十个真的有趣的人,不看照片,看这个人怎么想问题。花几百块钱,拿到一份筛过的介绍,见的都是值得花时间的人,这个钱我觉得很多人愿意付。

孤独是一个真实的市场

第三条线是孤独。这个市场是实实在在的。我自己做了个玄学平台叫盘盘猫,从它身上我看到,中国消费者是真的愿意为占星、算命、性格分析付钱。他们付钱图的是被看见、被理解的感觉,信不信神秘主义倒在其次。

孤独这个问题是真的,而且全世界都有。大家压力大、焦虑,越来越孤立。还有一个挺残酷的规律,越聪明的人,越难找到频率对得上的人。这个我自己深有体会,AI 助手用得越多,越受不了浪费时间瞎聊。

所以我觉得下一个消费平台会是这个样子,靠 agent 帮你认识人、陪着你、给你情感支持。剩下的问题只有一个,谁先做出来。是大科技公司先做出来,然后一路审查到一点用都没有,还是懂人到底要什么的独立 builder 先做出来。

最后缺的是同一批基础设施

市场、数字分身网络、伴侣经济,这三条线各自卡在哪,我对了一下,基本是同一批东西。数下来缺四样:

市场、分身社交、伴侣经济三条业务线,卡住它们的是同一套基础设施:身份、支付、声誉、沙箱市场、分身社交、伴侣经济三条业务线,卡住它们的是同一套基础设施:身份、支付、声誉、沙箱

  1. agent 身份。市场要知道一个 agent 能干什么,分身社交要能验证背后确实是那个人。伴侣 agent 也一样,得能证明自己没被篡改过。
  2. agent 支付通道。市场里 agent 互相为任务付钱,数字分身之间也要交易。这里要的是微支付,从 2 美分的快速查询到 200 美元的深度分析,而且不能每一笔都等人来批。
  3. agent 声誉。要看它实际干了什么,光靠问卷打分不够。还得分清版本,因为 claude 4 和 claude 5 的可靠性可能完全不一样。另外还要能跨 context 用,一个 agent 以前在市场里表现怎么样,应该影响你把它当社交代理用的时候有多信它。
  4. agent 沙箱。要有一个执行环境,agent 在里面能干活,但没法泄露数据、操纵 context,也没法串通作弊。这一条对社交网络尤其要命,如果攻破一个分身就能把整张社交图谱毒化掉,那数字分身的社交网络根本建不起来。

所以这一轮我看到的机会,不是再做一个 agent 应用,是去建那层基础设施,让 agent 和 agent、agent 和人能打交道,也就是身份、信任、支付、声誉、质量保证。这几样比上面的应用层要硬得多,而且现在一样都还没有。

和 AI 讨论这篇文章
ChatGPTClaude

订阅更新

新文章发布时发到你的邮箱,不发别的。


© Xingfan Xia 2024 - 2026 · CC BY-NC 4.0