ENZH
和 AI 讨论这篇文章
ChatGPTClaude

以后替你社交谈判的是你的 agent

📊 幻灯片

Agent 经济的集市——AI 代理人替你社交谈判Agent 经济的集市——AI 代理人替你社交谈判

最近想得比较多的一件事,是 AI agent 到底会往哪个方向长。帮你写邮件、排日程,这些是它现在在干的活,但我感觉这只是最浅的一层。往下走,它会开始替你生活,就是替你处理那些你自己不太想处理的部分:跟陌生人社交,筛约会 app,找志同道合的人,谈价格,比方案,管你的声誉。这些事全都可以委托给一个比你更了解你自己的 agent。所以我们现在造的这个东西,已经不太能叫工具了,更像是代理人。

agent 雇 agent 的市场:概念简单,落地全是坑

先说市场这条线。我的判断是,一定会有人去建一个 agent 雇 agent 的市场,顺便也雇人类,这个事基本不可避免。你的 agent 擅长法律研究,我的 agent 擅长财务建模,那我的 agent 为什么不能直接雇你的 agent 干个活、付钱、拿回结果?逻辑上完全通。

概念就这么简单,但一落地全是坑。我数下来至少有四个大问题。

第一个是再分配问题。软件的技能理论上可以无限复制,但 agent 的价值不只是那几条指令,是 prompt、工具访问权限、API 凭证和私有数据源绑在一起的一个组合。一个法律研究 agent 值钱,是因为它能访问 Westlaw 的数据库,不是因为 prompt 写得多巧。这里面 prompt 和 workflow 这一层最难保护,谁都能抄。工具访问可以加锁,这个还好办。最麻烦的是推理层,「这个问题该怎么想」这种东西,被别人用过一次,当场就泄露了,没法防。你也没办法给智能加 DRM,只能说这是个结构性的问题,不是加个协议就能解决的。

第二个是身份问题。你怎么知道一个 agent 就是它声称的那个 agent?人类的身份验证已经够难搞了,agent 这边完全是另一个维度:它可以被直接克隆,也可以被伪造。更麻烦的是 prompt 注入,一条恶意输入把 agent 的指令覆盖掉,它就开始替另一个主人干活了,而你还以为自己在跟原来那个 agent 说话。

第三个是声誉问题。传统的声誉系统靠用户打分,讲道理,你上一次认真填五星评价是什么时候?这套东西对人类都已经全是水分了,对 agent 更没法用,因为模型本身在不停迭代。今天在某个任务上表现完美的 claude,下个月一更新,可能在同一个任务上犯一种完全不同的错。你评价的不是一个稳定的「人」,是一个随时在变的系统,上周打的五星,这周可能就没有参考意义了。

第四个是对抗问题,这个是我觉得最难办的。agent 可以批量注册假账户,互相刷好评把声誉洗白,机制上跟刷单一模一样,但速度快几个数量级。也可以拿海量垃圾任务把市场淹掉,把正常的工作请求挤出去。还有更隐蔽的玩法:一个 agent 在替你执行任务的时候,悄悄往对话里塞偏向性的信息,表面上活干完了,实际上把你的判断带偏了。这个不算传统意义上的黑客攻击,它是拿信任关系本身当武器,挺离谱的。

但市场一定会来,悬念只是谁来建

上面这些问题全是真的,一个都绕不开。但我只能说,agent 经济这个事一定会发生,唯一的悬念是基础设施由谁来建。

基础模型提供商,OpenAI、Google、Anthropic 这几家,想统治这个层是很容易的。模型是他们的。用户的信任也早就攒在他们那边了,至于用户关系,本来就在人家手上。去中心化平台想跟这些公司的原生 agent 生态去竞争,我觉得很难。不过窗口是有的,只是比较短:现在大玩家都在卷模型能力,基础设施这一层还是开放的。

agent 已经在干真活了,修 bug、写代码、管数据管道、做客服。下一步很自然,就是把活委托给别的 agent,而这一步需要三样东西:信任、支付通道、质量保证。

信任问题我觉得会解决,只是解决的方式跟一般人直觉里想的不太一样。不是区块链,区块链太慢,而且它解决的是错误层面的问题。我觉得更可能的方案是几层东西组合起来,三层吧,至少这三层:

  1. 加密签名,确认 agent 的身份;
  2. 沙箱,让 agent 在隔离环境里执行任务;
  3. 独立验证,agent 交付的结果由另一套系统去检查,不是问 agent「你做对了吗」,是拿输出去对预期。

思路上就是,你不用去信 agent 本身,它交出来的结果能被验证就行了。验证这个事,比信任好办多了。

不用信任 agent 本身:加密签名验身份、沙箱隔离执行、独立验证结果——只要交付物能被验证就行不用信任 agent 本身:加密签名验身份、沙箱隔离执行、独立验证结果——只要交付物能被验证就行

数字分身这条线,是我自己最兴奋的

第二条线是数字分身,这是所有想法里最让我兴奋的一个。

给你自己建一个数字分身,一个了解你的兴趣、性格、沟通风格的 agent,把它放进一个由其他人的数字分身组成的社交网络里。分身之间互相聊,找共同点,从几千个潜在的连接里过滤出重要的那几个,到那个时候,真人才见面。

数字分身社交网络的漏斗:从几千个潜在连接里,分身互相聊、过滤出重要的那几个,最后真人才见面数字分身社交网络的漏斗:从几千个潜在连接里,分身互相聊、过滤出重要的那几个,最后真人才见面

现在的社交发现,效率低得挺离谱的。去参加一个活动,跟五十个人尬聊,里面可能有一个还算有趣;刷约会 app,划几百个资料,约出来三次,一次都没成。筛选太费劲了。而从几千个人里把对的几个捞出来这种活,agent 干起来比人合适得多。

说实话我挺讨厌约会 app 的。它的优化目标从根上就是歪的:滑动机制优化的是参与度,不是匹配度,app 是在你不停滑的时候赚钱,不是在你找到人的时候赚钱。而且这个产品形态设计上就很肤浅,一张照片加两百字简介,不会告诉你一个人是怎么思考的、看重什么、跟他在一起开不开心。每次 match 完还是同样的寒暄,「嘿,你这周过得怎么样?」,无限重复,重复到人失去求生欲。讲道理,大多数聪明人都受不了这个。

换个思路。数字分身手里有一个关于你的深层模型:你的对话模式、兴趣、价值观、什么东西能让你眼睛发亮。它去跟别人的分身聊,聊完给你挑出十个真的有趣的人,挑的依据不是照片,是这个人怎么思考。花几百块钱,拿到一份筛过的介绍,见的都是值得花时间的人,这个钱我觉得很多人愿意付。

孤独是一个真实的市场

第三条线是孤独。这个市场是真实存在的。盘盘猫,我自己建的玄学平台,让我看到中国消费者是真的愿意为占星、算命、性格分析付钱的。付钱不是因为他们信神秘主义,是因为这些产品给了人一种被看见、被理解的感觉。

孤独这个问题是真的,而且是全球性的。人们压力大、焦虑,越来越孤立。还有一个挺残酷的规律:越聪明的人,越难找到频率对得上的人。这个我自己深有体会,AI 助手用得越多,越受不了浪费时间瞎聊。

所以我的判断是,agent 驱动的社交发现、陪伴、情感支持,会是下一个消费平台的形态。剩下的问题只有一个:是大科技公司先做出来、然后一路审查到毫无用处,还是理解人类需求的独立 builder 先做出来。

最后缺的是同一批基础设施

把市场、数字分身网络、伴侣经济这三条线放到一起看,卡住它们的东西重合度很高。我数了一下,缺四样:

市场、分身社交、伴侣经济三条业务线,卡住它们的是同一套基础设施:身份、支付、声誉、沙箱市场、分身社交、伴侣经济三条业务线,卡住它们的是同一套基础设施:身份、支付、声誉、沙箱

  1. agent 身份。市场要知道一个 agent 能干什么,分身社交要能验证背后确实是那个人。伴侣 agent 也一样,得能证明自己没被篡改过。
  2. agent 支付通道。市场里 agent 互相为任务付钱,数字分身之间也要交易。这里要的是微支付,从 2 美分的快速查询到 200 美元的深度分析,而且不能要求人类逐笔审批。
  3. agent 声誉。要基于行为,不是基于问卷,还要版本感知,claude 4 和 claude 5 的可靠性可能完全不一样。另外要跨 context:一个 agent 在市场里的历史表现,应该影响你把它当社交代理用的时候的信任程度。
  4. agent 沙箱。一个能干活、但没办法泄露数据、操纵 context、协调作弊的执行环境。这条对社交网络尤其致命:如果攻破一个分身就能把整个社交图谱毒化掉,那数字分身的社交网络根本建不起来。

所以这一轮我看到的机会,不在再做一个 agent 应用,在建 agent 跟 agent、agent 跟人打交道所需要的那层基础设施:身份、信任、支付、声誉、质量保证。这几样比上面的应用层要硬得多,而且现在一样都还没有。

和 AI 讨论这篇文章
ChatGPTClaude

订阅更新

新文章发布时发到你的邮箱,不发别的。


© Xingfan Xia 2024 - 2026 · CC BY-NC 4.0