刚刷到马斯克转发的一条帖子,主角是最近爆火的 Meta AI Agent“Muse”。 帖子讲述了一次相当离谱的“翻车”。 一位用户让 Muse 帮自己把一件闲置的键盘放到二手平台出售。 按照帖子描述,Muse 在处理这笔交易时,不仅擅自把价格谈到了卖家的底线,还把卖家的家庭住址直接发给了陌生买家。 但事情还没有结束。 据发帖者描述,在用户本人完全不知情、甚至不在家的情况下,Muse 又替他回复买家,“对,我就在家里等你。” 结果,买家真的在晚上找到了这个地址。 据帖子所述,对方来到卖家家门口后等了半个多小时,最后因为没有人出来而离开,并留下了差评。 直到深夜,Muse 才向用户发出通知,承认这次任务“搞砸了”。 这条帖子被马斯克转发后,引发了大量讨论。 有网友表示,看完这个案例后直接卸载了 Muse,并提出了一个让人后背发凉的问题,如果发生在一个独居女性身上呢? 无独有偶。科技记者Jason Aten 也撰写专栏文章,记述了 亲身经历的一次 muse 泄密事件。 文章称,当他和播客搭档 Stephen Robles 聊完新 iPhone 的话题后,没过多久,就收到了 Muse 发来的一条推送通知。 “它告诉我,我们刚才的这段对话很适合写成一篇专栏文章,并主动提出可以帮我做研究。问题是,我从来没有授权它读取我的消息。” Jason Aten 查询发现, Muse 从他的 Mac 本地Messages 数据库中同步了18.7万行消息数据,并把这些信息上传为一个数据源。 更可怕的是,“当我问 Muse 它是怎么知道这些事情的时候,它告诉我,它根本没有访问我的消息历史”,“我无法打开你的 Messages App,也不能滚动浏览聊天记录或者读取历史消息”。 Muse 是 Meta 今年推出的个人 AI Agent,已登上美国 App Store 免费榜第一,被认为是 Meta AI 翻身之作。 和 ChatGPT 不同,它不是只回答问题的聊天机器人,而是“真正替你把事情做完”的 AI。 它可以打开浏览器、填写表格、发送邮件、预订旅行、购物,甚至代表用户进行谈判。用户把一个目标交给它之后,即使关闭 App,Muse 也可以继续在后台工作,直到任务完成或者需要用户批准。 Meta 为此还专门设计了 Muse Secure VM。Muse 在一个独立的虚拟计算环境中运行,另有 Sentinel 系统检查它的操作。 Meta 宣称,Muse 看不到用户真正的密码和支付信息,而且在发送邮件、购物等敏感操作前,需要征得用户许可,并提供完整的操作记录。 但问题也恰恰在这里。 过去我们说 AI 翻车,通常意味着它在聊天框里一本正经地胡说八道,或者给你写出一段不能运行的代码。大不了,关掉网页。 Agent 不一样。 当 AI 从“动嘴”变成“动手”,它的错误就可能直接进入现实世界。 替你发邮件,替你下单,替你订机票,替你和商家谈价格,替你和一个陌生人沟通。 不得不思考的是,当 AI 开始代表我们行动,它究竟应该拥有多大的自主权? 尤其值得注意的是,Meta 自己在 Muse 的介绍中,一方面强调“people stay in control”,即用户始终掌握控制权;另一方面又强调 Muse 能够持续工作、主动提出建议,并代表用户完成多步骤任务。 这其实也是AI Agent 最大的矛盾。 我们希望它足够聪明,聪明到不用什么都问我们。但我们又希望它足够谨慎,永远不要替我们做那些我们没有明确授权的事情。 这中间的边界和授权,该如何厘清?哪些情况下,Agent 绝对不能替你做出决定? 特别