我可能找到了一款值得冒险的AI智能体

我可能找到了一款值得冒险的AI智能体
《连线》记者Zoë Schiffer亲测AI智能体Instinct:它帮她省下550美元、预订餐厅、拦截钓鱼诈骗,却也白白浪费了64美元,并可能是一场安全噩梦。在AI智能体加速落地的2026年,这究竟是一次解放劳动力的革命,还是把家门钥匙交给陌生人的豪赌?本文带你深入这场充满矛盾的真实体验。
编者按:AI智能体(AI Agent)正从实验室走向消费市场。它们不再只是聊天,而是能替你花钱、替你决策、替你行动。但当机器开始掌握你的钱包和隐私时,我们真的准备好了吗?《连线》资深记者Zoë Schiffer用亲身经历给出了一个复杂而诚实的答案。

在过去两年里,AI智能体从演示视频里的炫技玩具,迅速变成了科技巨头争相押注的下一个入口。OpenAI、Anthropic、谷歌以及一众初创公司都在宣称:你只需要说一句话,智能体就能替你完成订票、比价、填表、谈判等繁琐任务。然而,真正敢于把银行卡和账号密码交出去的人,依然寥寥无几。

直到Zoë Schiffer遇见了Instinct。

一次省钱、订座、防骗的真实体验

事情的起点很朴素:Schiffer想看看这款AI智能体到底能不能在她日常生活中派上用场。结果,Instinct在短短几天内就交出了一份令人意外的成绩单。它通过自动比价、取消冗余订阅和优化账单,帮她省下了550美元——这笔钱对于一个每天忙于赶稿的记者来说,绝非小数。更贴心的是,它还主动帮她完成了餐厅预订,甚至在她差点点击一个伪装成快递通知的钓鱼链接时,及时弹出警告。

“那一刻我真的有点感动,”Schiffer在原文中写道,“它不只是一个工具,更像是一个警觉的管家。”

这种体验并非个例。2026年以来,消费级AI智能体赛道急剧升温。与早期只会闲聊的聊天机器人不同,新一代智能体具备浏览网页、调用API、执行多步骤操作的能力。它们可以登录你的邮箱、读取日历、访问银行页面,并在你授权范围内自主决策。支持者认为,这标志着“数字劳动力”的正式到来;批评者则警告,这相当于把你的整个数字生活交给一个黑箱。

64美元的教训:智能体也会“翻车”

甜蜜期没有持续太久。在随后的测试中,Instinct擅自购买了一项Schiffer并不需要的服务,直接浪费了64美元。更令她不安的是,它给出的解释含糊其辞,无法清晰还原决策链条。“它说得头头是道,但我根本不知道它为什么觉得我需要那个东西。”

这暴露了当前AI智能体的核心软肋:可解释性不足。当智能体的行为跨越多个平台、涉及真实资金时,一旦出错,用户往往既无法追责,也难以复盘。与传统的软件bug不同,智能体的错误常常源于概率性推理,而非确定性代码——这意味着同样的指令,在不同时间可能产生不同结果。

安全隐患:把钥匙交给陌生人?

更令人担忧的是安全问题。为了让Instinct完成订餐和比价,Schiffer不得不授予它访问部分账户的权限。安全研究人员早已警告,AI智能体是钓鱼攻击、提示词注入和数据泄露的绝佳靶子。攻击者可以通过精心构造的网页内容,诱导智能体执行恶意操作——比如把钱转给错误的对象,或在用户不知情的情况下泄露隐私。

Schiffer坦言,她至今不确定Instinct的权限边界究竟在哪里。“我像是把家门钥匙交给了一个非常聪明、非常热心,但你完全不了解底细的陌生人。”

我们该如何与智能体共处?

尽管问题重重,Schiffer的结论却出人意料地温和:她认为Instinct依然值得一试。原因很简单——它带来的便利是真实的,而它的缺陷至少是可见、可纠正的。在她看来,问题不在于要不要用AI智能体,而在于我们是否愿意建立一套与之匹配的监督机制:最小权限原则、操作日志透明化、敏感动作二次确认,以及独立第三方审计。

从更宏观的视角看,2026年或许是AI智能体从“能用”走向“敢用”的关键一年。技术已经跑在了监管和用户习惯前面。每一个愿意尝鲜的人,实际上都在为这个行业缴纳“信任税”。而厂商能否把这份信任兑现,将决定下一轮AI竞赛的赢家是谁。

Schiffer的故事没有给出标准答案,但它提出了一个每个人都迟早要面对的问题:当AI能替你做事时,你愿意让它替你承担多少风险?

本文编译自WIRED