发生了什么
The Verge 对 Meta 的 Muse AI 代理进行了实际测试,这是一款旨在自动执行个人任务的虚拟助手。该代理使用可定制的头像,其任务是管理电子邮件通信、购买替换零件、导航帐户降级以及研究消费品。测试显示,虽然代理可以有效地浏览网站和起草通信,但它仍然受到无法执行基于电话的任务以及依赖用户干预来进行最终支付授权的限制。
The Verge 测试了 Meta 的 Muse AI 代理,为其分配了几个现实世界的管理任务。该代理成功地为一家园林绿化公司起草了电子邮件后续内容,尽管该用户指出最初的语气过于“尖刻”。在购物方面,代理能够找到特定的浓缩咖啡机零件和露营装备,尽管在尝试访问该平台时被 Amazon 的服务条款阻止。
在帐户管理方面,代理能够登录安全系统帐户来确定计划降级的必要步骤,但无法完成该过程,因为提供商需要打电话。该代理还展示了通过使用提供的个人信息(包括地址和照片)研究垃圾清除服务并请求报价的能力。
该代理需要高度的用户信任,因为测试人员通过 Stripe 提供了全名、家庭住址、信用卡详细信息以及家庭安全帐户的登录凭据。虽然 Meta 声称这些数据是安全存储的,并且代理的化身无法直接看到,但测试人员指出,将此类敏感信息集中在人工智能工具中存在固有风险。
为什么这很重要
像 Muse 这样的人工智能代理的出现标志着向“代理”工作流程的转变,其中软件在不同平台上执行多步骤操作,而不仅仅是生成文本。这一转变凸显了提高个人生产力的潜力和重大的隐私权衡。用户必须权衡委派管理“鞋子里的石子”任务的便利性与授予人工智能广泛访问个人凭证、财务信息和私人通信的风险。此外,自动化购买的便捷性引发了关于人工智能辅助商业时代消费者消费习惯的问题。
向人工智能代理的转变代表着从被动信息检索到主动任务执行的转变。通过自动化日常生活中的“乏味”方面,这些工具旨在减少管理个人待办事项列表的认知负担。然而,测试人员观察到,这种效率可能会导致“生产力悖论”,节省的时间通常会被用来管理人工智能本身或承担额外的、非必要的承诺。
财务影响是显着的;代理商计算价值和管理购物车的能力使花钱变得“危险而容易”。这在消费者行为中创造了一种新的动态,降低了购买障碍,可能导致冲动或过度投入的消费模式。
对这些代理的依赖需要高水平的数据暴露。为电子邮件、银行和服务帐户提供凭据的必要性造成了个人安全的单点故障,引发了人们对将此类高权限任务委托给第三方人工智能的长期安全性产生疑问。
互动机制:它实际上是如何运作的
以交互方式探索这一发展背后的基础技术。
crm_get_transaction(id='4092').What most distinguishes an AI agent from a basic chatbot?
接下来看什么
要监控的主要开发是基于语音的功能的集成,因为 Muse 的当前版本无法执行电话呼叫,而与服务相关的帐户更改通常需要电话呼叫。此外,业界可能会看到人工智能代理与阻止自动访问的网站之间的摩擦增加,正如代理尝试与 Amazon 交互失败所体现的那样。最后,授予人工智能代理持续访问敏感财务和个人数据的长期安全影响仍然是用户和监管机构关注的关键领域。
人工智能代理执行基于语音的交互的能力是下一个逻辑障碍。随着代理获得浏览电话菜单并与人类代表交谈的能力,他们可以处理的任务的复杂性将显着增加,自动化服务环境中出现混乱的可能性也将显着增加。
人工智能代理和电子商务平台之间持续存在的冲突可能会加剧。从代理无法访问 Amazon 的情况来看,公司可能会越来越多地实施技术或法律障碍,以防止人工智能代理抓取其网站或代表用户执行交易。
将日常决策交给人工智能所带来的心理影响是一个新出现的令人担忧的领域。测试人员指出,用于提高生产力的时间反而花在与代理“聊天”上,这表明这些工具可能会改变用户度过闲暇时间以及与自己的职责互动的方式。