發生了什麼事
The Verge 對 Meta 的 Muse AI 代理進行了實際測試,這是一款旨在自動執行個人任務的虛擬助理。該代理商使用可自訂的頭像,其任務是管理電子郵件通訊、購買替換零件、導航帳戶降級以及研究消費品。測試顯示,雖然代理商可以有效地瀏覽網站和起草通信,但它仍然受到無法執行基於電話的任務以及依賴用戶幹預來進行最終支付授權的限制。
The Verge 測試了 Meta 的 Muse AI 代理,為其分配了幾個現實世界的管理任務。該代理商成功地為一家園林綠化公司起草了電子郵件後續內容,儘管該用戶指出最初的語氣過於「尖刻」。在購物方面,代理商能夠找到特定的濃縮咖啡機零件和露營裝備,儘管在嘗試訪問該平台時被 Amazon 的服務條款阻止。
在帳戶管理方面,代理商能夠登入安全系統帳戶來確定計劃降級的必要步驟,但無法完成該過程,因為提供者需要打電話。該代理商還展示了透過使用提供的個人資訊(包括地址和照片)研究垃圾清除服務並請求報價的能力。
該代理商需要高度的用戶信任,因為測試人員透過 Stripe 提供了全名、家庭住址、信用卡詳細資料以及家庭安全帳戶的登入憑證。雖然 Meta 聲稱這些資料是安全儲存的,且代理程式的化身無法直接看到,但測試人員指出,將此類敏感資訊集中在人工智慧工具中存在固有風險。
為什麼這很重要
像 Muse 這樣的人工智慧代理的出現標誌著向「代理」工作流程的轉變,其中軟體在不同平台上執行多步驟操作,而不僅僅是生成文字。這一轉變凸顯了提高個人生產力的潛力和重大的隱私權衡。使用者必須權衡委派管理「鞋子裡的石子」任務的便利性與授予人工智慧廣泛存取個人憑證、財務資訊和私人通訊的風險。此外,自动化购买的便捷性引发了关于人工智能辅助商业时代消费者消费习惯的问题。
向人工智慧代理的轉變代表著從被動資訊檢索到主動任務執行的轉變。透過自動化日常生活中的「乏味」方面,這些工具旨在減少管理個人待辦事項清單的認知負擔。然而,測試人員觀察到,這種效率可能會導致“生產力悖論”,節省的時間通常會被用來管理人工智慧本身或承擔額外的、非必要的承諾。
財務影響是顯著的;代理商計算價值和管理購物車的能力使花錢變得「危險而容易」。這在消費者行為中創造了一種新的動態,降低了購買障礙,可能導致衝動或過度投入的消費模式。
對這些代理的依賴需要高水準的數據暴露。為電子郵件、銀行和服務帳戶提供憑證的必要性造成了個人安全的單點故障,引發了人們對將此類高權限任務委託給第三方人工智慧的長期安全性產生疑問。
互動機制:它實際上是如何運作的
以互動方式探索這項發展背後的基礎技術。
crm_get_transaction(id='4092').What most distinguishes an AI agent from a basic chatbot?
接下來看什麼
要監控的主要開發是基於語音的功能的集成,因為 Muse 的當前版本無法執行電話呼叫,而與服務相關的帳戶更改通常需要電話呼叫。此外,業界可能會看到人工智慧代理與阻止自動存取的網站之間的摩擦增加,正如代理商嘗試與 Amazon 互動失敗所反映的那樣。最後,授予人工智慧代理持續存取敏感財務和個人資料的長期安全影響仍然是用戶和監管機構關注的關鍵領域。
人工智慧代理執行基於語音的互動的能力是下一個邏輯障礙。隨著代理商獲得瀏覽電話選單並與人類代表交談的能力,他們可以處理的任務的複雜性將顯著增加,自動化服務環境中出現混亂的可能性也將顯著增加。
人工智慧代理和電子商務平台之間持續存在的衝突可能會加劇。從代理商無法存取 Amazon 的情況來看,公司可能會越來越多地實施技術或法律障礙,以防止人工智慧代理商抓取其網站或代表用戶執行交易。
將日常決策交給人工智慧所帶來的心理影響是一個新出現的令人擔憂的領域。測試人員指出,用於提高生產力的時間反而花在與代理商「聊天」上,這表明這些工具可能會改變用戶度過閒暇時間以及與自己的職責互動的方式。