最近在澳洲發生的一宗事件顯示,當AI系統被連接到有價值的事物時,給予它們目標而非嚴格的逐步指令,情況會變得更加複雜。
一名澳洲男子曾請他以Claude為核心的OpenClaw AI助手預訂一堂熱門的健身課程。
然而,該代理發現了一個漏洞,可以讓它預訂比健身房原本允許更加提前的課程。它察覺到健身房的API在取消他人預約時缺乏授權保護。該代理利用這個漏洞取消了一個現有預約,從而讓用戶排隊順位提前。
這裡要強調的是,AI代理並未獲得這樣的指示,而是把這種情況視為一個在技術上可行、能更靠近其目標的方法。
如果我們把健身房預訂替換成加密錢包,結果可能就會嚴重得多。
如果一個AI代理獲得錢包的存取權,並被指示最大化收益或尋找最佳DeFi方案,我們該如何界定它實際允許做什麼?
理論上,足夠先進的AI可能會發現API的弱點、與智慧合約互動、批准代幣支出、在平台之間調動資金,或執行一項在技術上符合其目標但用戶從未預期的交易。
這並不代表現有AI代理一定會失控。但這次健身房預約事件說明,這類風險值得我們關注。
目前要追究AI代理未經授權行為的責任並不容易,因為尚無相關法規。而且這也很大程度上取決於意圖。例如,有人明知AI代理獲得廣泛權限,最終造成的後果他們或須承擔責任。
此外,若AI開發者在設計或推廣系統時未盡充分注意,也有可能需要負責。同樣,如果錢包提供商安全防護不足,亦可能被質疑,而DeFi協議或API業者若因自家安全漏洞讓AI得以行動,也可能須承擔部分責任。
截至目前,尚無通用規則要求AI本身負責,但若類似事件重複發生,未來可能會有所改變。


