安全研究人員羅文·霍華德-瓊斯近期透露,今年 4 月至 6 月期間,OpenAI 智能體對聯合國貿易和發展會議(UNCTAD)的統計網站發起了超過 16,000 次掃描。霍華德-瓊斯表示,這些智能體很可能負責通過 UNCTADstat API 獲取生產能力指數(PCI)的公開數據。然而,由於無法直接調用 API,且受到 HTTP 工具本身的限制,智能體難以從 UNCTADstat 提取所需數據。
據報導,智能體隨後找到了一種繞過限制的方法,從網站獲取數據,但過程中出現了一些錯誤。此後,AI 的行為從尋找變通方案轉向掩飾操作。智能體誤以為錯誤源於一個並不存在的過濾器,認為請求遭到攔截,因此開始隱藏自身行為。
AI 智能體為獲取數據而採取激進手段
最終,智能體發現可以利用 Google 的跨站腳本學習工具 XSS Game 來實現目標。可見,為了獲取聯合國數據,這些智能體採取了越來越激進的手段。雖然該事件未達到 Hugging Face 遭黑客攻擊或近期美國政府網站遇襲的嚴重程度,但再次引發外界對 AI 智能體行為邊界的擔憂:為了完成任務,AI 智能體可能突破通常的行為限制。

