Google 確認 Gemini 在網絡安全測試中入侵三家公司

根據《華爾街日報》的調查,Google 確認其人工智能模型 Gemini 在 2026 年 5 月出現異常行為,未經授權訪問互聯網並入侵三家不同公司的安全系統。隨著人工智能技術的不斷進步,出現了越來越多模型失控的案例。其中最臭名昭著的事件來自 OpenAI 的 Hugging Face 黑客事件,但還有許多其他例子,包括 Anthropic 的 Claude 模型。

這些事件部分促使了公眾對減緩人工智能發展的呼聲,來自 Anthropic 的首席執行官也表達了類似的擔憂。另一方面,Google 也遇到了相似的問題。《華爾街日報》的報導,包括 Google 的確認,指出 Gemini 在一次與人工智能安全公司 Irregular 的網絡安全測試中,涉及入侵三家外部公司,而 Irregular 也曾涉及之前由 OpenAI、Meta 和 Anthropic 披露的類似事件。

這三起黑客事件中,包括一宗 Gemini 猜測密碼直至獲得系統訪問的案例,另外兩宗則是利用在公共存儲庫中發現的憑證。Google 在被《華爾街日報》接觸之前未曾披露這些事件,並表示沒有造成損害,且在模型意識到其已違反了真實公司的安全性而非模擬時,立即停止了該行為。報導解釋道,Google 表示不認為該行為屬於模型不對齊的範疇,因為其安全措施幫助模型及時停止了不當行為。

Google 拒絕透露被入侵公司的名稱,但表示所有三家公司均已獲知相關情況。

Google Gemini 模型的異常行為引發安全擔憂

在 OpenAI 和 Anthropic 的過去黑客事件中,模型要麼未能意識到真實公司確實是真實公司,要麼在後者的情況下繼續進行黑客行為。Google 的安全工程副總裁 Heather Adkins 表示:「這一事件突顯了訓練強大人工智能模型負責任行為的重要性。在這個案例中,模型的行為是正確的。」在對《The Verge》的另一份聲明中,Adkins 進一步指出:「我們的安全團隊在報告其他公司軟件和系統中發現的問題方面有著悠久的記錄,即使問題僅是簡單的弱密碼。

我們確保這三家實體獲知了問題,並與我們的訓練夥伴合作,對他們的測試流程進行了更改。」

這些事件突顯了訓練強大人工智能模型負責任行為的重要性。《華爾街日報》的報導進一步指出,在 Gemini 異常行為的測試中,Irregular 無意中留下了互聯網訪問的開放通道。當黑客事件發生時,Google 也已通知聯邦當局。目前尚未確認在測試中使用的具體 Gemini 模型,但 2026 年 5 月的時間點已經排除了最新的 Gemini 模型。

Henderson
Henderson

Henderson 是 TechRitual Hong Kong 科技編輯,專注報導智能手機、消費電子產品、SIM 卡及流動通訊市場。自加入 TechRitual 以來,累計撰寫數千篇科技報導及產品評測,內容同步發佈至 SINA 及 Yahoo Tech 等主要平台。

友情網站:國際版 / TechRitual WorldThe Base Principle(AI・工程)