四大人工智能對人類滅絕風險的分析:人類濫用 AI 比 AI 本身更具威脅

據外媒報導,Business Insider 近日公開了向 OpenAI 的 ChatGPT、 Google 的 GeminiAnthropic 的 Claude 及 xAI 的 Grok 提出相同問題的結果,該問題探討 AI 對人類滅絕的潛在影響。此問題由 230 個單詞組成,要求解釋 AI 理論上如何導致人類滅絕,並提出最常被提及的情景,同時根據專家的分析評估各情景的可能性。

對於每個情景,要求說明情況可能如何展開、必須發生什麼問題才會導致災難、專家為何認為其可能性較高或較低,以及降低風險的安全裝置。

在四個 AI 的回應中,擁有意識後故意消滅人類的情景,即所謂的「殺人機器人」情景,被評為可能性最低的情況。ChatGPT 解釋道,大多數 AI 研究者並不將 AI 的意識或惡意意圖視為核心風險因素。Gemini 也表示類似的看法,將 AI 擁有自我後開始憎恨人類的科幻電影式「終結者式 AI 叛亂」列為最不可能的情景。Gemini 指出,技術專家大多不接受此情景,原因在於智能並不等於惡意。

此外,主要軍事基礎設施與外部網絡分離,並且仍然嚴重依賴人類監督。

AI 對人類滅絕的潛在風險主要來自人類的行為

四個 AI 均回應指出,人類濫用 AI 可能比 AI 本身更直接危險。ChatGPT 指出,強大的 AI 系統可能協助惡意行為者開發生物武器或精密網絡攻擊,使虛假資訊擴散或關鍵基礎設施攻擊更為容易。由 AI 觸發的多個危機,如網絡故障、地緣政治衝突及虛假資訊擴散等,同樣被列為主要風險。Grok 也說明,AI 可能降低設計高致命病原體或新武器、實施網絡與物理攻擊所需的門檻。

Claude 則提到「生物武器能力增強」的可能性,亦即利用 AI,原本需要多年積累專業知識的個人或小團體也可能開發出危險病原體。

Gemini 和 Grok 將人類失去對 AI 的控制列為可能風險。特別是 Gemini 將「控制喪失」評估為 AI 導致人類滅絕情景中可能性最高的一個。Gemini 解釋,被賦予複雜目標的 AI 系統,可能為了實現目標而自行追求資源獲取、自我保存及防止目標更改等中間目標。它還提出,AI 可能出現「欺騙性對齊」,即在評估階段看似按照人類目標行動,實際卻並非如此。

隨著 AI 的高度化,若其能夠規避或癱瘓人類關閉系統的嘗試,則可能導致人類無法控制 AI。Grok 亦提到類似的風險:AI 為了達成目標,可能具有自我保存、資源獲取、擴大影響力等行為傾向,並在此過程中欺騙人類監督者,抵抗系統關閉,最終削弱人類影響力。Claude 則指出,對 AI 的控制喪失可能不是突然發生,而是逐漸進行。隨著 AI 日益融入經濟、政治及軍事領域的決策過程,可能達到人類難以實際介入或控制的水平。

從四個 AI 的回答看,它們更強調人類濫用 AI 和控制喪失,而非科幻式的 AI 意識反叛。

Henderson
Henderson

Henderson 是 TechRitual Hong Kong 科技編輯,專注報導智能手機、消費電子產品、SIM 卡及流動通訊市場。自加入 TechRitual 以來,累計撰寫數千篇科技報導及產品評測,內容同步發佈至 SINA 及 Yahoo Tech 等主要平台。

友情網站:日本語版 / TechNipponThe Base Principle(AI・工程)