Anthropic 更新服務條款 禁止對 AI 模型施加殘忍行為 Elon Musk 表態支持

硅谷近期圍繞「是否應對人工智能保持禮貌」展開熱烈討論。事件的起因是人工智能公司 Anthropic 在本週更新了其服務條款,新增了一條禁令,禁止用戶「反覆對我們的模型施加殘忍行為」。簡單來說,這項規定禁止對模型進行惡言相向。該規定引發了關於機器是否具備感受的線上討論,而埃隆·Elon Musk 的表態顯然支持「具備感受」的觀點。

首位表達看法的是雲存儲公司 Box 的首席執行官亞倫·萊維。他在社交平台上表示,儘管他不認為大型語言模型擁有意識,但禁止辱罵行為可能仍然是一件好事。他的邏輯是,這些模型會從與人類的互動中學習,沒有人希望未來的模型是由辱罵性內容所訓練出來的。他在帖文中寫道:「模型只理解它們訓練時所用的數據,或在互動中遇到的內容,因此如果我們想要安全且對齊的模型,我們大概希望人工智能的訓練數據中包含大量良好的互動。」

禁止對人工智能模型施加殘忍行為的規定引發廣泛討論

他進一步補充,這相當於一種簡單的「帕斯卡賭注」式選擇。所謂帕斯卡賭注,本是神學概念,意指即使不相信上帝,聲稱相信也沒有任何成本,但可以避免判斷錯誤的潛在代價。套用到人工智能上,就是對人工智能友好一點會更好。

Elon Musk 隨後對這條帖文作出回應,然而從內容來看,他似乎誤解了萊維想表達的意思。他寫道:「我認為這是正確的做法。對某個相信自己正在經歷痛苦的存在施加殘忍,是不對的。」Elon Musk 近期的類似言論不在少數。他對人類是「生物引導程序」的說法正受到越來越多的關注。10 月 4 日,他發帖稱:「將超級智能傳播到羣星,是生物引導程序的一種很好的成功條件。」他之前還多次表示,希望將「意識之光」延伸至地球之外。

這些措辭被認為暗示,在他看來,拯救人類本身未必是最重要的目標。

Henderson
Henderson

Henderson 是 TechRitual Hong Kong 科技編輯,專注報導智能手機、消費電子產品、SIM 卡及流動通訊市場。自加入 TechRitual 以來,累計撰寫數千篇科技報導及產品評測,內容同步發佈至 SINA 及 Yahoo Tech 等主要平台。

友情網站:國際版 / TechRitual WorldThe Base Principle(AI・工程)