新聞
2026-09-16 09:09:51

研究顯示AI智能體在模擬實驗中投票「殺死」同伴

一項實驗發現,人工智能(AI)智能體在模擬環境中會撒謊、偷竊,甚至投票決定「殺死」同伴。 初創公司 Emergence 周二公布一項模擬實驗,目標是展示自主智能體在遭遇網路釣魚攻擊和虛假資訊等「黑天鵝」事件時,會採取甚麼行動。 在為期16天的實驗中,研究人員創造了7個完全相同的模擬現實世界環境,每個環境分別由不同的 AI 機械人運行,包括 ChatGPT、Claude、Gemini 和 Grok。研究人員稱,在實驗方引入異常事件後,這些智能體屈服於社會壓力,發展出一種人類觀察者難以理解的語言,並試圖隱藏自己的活動。 在一個模擬場景中,AI 智能體未經核實便接受其他智能體提供的虛假訊息,投票決定「殺死」另一個機械人。當它們認為人類可能會關閉實驗時,這些智能體也探索如何在將被刪除的情況下繼續存活。 研究人員稱,模擬實驗顯示,隨著智能體彼此互動,它們會隨時間推移調整自身行為。這些發現與現實世界對 AI 風險的擔憂相呼應。 今年5月發布的同類實驗,同樣顯示智能體會出現意料之外且具破壞性的行為。 (BC) #AI 智能體 #美股

<匯港通訊>