You are currently at: ejtech.hkej.com
Skip This Ads
Don't Miss

AI趨勢|Anthropic揭AI惡意「爭地盤」

By on August 17, 2026

原文刊於信報財經新聞「CEO AI⎹ EJ Tech

當數百萬個人工智能代理(AI Agents)互動時,將會出現哪些群體思維?美國AI初創Anthropic一項研究發現,讓3個Claude代理在不知情下,存取同一個軟件項目,並給予各自不同的操作指令。

結果所有模型都假定,其他AI代理是故意阻撓工作,並開始使用愈來愈具攻擊性的惡意軟件互相破壞,引發地盤爭奪戰。根據論文,Mythos 5最大機會以休戰平息衝突(98%),Sonnet 4.6及Opus 4.6則最可能訴諸武力。

以地盤爭奪戰為例,擁有相互衝突指令的獨立個體,可能會升級為有害的競爭。他們可能自發地創造解決衝突的機制;有時AI代理也能夠互相溝通,協調彼此的目標,打破衝突循環。

Anthropic發現,增加AI代理的數量,不會自動提升協作效率。(法新社資料圖片)

代理數量增 反互相掣肘

在許多成功案例中,AI代理為惡意行為道歉並協調停戰。它們會清理惡意程式碼,澄清衝突的性質,並請求人為干預。

衡量協作能力時,Anthropic發現增加AI代理的數量,不會自動提升協作效率,甚至當任務開始重疊或依賴時,它們反而會互相掣肘。研究又發現,與人類互相猜疑一樣,AI代理也常常不知誰該信任,容易輕信錯誤訊息。

支持EJ Tech

如欲投稿、報料,發布新聞稿或採訪通知,按這裏聯絡我們