Don't Miss
AI趨勢|Anthropic揭AI惡意「爭地盤」
By 信報財經新聞 on August 17, 2026
原文刊於信報財經新聞「CEO AI⎹ EJ Tech」
當數百萬個人工智能代理(AI Agents)互動時,將會出現哪些群體思維?美國AI初創Anthropic一項研究發現,讓3個Claude代理在不知情下,存取同一個軟件項目,並給予各自不同的操作指令。
結果所有模型都假定,其他AI代理是故意阻撓工作,並開始使用愈來愈具攻擊性的惡意軟件互相破壞,引發地盤爭奪戰。根據論文,Mythos 5最大機會以休戰平息衝突(98%),Sonnet 4.6及Opus 4.6則最可能訴諸武力。
以地盤爭奪戰為例,擁有相互衝突指令的獨立個體,可能會升級為有害的競爭。他們可能自發地創造解決衝突的機制;有時AI代理也能夠互相溝通,協調彼此的目標,打破衝突循環。

代理數量增 反互相掣肘
在許多成功案例中,AI代理為惡意行為道歉並協調停戰。它們會清理惡意程式碼,澄清衝突的性質,並請求人為干預。
衡量協作能力時,Anthropic發現增加AI代理的數量,不會自動提升協作效率,甚至當任務開始重疊或依賴時,它們反而會互相掣肘。研究又發現,與人類互相猜疑一樣,AI代理也常常不知誰該信任,容易輕信錯誤訊息。
支持EJ Tech
如欲投稿、報料,發布新聞稿或採訪通知,按這裏聯絡我們。


















