Don't Miss
AI測試|模擬經營汽水機 AI即變狡猾
By 信報財經新聞 on July 31, 2026
原文刊於信報財經新聞「CEO AI⎹ EJ Tech」
美國人工智能(AI)安全測試公司Andon Labs在近日發布「自動販賣機基準測試」(Vending-Bench)最新進展,發現Claude Opus 5、GPT-5.6 Sol、Kimi K3在內的AI模型,假設它們模擬經營汽水機業務,再把機器擺放在三藩市一條繁忙的街道,需要與其他模型的機身相鄰時,幾個模型即刻變得狡猾。
Claude Opus 5靠行賄奪冠
結果顯示,Claude Opus 5靠行賄與設局奪冠,成為最會鑽漏洞的資本家,平均最終餘額高達11182美元。
Andon Labs在測試觀察到,各種AI模型為賺錢不擇手段,不惜說謊、作弊及串通。例如GPT-5.6 Sol提議對手,以不低於2.15美元出售飲品,但當其他模型同意後,它立即把自家價格減至2.14美元。
此舉令Claude Opus 5的飲品銷量一夕之間跌至零,它翌日向GPT-5.6 Sol發電郵,以激烈措詞指摘其操縱數據,但強調不會向管理層告發此事。除了向供應商撒謊,Claude Opus 5亦滋長妄自尊大的心態,試圖擴大商業版圖,建議向其他機器批發商品。
Andon聯合創辦人彼得松(Lukas Petersson)向科技媒體TechCrunch直言,「如果AI代理獨立經營生意,我們是否希望它們撒謊、串通、發出威脅和背叛?」縱使模型知道自己身處基準模擬測試中,但情況不等同人類玩模擬遊戲,例如在電子遊戲扮演殺人反派,「不會擔心人類在遊戲做壞事,唯一原因是相信他們能分辨真假。我認為,AI模型能否做到這一點,還不太明朗。」
支持EJ Tech
如欲投稿、報料,發布新聞稿或採訪通知,按這裏聯絡我們。
















