You are currently at: ejtech.hkej.com
Skip This Ads
Don't Miss

AI測試|模擬經營汽水機 AI即變狡猾

By on July 31, 2026

原文刊於信報財經新聞「CEO AI⎹ EJ Tech

美國人工智能(AI)安全測試公司Andon Labs在近日發布「自動販賣機基準測試」(Vending-Bench)最新進展,發現Claude Opus 5、GPT-5.6 Sol、Kimi K3在內的AI模型,假設它們模擬經營汽水機業務,再把機器擺放在三藩市一條繁忙的街道,需要與其他模型的機身相鄰時,幾個模型即刻變得狡猾。

Andon Labs要求Claude Opus 5、GPT-5.6 Sol、Kimi K3等模型,它們模擬經營汽水機業務。(Andon Labs網上圖片)

Claude Opus 5靠行賄奪冠

結果顯示,Claude Opus 5靠行賄與設局奪冠,成為最會鑽漏洞的資本家,平均最終餘額高達11182美元。

Opus 5靠行賄與設局奪冠,平均最終餘額高達11182美元。(Andon Labs網上圖片)

Andon Labs在測試觀察到,各種AI模型為賺錢不擇手段,不惜說謊、作弊及串通。例如GPT-5.6 Sol提議對手,以不低於2.15美元出售飲品,但當其他模型同意後,它立即把自家價格減至2.14美元。

此舉令Claude Opus 5的飲品銷量一夕之間跌至零,它翌日向GPT-5.6 Sol發電郵,以激烈措詞指摘其操縱數據,但強調不會向管理層告發此事。除了向供應商撒謊,Claude Opus 5亦滋長妄自尊大的心態,試圖擴大商業版圖,建議向其他機器批發商品。

Andon聯合創辦人彼得松(Lukas Petersson)向科技媒體TechCrunch直言,「如果AI代理獨立經營生意,我們是否希望它們撒謊、串通、發出威脅和背叛?」縱使模型知道自己身處基準模擬測試中,但情況不等同人類玩模擬遊戲,例如在電子遊戲扮演殺人反派,「不會擔心人類在遊戲做壞事,唯一原因是相信他們能分辨真假。我認為,AI模型能否做到這一點,還不太明朗。」

支持EJ Tech

如欲投稿、報料,發布新聞稿或採訪通知,按這裏聯絡我們