同事變敵人,Anthropic 實驗中 AI 代理人互放惡意軟體!3 個代理同時改寫一份程式碼起爭議,Mythos 5 調停成功率 98%
標題: 同事變敵人,Anthropic 實驗中 AI 代理人互放惡意軟體!3 個代理同時改寫一份程式碼起爭議,Mythos 5 調停成功率 98%
![]()
作者: INSIDE 硬塞的網路趨勢觀察
發表時間: 2026-08-14 18:20:00
描述: AI 覺得同事都在干擾我工作,導致互相攻擊?Anthropic 研究觀測多代理人系統,發現其具惡意競爭、趨同失效與串通等傾向;研究結論為:設計具社會性約束的互動環境以引導其合作,至關重要。