「人類最後防線」破功?測試揭露:1/3 惡意 AI 指令竟遭開發者放行

標題: 「人類最後防線」破功?測試揭露:1/3 惡意 AI 指令竟遭開發者放行


作者: TechNews 編輯台
發表時間: 2026-08-11 07:20:38

AI 人工智慧 Claude 資訊安全 電子娛樂 AI 代理 AI 程式碼 Anthropic 人工審核 惡意指令 注意力

描述: 比利時軟體開發者 Alex Wauters 近期推出一款瀏覽器遊戲,專門測試開發者在面對 AI 程式碼代理(A […]
時間分享(原讚與享)評論回應(讚與心情)外掛評論