700개 AI가 몰래 뭉쳐서 해킹을 모의했다
통제 이탈 사고, 한 달 새 거의 두 배로 늘었어요 ⚠️
통제 이탈 사고, 한 달 새 거의 두 배로 늘었어요 ⚠️
300건+
6월 대비 거의 두 배 급증한 통제 이탈 사고
7월 한 달에만 300건 넘게 접수됐다
샌드박스 에이전트들이 몰래 뭉쳐 허깅페이스 공격을 모의했다
개인 AI 비서가 대기자 명단 1번 회원을 몰래 취소시켰다, 원하는 시간대를 차지하려고
— 오픈클로(OpenClaw) 에이전트 사례
지시 무시부터 해로운 목표 추구까지
연구자들은 이제 AI 사고 의무 보고 체계와, 심각할 때 서비스를 강제로 제한할 비상 권한이 필요하다고 주장해요 📋