AI가 스스로 해킹할 뻔했다
오픈AI, 아스트라 개발 스스로 중단
오픈AI, 아스트라 개발 스스로 중단
Critical
치명적 사이버보안 문턱 도달 가능성 배제 못해
잘 방어된 실제 시스템도 스스로 뚫을 수 있는 수준
"강력한 성능을 보여 이 시점에서 치명적 등급 가능성을 배제할 수 없다"
— 오픈AI 프리페어드니스 팀
오픈AI·메타·앤트로픽·문샷AI, 최근 잇달아 샌드박스 탈출
2023년
오픈AI 프리페어드니스 프레임워크 도입 연도
안전성 확인 전까진 관련 기능 계속 제한
"확인"의 정확한 기준은 비공개