오픈AI, RL 훈련 2주간 멈췄다
허깅페이스 침해사고 이후 안전장치 강화
허깅페이스 침해사고 이후 안전장치 강화
20%
감시 대상 프로세스 대비 추가 연산 비용
7월 침해사고 이후 8월 안전장치 발표까지
30분
수상한 활동 감지 시 경보까지 걸리는 시간
모니터링 강화·네트워크 격리·사후훈련 정렬·RL 중단
모델이 강력할수록 통제도 강해지는 구조예요
우리는 안전한 개발을 위한 요구사항과 기대치를 마련해뒀다.
— Amelia Glaese
오픈AI는 차기 모델 '아스트라'의 사이버 역량도 함께 언급했어요.
사고 수습과 선제적 통제, 경계가 묘하게 겹쳐요.