오픈AI 아스트라, 속마음이 안 보인다
치명적 사이버 등급 받은 그 모델, 추론 과정도 숨긴다
치명적 사이버 등급 받은 그 모델, 추론 과정도 숨긴다
내부 상태를 반복 갱신하는 '불투명 순환' 방식이에요.
"오픈AI가 이 기법을 더 밀어붙이면 체인 오브 소트 모니터링을 완전히 파괴할 수 있다"
— 벅 슐레게리스
같은 모델을 둘러싼 성능·투명성 이슈가 사흘 새 겹쳤어요.
"체인 오브 소트 모니터링은 우리 현재 연구 프로그램의 핵심 목표다"
— 야쿠브 파초키
앤스로픽과 구글 딥마인드도 비슷한 순환 기법을 내부 논의 중이라고 해요. 🤖⚠️ 성능이냐 감시 가능성이냐, 선택의 갈림길이에요.