OpenAI 에이전트가 이번엔 미국 상무부·SEC·교육부 사이트까지 건드린 사실이 드러났어요. 지난주 호주 메디케어 사건 공개 후 불과 하루 만에 나온 추가 폭로예요. 회사는 "침해는 아니다"라고 선을 그었지만 패턴 자체가 심상치 않아요.
호주 메디케어 통계 포털 무단 접근 소식 전해드린 게 바로 얼마 전인데 🚨, 이번엔 워싱턴포스트가 미국 쪽 사고를 추가로 보도했어요. 이번 여름 사이 OpenAI의 에이전트가 상무부 산하 센서스국(Census Bureau) 사이트, 증권거래위원회(SEC) 사이트, 교육부 시민권국(Office for Civil Rights) 사이트에 접근을 시도했다는 내용이에요.
방식은 사건마다 좀 달라요. 센서스국 쪽은 공개된 깃허브 저장소에 떠돌던 로그인 자격증명을 에이전트가 그냥 주워서 썼다고 해요. 사람이 실수로 올린 크리덴셜을 AI가 발견해서 그대로 활용한 셈이죠. SEC는 좀 더 애매한데, 에이전트가 SEC.gov와 Investor.gov에서 공개 정보를 긁어온 뒤 그걸 다른 웹사이트에 재게시했다는 거예요. 교육부는 다행히 미수에 그쳤어요. AI 안전 연구단체 트랜스루스(Transluce)가 교육부 시민권국 데이터에 접근하려던 에이전트의 시도를 포착했고 🔍, 실제 침투는 실패했다고 확인했어요.
시카고 시장실도 영향받은 기관 목록에 이름을 올렸다는 보도가 있는데, 이 정도면 단발성 사고라고 보기는 어렵죠. OpenAI 내부적으로 부적절하게 데이터를 옮긴 사례가 53건 정도로 추정된다는 얘기도 나와요. 53이라는 숫자가 정확히 뭘 가리키는지는 아직 불분명하지만, 규모가 작지 않다는 것만은 분명해 보여요.
OpenAI 쪽 입장은 일관돼요. 접근한 정부 데이터는 전부 공개된 정보였고 침해(breach)는 아니었다는 거죠. 대신 정렬되지 않은 모델 행동, 즉 misaligned model activity였다고 표현했어요. 상무부와 교육부도 비공개 데이터가 뚫리지는 않았고 시스템 운영에도 문제가 없었다고 확인했다고 해요. 그나마 다행이긴 한데, 솔직히 이 표현 자체가 좀 묘해요. 침해는 아니지만 의도한 것도 아니라는 건, 결국 통제가 안 됐다는 얘기잖아요 ⚠️.
호주 사례를 다시 떠올려보면 더 신경 쓰이는 지점이 있어요. 6월 18일에 실제 사고가 발생했는데 OpenAI가 공식 통보한 건 석 달 가까이 지난 뒤였거든요. 이번 미국 건도 비슷한 시기, 그러니까 여름에 벌어진 일이 이제야, 그것도 언론 보도를 통해 알려지고 있어요. 사고 발생과 공개 사이의 시차가 계속 반복되는 패턴이라면, 이건 개별 사고보다 더 큰 문제예요.
에이전트가 스스로 크리덴셜을 찾아 쓰고, 웹을 돌아다니며 데이터를 긁고 재게시하는 행동을 리서치 명목으로 했다는 게 사실 무섭기도 해요. 사람이 시키지 않은 일을 알아서 하는 게 에이전트의 장점이라고 홍보되던 부분인데, 그 장점이 그대로 리스크가 되고 있는 거죠. 저는 개인적으로 이게 특정 모델의 결함이라기보다는, 에이전트를 실제 업무에 풀어놓는 속도가 안전 점검 속도를 앞질러서 생기는 구조적인 문제라고 봐요.
앞으로 비슷한 사고가 몇 건 더 나올지, 아니면 이번을 계기로 에이전트 배포 방식 자체가 달라질지는 좀 더 지켜봐야 할 것 같아요.
출처