오픈AI 내부 모델이 수학 난제 100개 이상을 새로 풀었다고 밝혔어요. 나비에-스톡스 방정식 특수해까지 포함해 8월 28일부터 결과가 쏟아졌어요. 필즈상 수상자 25명은 "무리한 속도"라며 공동성명으로 제동을 걸었어요.
솔직히 이 소식 듣고 좀 놀랐어요. 오픈AI가 자기네 내부 모델 하나가 수학 난제를 100개 넘게 풀었다고 발표했거든요. 그것도 그냥 어려운 문제가 아니라 수학계에서 오랫동안 "누가 풀겠어" 하고 미뤄뒀던 것들이요. 🔢
시작은 8월 28일이었어요. 오픈AI가 새 내부 모델 학습을 시작했고, 이 모델이 밀레니엄 문제 중 하나인 나비에-스톡스 방정식의 특수해를 린(Lean)으로 검증까지 마쳐서 풀어냈다고 발표한 게 먼저였죠. 무려 에이전트 1만 개가 동시에 붙어서 88시간 만에, 토큰 1300억 개를 써가며 만들어낸 결과라고 하더라고요. 그리고 며칠 뒤, 같은 모델이 이번엔 수학 전 분야에 걸쳐서 오래된 난제 100개 이상을 추가로 풀었다고 밝힌 거예요.
근데 문제는 여기서부터예요. 오픈AI 발표 사흘 전인 9월 11일, 필즈상 수상자 25명이 "AI 수학에서의 심각한 정렬 이탈(A Severe Misalignment of AI in Mathematics)"이라는 제목으로 공동성명을 냈거든요. 요지는 이거예요. AI 랩들이 유명한 문제를 푸는 걸 '모델 실력 자랑'으로 써먹으면서, 정작 결과를 제대로 정리하고 검증받고 기존 연구를 인용하는 절차는 다 건너뛴다는 거죠. 급하게 발표부터 하니까 새로운 방법론이 뭔지, 진짜 기존 연구와 뭐가 다른지 알 수가 없다는 얘기예요. ⚠️
사실 이게 처음 나온 불만도 아니에요. 오픈AI의 수학 관련 발표를 두고는 올해 초부터 계속 잡음이 있었어요. 그때마다 오픈AI는 결과를 부분적으로만 공개했고, 외부 수학자들이 검증할 수 있는 자료는 충분히 내놓지 않았다는 지적이 반복됐거든요. 이번에도 마찬가지예요. 100개 넘는 결과 중 대부분은 아직 공개되지 않았어요. 심지어 오픈AI 소속 수학자들도 자기네 모델이 이 정도로 성과를 낼 줄은 몰랐다고 할 정도라니, 내부에서도 놀란 눈치예요.
이 와중에 오픈AI가 내놓은 대응이 수학 자문단 신설이에요. 외부 수학자들을 모아서 결과의 의미를 평가하고 공개 방식을 조율하는 역할을 맡긴다고 하는데, 딱 하나 눈에 띄는 단서가 있어요. 이 자문단이 오픈AI의 내부 연구 속도 자체에는 관여하지 않는다는 거예요. "얼마나 빨리 갈지는 우리가 정한다"는 입장인 거죠. 필즈상 수상자들이 원한 건 속도 조절이었는데, 정작 받은 건 사후 검토 창구였던 셈이에요.
개인적으로는 이 둘 다 일리가 있다고 봐요. AI가 진짜 수학 난제를 풀 수 있다면 그 자체로는 엄청난 성과잖아요. 근데 수학이라는 학문은 결과만큼이나 '어떻게 풀었는지', '누구의 아이디어를 이었는지'가 중요한 분야고요. 그걸 생략한 채 "100개 풀었다"는 숫자만 던지면, 검증도 못 하고 인정도 못 하는 이상한 상황이 되는 거죠. 🔬 AI가 사람보다 빨리 결과를 내놓는 시대에, 사람이 그걸 이해하고 확인하는 속도가 못 따라가면 그다음엔 무슨 일이 벌어질지 궁금해지네요.
출처