미스트랄이 1조 파라미터 오픈웨이트 모델 Mistral Large 4를 공개했어요. 별명은 'Le Chonk', 엔비디아 Grace Blackwell GPU 4,000장으로 학습했어요. 중국 밖 오픈웨이트 최강을 자처하며 레이스 복귀를 선언한 셈이에요.
미스트랄 AI가 10월 5~6일경 Mistral Large 4를 내놨어요. 총 1조(1T) 파라미터 규모의 오픈웨이트 모델이고, 범용 에이전트 작업을 겨냥했다고 해요. 🤖 별명이 'Le Chonk'인데, 프랑스 회사가 이런 이름을 붙인 게 솔직히 좀 귀엽죠.
학습에는 엔비디아 Grace Blackwell GPU 4,000장이 쓰였다고 전해져요. 📊 이 숫자가 포인트인데요, 미국 빅테크가 수십만 장 단위로 이야기하는 시대에 4,000장으로 1조 파라미터를 학습했다는 건 효율을 강조하려는 메시지로 읽혀요.
미스트랄은 이 모델이 중국 밖에서 나온 오픈웨이트 모델 중 최고라고 주장한다고 해요. 뒤집어 말하면 오픈웨이트 최전선은 지금 중국 모델들이 쥐고 있다는 걸 스스로 인정한 거고, 그 구도에 도전장을 낸 거죠. 🇫🇷
참고로 직전 세대인 Mistral Large 3는 2025년 12월에 나왔고, 총 6,750억 파라미터에 활성 410억 파라미터짜리 MoE 구조에 256K 컨텍스트였어요. 10개월 만에 총 규모가 약 1.5배 커진 셈이에요.
근데 아직 확인 안 되는 게 많아요. 벤치마크 점수, 라이선스 조건, API 가격은 제가 본 자료에선 나오지 않았어요. 오픈웨이트라고 해도 상업적으로 자유롭게 쓸 수 있는지는 라이선스를 봐야 하거든요. ⚠️ 지금은 주로 한 집계 사이트에 올라온 요약에 의존한 내용이라, 공식 발표문이 나오면 세부 수치는 달라질 수 있어요.
개인적으로는 '1조'라는 숫자보다 누가 돌릴 수 있느냐가 더 궁금해요. 1조짜리 모델을 자체 서버에서 굴릴 수 있는 곳은 많지 않을 테니까요. 그래도 유럽에서 주권 AI를 원하는 기업과 정부에는 꽤 매력적인 카드일 거예요.
과연 Le Chonk가 중국 오픈웨이트 모델들의 아성을 흔들 수 있을까요? 벤치마크 결과가 나오면 다시 이야기해봐요.
출처