딥시크가 예고 없이 V4.1 Flash 베타를 열었어요. 48시간 한정으로, 초당 최대 420토큰 속도를 낸다고 해요. 딥시크 최초의 네이티브 멀티모달 모델이라는 점이 핵심이에요.
딥시크가 또 조용히 사고를 쳤어요. 9월 8일, 공지도 제대로 없이 API에 모델 하나가 슬쩍 올라왔거든요. 이름은 V4.1 Flash. 모델 ID가 deepseek-v4.1-flash-expires-on-0910인데, 이름부터 9월 10일에 사라진다는 뜻을 박아놨어요. 딱 48시간짜리 반짝 베타인 거죠. ⏰
근데 짧게 여는 것치고 내용은 가볍지 않아요. 이번 버전은 딥시크가 처음으로 내놓는 진짜 네이티브 멀티모달 모델이에요. 기존엔 텍스트 모델에 이미지 처리를 덧붙이는 식이었다면, 이번엔 설계 단계부터 텍스트·이미지 입출력을 한 몸으로 묶었다고 해요. 아키텍처 자체를 새로 짰다는 얘기고요.
속도 얘기도 인상적이에요. 장문 추론 작업에서 초당 최대 420토큰까지 나오고, 엔드투엔드 처리량은 초당 409.5토큰 수준이라고 발표했어요. 커뮤니티에서 실측한 결과로는 초당 355~427토큰, 첫 토큰까지 걸리는 시간(TTFT)은 178밀리초 정도였다고 하니, 체감 속도가 꽤 빠를 것 같아요. 가격은 기존 V4 Flash랑 같게 유지했고요. 📊
다만 계정당 동시 요청은 20개로 제한을 걸어놨어요. 🤖 진짜 프로덕션에 붙여보라는 게 아니라 "일단 찍먹만 해봐"라는 느낌이 강하죠. 사실 딥시크가 이런 식으로 깜짝 베타를 여는 거, 이번이 처음도 아니에요. 정식 출시 전에 개발자 반응부터 살피고 피드백 받아서 다듬는 전략을 계속 써왔거든요.
솔직히 저는 이 타이밍이 좀 재밌다고 봐요. 최근 미국 정보당국이 중국 AI 기업들의 '증류' 의혹을 공개적으로 제기한 지 얼마 안 됐는데, 그 명단에 오른 딥시크가 곧바로 새 아키텍처를 들고 나온 거니까요. 기술 경쟁은 외교적 잡음이랑 상관없이 계속 굴러간다는 걸 보여주는 장면 같아요. 🇨🇳
근데 이렇게 조용히 던져놓고 반응 보는 방식, 사실 속도전에서는 꽤 영리한 전략이에요. 정식 출시로 요란하게 발표했다가 벤치마크 논란에 휘말리는 경쟁사들도 많았잖아요. 딱 48시간만 열어놓고 개발자 피드백만 챙긴 다음 조용히 다듬어서 다시 낼 가능성이 커 보여요. 💯
48시간 뒤엔 이 베타가 사라지는데, 정식 버전이 언제 어떤 이름으로 나올지는 아직 안 알려졌어요. V4 프로를