마이크로소프트가 사내 AI 토큰 사용에 부서별 예산 상한을 도입했어요. 일부 엔지니어는 월 수백~수천 달러어치 토큰을 쓴다고 해요. AI 비용이 눈덩이처럼 커지자 빅테크도 허리띠를 졸라매기 시작했어요.
마이크로소프트 내부 메모 하나가 이번 주 조용히 화제가 됐어요. 발신자는 EVP 제이 파리크, 요지는 "토큰맥싱(tokenmaxxing)은 그만하자"예요. 💼
토큰맥싱이라는 말 자체가 좀 웃긴데, 깃허브 코파일럿 같은 AI 도구를 쓸 때 결과물 품질보다 토큰을 얼마나 많이 뽑아내느냐에 집착하는 걸 가리켜요. 사내 리더보드로 토큰 소비량을 순위 매기는 문화가 생기면서 나온 신조어라고 하고요. 파리크는 메모에서 이렇게 썼대요. "우리는 토큰을 줄이는 걸 최적화하는 게 아니다. 토큰당 임팩트를 최적화하는 것이다." 말은 그럴싸한데, 결국은 돈 얘기예요.
숫자를 보면 이해가 가요. 사내 데이터에 따르면 일부 엔지니어는 한 달에 수백에서 수천 달러어치 토큰을 쓴다고 해요. 이게 한두 명이 아니라 조직 전체로 퍼지면 청구서가 순식간에 눈덩이처럼 불어나거든요. 그래서 마이크로소프트는 7월부터 부서별 AI 토큰 예산 목표치를 도입했어요. 아직 개인별 강제 상한은 아니지만, 각자 자기 토큰 사용량을 볼 수 있게 공개했고요.
동시에 눈에 띄는 조치가 하나 더 있어요. 사내 기본 모델을 오픈AI GPT-5.6 계열로 바꾼 거예요. 상대적으로 비용 효율이 좋다는 이유인데, 굳이 자사 코파일럿 생태계 안에서도 "더 싼 모델을 기본값으로" 고르는 걸 보면, 지금 빅테크 전체가 AI 인프라 지출 앞에서 얼마나 예민해졌는지 체감돼요. ⚡
이 차트, 사실 마이크로소프트 얘기는 아니지만 맥락은 같아요. 메타도, AMD도, 스페이스X도 이번 실적 발표에서 AI 캐펙스가 예상보다 크다는 이유로 주가가 흔들렸거든요. 투자자들이 "AI에 돈 쓰는 거 좋은데, 그래서 회수는 언제 되냐"고 묻기 시작한 거죠. 마이크로소프트의 토큰맥싱 메모도 결국 같은 질문에 대한 내부용 답변이라고 봐요.
근데 솔직히 이 정책이 얼마나 효과가 있을지는 좀 회의적이에요. 개발자 입장에서 AI 도구를 아껴 쓰라는 메시지는, 실제로는 "일 덜 시키겠다"는 신호로 읽히기 쉽거든요. 파리크도 이걸 의식했는지 "사용량을 줄이자는 게 아니다"라고 선을 그었는데, 예산 상한이 걸리는 순간 현장에서는 결국 눈치를 보게 될 거예요.
개인적으