100B-120B급 신규 모델이 왜 이렇게 안 나올까?
Why there is a lack of new 100B-120B models?
핵심 요약
로컬 LLM 사용자들이 선호하는 100B-120B 체급 모델의 출시가 뜸해진 이유와 해당 체급의 실용성에 대해 토론함.
- 애매한 포지셔닝 — 일반 사용자에게는 너무 무겁고 클라우드 업체가 서비스하기엔 너무 작다는 분석임.
- 하드웨어 접근성 — Mac Studio나 고용량 RAM 환경을 갖춘 유저들에게는 여전히 매력적인 크기라는 의견임.
- 상용 모델과의 경쟁 — 120B급 성능이 너무 좋으면 기업의 유료 API 매출을 갉아먹을 수 있다는 추측임.
- Mistral 모델 논쟁 — Mistral 계열 모델들의 전반적인 성능 저하에 대한 실망감과 특정 용도에서의 강점이 언급됨.
GPT-OSS-120B가 이 제품군의 첫 모델이었고, 그 뒤를 이어 GLM-4.5-Air, Nemotron-3-Super, Qwen3.5-122B, Mistral-Small-4-119B가 출시되었습니다. 하지만 이 모델들은 모두 출시된 지 최소 3개월(GPT-OSS-120B는 10개월)이 지났으며, 최근 출시되는 모델들은 25B-35B(Gemma4, Qwen3.6)이거나 200B+(Step 3.5/3.7 Flash, DeepSeek-V4-Flash, MiniMax-M3, Nemotron-3-Ultra)급입니다. ~120B MoE 제품군도 70B/80B 모델들처럼 "사멸"한 걸까요, 아니면 2026년 하반기에 새로운 출시 소식이 있을까요?

