GLM 5.2 API 출시, 가중치 HF 공개, Ollama 지원 시작
GLM 5.2 API is live, weights are on HF, and ollama has it already
핵심 요약
GLM 5.2가 오픈 소스로 공개되어 로컬 실행 및 API 사용이 가능해졌습니다.
- 모델 공개 — GLM 5.2 가중치가 HuggingFace에 MIT 라이선스로 배포됨
- API 지원 — 1M 토큰당 1.4달러(입력) 및 4.4달러(출력)로 책정됨
- 성능 지표 — SWE-bench Pro 등에서 GPT-5.5와 대등한 수준을 기록함
- 활용 방안 — 지원 로그 필드 추출 및 코드 리뷰 등 단순 업무에 적합함
GLM 5.2가 금요일에 출시되었는데, 처음에는 GLM 코딩 플랜에 묶여 있었습니다. 다른 IDE 티어를 구독하지 않고 그냥 테스트만 해보고 싶었던 사람들에게는 짜증 나는 일이었죠.
오늘 두 시간 전에 API를 열고 HuggingFace에 MIT 라이선스로 가중치를 올렸습니다. Ollama에도 이미 추가되었고요. 이제 로컬에서 직접 실행하거나 이미 사용 중인 게이트웨이를 통해 호출할 수 있습니다.
블로그를 건너뛰고 싶은 분들을 위한 링크입니다:
API 가격은 GLM-5.1과 동일하게 1M 입력 토큰당 1.4달러, 출력 토큰당 4.4달러입니다. High와 Max 두 가지 사고 모드가 있습니다. Max 모드는 토큰을 더 많이 소모하지만 점수를 높여줍니다. 1M 컨텍스트를 지원하는데, 윈도우 끝까지 갔을 때 일관성이 유지되는지는 아직 테스트해보지 않았습니다.
공개된 벤치마크 결과는 Terminal-Bench 2.1에서 81.0점, SWE-bench Pro에서 62.1점, FrontierSWE에서 74.4점입니다. Opus 4.8보다 1점 뒤처지고, GPT-5.5보다는 1점 앞섭니다. 오픈 가중치 모델로서는 상당히 유용한 위치입니다. 모든 면에서 이겨서가 아니라, 흥미로운 라우팅을 가능하게 할 만한 가격대에 충분한 성능을 보여주기 때문입니다.
제가 가장 먼저 라우팅할 업무는 지원 로그에서 필드 추출하기, 내부 요약 초안 작성, 코드 리뷰 첫 단계 코멘트 작성입니다. 지루한 70%의 업무들이죠. 만약 이상한 오류 없이 일주일간 실제 트래픽을 견뎌낸다면, 범위를 더 넓힐 생각입니다.

