어제는 Grok 4.7(pelicans)과 MiMo v2.6 Flash/Pro(역시 pelicans)가 공개됐고, 오늘은 Anthropic이 Claude Opus 5.5를 출시했으며, 약 한 시간 뒤에는 OpenAI가 GPT-6 Sol과 GPT-6 Luna를 연달아 선보였습니다. 신규 모델 전체를 제대로 평가하려면 좀 더 시간이 필요하겠지만, 지금까지 파악한 첫인상을 공유합니다.
GPT-5.6 Luna는 뛰어난 성능과 매우 저렴한 가격을 동시에 갖춰, 제가 애플리케이션 개발에 가장 즐겨 쓰던 모델이었습니다. 그런데 GPT-6 Luna는 그 가격에서 다시 절반으로 내려갔습니다. GPT-6 Sol 역시 GPT-5.6 Sol 대비 비슷한 수준으로 가격이 낮아졌습니다.
현재 가격 현황은 다음과 같습니다:
| 모델 | 입력 | 캐시 입력 | 출력 |
|---|---|---|---|
| GPT-6 Luna | $0.10/M | $0.01/M | $0.50/M |
| GPT-5.6 Luna | $0.20/M | $0.02/M | $1.20/M |
| Grok 4.7 | $2/M | $0.50/M | $6/M |
| GPT-6 Sol | $2/M | $0.20/M | $10/M |
| GPT-5.6 Terra | $2/M | $0.20/M | $12/M |
| Claude Opus 5.5 | $4/M | $0.20/M | $20/M |
| GPT-5.6 Sol | $4/M | $0.40/M | $20/M |
| Claude Fable 5.1 | $10/M | $0.25/M | $50/M |
| GPT-6 Astra | $10/M | $1/M | $50/M |
GPT-5.6는 11월에 25% 가격 인상이 예정되어 있어, GPT-6의 가격은 해당 모델들의 프로모션 가격 기준으로도 절반 수준입니다.
(GPT-5.6 Terra가 GPT-6 Sol과 동일한 가격이 된 이상, Terra를 써야 할 이유는 사실상 사라졌습니다.)
이 가격이 얼마나 공격적인지는 아무리 강조해도 지나치지 않습니다. Grok 4.7은 GPT-5.6 Sol 대비 절반도 안 되는 $2/$6에 출시됐지만, 이제 입력 가격은 GPT-6 Sol과 동일해졌고 출력 가격 격차도 크게 줄었습니다.
$0.10/$0.50의 GPT-6 Luna는 OpenAI가 출시한 모델 중 가장 저렴한 축에 속하며, 성능이 훨씬 낮은 GPT-4.1 Nano($0.10/$0.40, 2025년 4월)와 GPT-5 Nano($0.05/$0.40, 2025년 8월)만이 더 저렴합니다.
GPT-6 Luna용 펠리컨과 GPT-6 Sol용 펠리컨을 각각 생성한 뒤, GPT-5.6 펠리컨들과 함께 비교 그리드로 묶어봤습니다. 5.6 계열은 굵고 선명한 색감을 선택한 반면 6 계열은 훨씬 차분하고 절제된 색조를 보여준다는 점이 한눈에 들어와 흥미로웠습니다. 개인적으로는 여전히 max 설정의 GPT-6 Astra가 가장 훌륭한 펠리컨을 만들어냈다고 생각합니다.

Opus 5.5는 기존 Opus에 대한 가장 큰 불만이었던 소통 방식 문제를 개선한 것으로 보입니다. Thariq Shihipar의 말을 인용하면:
Opus 5.5는 여러분의 피드백이 만들어낸 결과물입니다.
명확하게 소통하고, Opus 5.0보다 토큰당 비용이 낮으며, Fable 5.1 수준의 지능을 갖추면서도 토큰 효율이 매우 높고, 모든 effort 수준에서 잘 작동합니다.
Blender 성능 개선도 이뤄졌다고 합니다. 직접 테스트해 보는 게 기대됩니다.
Opus 4.5, 4.6, 4.7, 4.8, 5는 모두 입력 $5/백만 토큰, 출력 $25/백만 토큰으로 동일한 가격을 유지했습니다. 5.5는 여기서 20% 인하된 입력 $4/백만, 출력 $20/백만입니다.
캐시 읽기 가격은 60% 인하됐습니다. 에이전트 대화가 길어질수록 입력 토큰의 90% 이상이 캐시 토큰 가격으로 처리되는 만큼, 이는 상당히 의미 있는 변화입니다.
Opus 5.5의 새 가격은 GPT-5.6 Sol과 동일하지만, 이는 OpenAI가 Sol 가격을 절반으로 내리기 전의 이야기입니다.
GPT-6 Astra와 Claude Fable 5.1은 모두 입력 $10/백만, 출력 $50/백만으로 동일한 가격대를 형성하고 있습니다. 현재 가격 전쟁은 그 아래 티어의 모델들에서 벌어지고 있습니다.
Anthropic은 Sonnet 5.5와 Haiku 5.5도 곧 출시될 예정이라고 밝혔습니다. 현재 Haiku 4.5는 $1/$5인 반면 최신 GPT-6 Luna는 그 10분의 1 수준인 $0.10/$0.50에 불과한 상황에서, Haiku가 저가 구간의 가격 경쟁력을 되찾을 수 있을지 지켜보는 것도 흥미로울 것 같습니다.
"자전거를 탄 펠리컨 SVG를 생성해 줘" 테스트를 시작한 이래 처음으로, "max" 추론 수준의 Claude Opus 5.5가 응답 생성에 실패했습니다!
모델은 이 요청을 "클래식한 테스트 요청"이라 칭하며, 무엇을 해야 할지 정말, 정말로 깊이 생각하기 시작했습니다:
이건 클래식한 테스트 요청이니, 독특한 부리와 목 주머니를 가진 펠리컨이 바퀴·프레임·페달이 제대로 갖춰진 자전거를 타는 모습을, 하늘과 지면을 단순하게 표현한 배경 위에 잘 구성해서 그려낼 계획을 세우고 싶습니다. [...]
정강이 길이가 약 95.2로 확인됐으니 충분합니다. 이제 가까운 쪽 다리의 경로를 엉덩이에서 무릎, 발목 순으로 계산하고, y=478-494 부근 페달 표면 위에 자연스럽게 얹히도록 직선과 곡선 패스로 발뒤꿈치, 발가락 끝, 발바닥 윤곽을 스케치하고 있습니다. [...]
바구니에서 눈에 띄게 튀어나온 생선을 펠리컨이 바라보는 모습은 살려둘 만한 재미있는 디테일입니다. 부리 아래쪽에 배치한 눈이 실제 펠리컨 해부학적 구조와 일치하는지도 확인하면서, 조금 더 밝은 표정을 줄지 고민 중입니다. [...]
멀리 있는 다리가 프레임 뒤로 지나가는 것처럼 제대로 보이니, 이제 체인링 톱니를 확인하고 레이어 순서를 점검합니다. 멀리 있는 크랭크 암은 시트 튜브와 체인링에 대부분 가려져야 합니다. 텍스트가 없으니 font-family는 필요 없고, 올바른 스케일링을 위해 최종 SVG의 width·height 속성과 viewBox를 정리하고 있습니다. [...]
이 펠리컨이 얼마나 기대됐는지 모릅니다... 그런데 모델이 멈춰버렸습니다. Opus 5.5는 다른 Claude 모델과 마찬가지로 출력 최대 토큰 한도가 128,000개인데, SVG에 대해 아직 추론 중인 상태에서 그 한도에 도달해버린 것입니다!
두 번째 시도에서도 결과는 같았습니다. 이제 "max" 설정이 사실상 무용지물이 아닌가 하는 의심이 듭니다. 단순한 SVG 프롬프트에서도 과도한 추론으로 실패한다면, 더 중요한 작업에서도 같은 일이 반복되지 않을 거라고 믿기 어렵습니다.
(두 번의 실패에서 각각 $2.56씩 소요됐고, 시간은 거의 20분에 달했습니다.)
반면 Fable 5.1을 "max"로 실행했을 때는 과도한 추론 없이 Anthropic 모델 중 제가 본 최고의 펠리컨을 만들어냈습니다.
5.5 max를 제외한 Opus 5.5 펠리컨들은 다음과 같습니다.
Opus 5, Fable 5.1, Sonnet 5의 펠리컨들과 함께 비교한 비교 그리드도 만들었습니다:

자전거를 탄 펠리컨 그리기 실력으로 벤더별 모델을 비교하는 게 지금 시점에 얼마나 의미 있는 일인지는 모르겠지만(애초에 의미가 있었는지도 모르지만), 같은 모델 패밀리 내에서 추론 수준별로 비교할 때는 여전히 유용한 방법이라고 생각합니다.
현재 Codex와 Claude Code의 기본 모델을 각각 GPT-6 Sol과 Claude Opus 5.5로 설정해 사용하고 있습니다. agent.datasette.io의 Datasette Agent 데모도 GPT-6 Luna로 업그레이드했는데, Datasette Apps용 SQL 쿼리와 HTML·JavaScript 작성 모두에서 빠르고 능숙한 모습을 보여주고 있습니다.
현재 보고 계신 것은 블로그의 장문 아티클만입니다. 모든 게시물을 받아보시려면 /atom/everything/을 구독하거나, 다른 구독 옵션을 확인해 보세요.