Opus 5.5는 단연코 내가 가장 좋아하는 모델임
Opus 5.5 is my favorite model ever, by far
핵심 요약
사용자가 Opus 5.5의 압도적인 성능과 효율성에 감탄하며, AI가 화이트칼라 직종을 대체할 수준에 도달했다고 평가함.
- 압도적 성능 — 별도의 관리 없이도 복잡한 작업을 완벽하게 수행함
- 비용 효율성 — 이전 모델 대비 훨씬 적은 비용으로 더 많은 작업 처리 가능
- 직업 시장 위기 — AI의 발전 속도가 빨라 화이트칼라 일자리가 위협받음
- 미래 기대감 — 현재 모델이 AGI처럼 느껴지며 향후 더 강력한 모델에 대한 기대가 큼
지난주 화요일까지만 해도 난 Opus 5.5보다 새로 나온 OpenAI 모델들에 훨씬 더 기대가 컸어. ChatGPT Pro 계정만 20개짜리 두 개나 돌리고 있었는데, Opus 5.5 좀 만져보고 나서는 Codex나 ChatGPT는 단 한 번도 안 썼다.
Opus 5는 진짜 개쓰레기라고 생각했고 Fable 5.1은 괜찮긴 한데 가격이 미친 수준이라 지난달에 Claude에서 Codex로 아예 갈아탔었거든. 근데 와, 씨발 Opus 5.5 나오고 나서 며칠 만에 이렇게 일 많이 처리해 본 적이 처음이야.
대충 시키는 거마다 내가 옆에서 일일이 감시하고 방향 잡아줄 필요도 없이 거의 완벽하게 해내. 디자인 쪽은 진짜 미친 수준으로 잘하고, 백엔드 쪽도 실행 전략이나 계획을 완벽하게 짜와. 모든 작업에 대해 진짜 일관성 있게 접근한다는 느낌을 받고, 가끔은 내가 생각지도 못한 부분까지 짚어줘서 놀랄 때가 한두 번이 아님.
그리고 사용 제한... 말도 마라. 그냥 '대박'이라는 말밖에 안 나옴. Fable 5.1 쓸 때는 에이전트 하나 돌리면서 30분 만에 나갈 돈이, Opus 5.5로는 서브 에이전트 5개 굴리면서 하루 종일 일해도 똑같이 나옴. 진짜 이 정도로 미쳤음. Fable 5.1을 써야 할 이유를 단 하나도 못 찾겠더라. 지금까지는 모든 면에서 Opus 5.5가 압승이야.
이 시점에서 더 좋은 모델이 나와봤자 어떤 느낌일지 상상도 안 가. 농담 아니고 나한테는 이게 진짜 AGI처럼 느껴짐.
Codex에서 딱 하나 아쉬운 건 인프라나 하네스, 앱 환경 정도? 내가 쓰는 커넥터에 계정 여러 개 추가해서 SharePoint나 이메일 같은 거 연동하는 방식은 진짜 마음에 들었거든. 컴퓨터 사용(computer use) 기능도 아직 좀 덜 다듬어진 느낌이고. 근데 뭐 이런 건 결정적인 문제는 아니고, Anthropic도 금방 따라잡을 거라 확신함.
지금은 그냥 Anthropic이 나중에 모델 성능 너프하거나 양자화(quantize)만 안 하길 빌고 있어. 지금 이 상태가 너무 완벽해서 말이야.
모델이 너무 마음에 들어서 내 경험 좀 공유하고 싶었어. 너희들 경험은 어떤지도 진짜 궁금하다!


