최신 Opus 모델은 오늘날 개발자들의 코딩 패턴에 맞춰 비용 효율을 극대화하도록 가격 책정과 훈련 방식을 새롭게 설계했습니다.
토큰 기반 과금 기준으로, Claude Opus 5.5는 Opus 5 대비 일반적인 워크로드 실행 비용이 약 40% 저렴할 것으로 예상됩니다. 개발자 입장에서는 이 절감이 실제로 어떻게 쌓이는지가 중요합니다.
토큰 단위로 비용을 내는 경우, 실행 시간이 길고 컨텍스트가 많은 세션일수록 비용 차이가 크게 납니다. 이는 지난 6개월 사이 Claude Code에서 급격히 늘어난 세션 유형과 정확히 일치합니다.
이 글에서는 오늘날(그리고 아마 내일도) 개발자들의 코딩 방식에서 Opus 5.5가 비용 효율적인 이유를 구체적으로 살펴봅니다.
2026년 3월부터 9월까지 개발자들의 Claude Code 사용 패턴을 집계 데이터로 분석했습니다. 모델 성능이 향상됨에 따라 개발자들은 에이전트를 점점 더 정교한 방식으로 활용하고 있습니다. 세션당 프롬프트 수는 크게 변하지 않았지만, 몇 가지 흥미로운 패턴이 발견됐습니다.

이 모든 수치는 개발자들이 더 많은 정보를 갖춘 Claude를 더 크고 개방형인 작업에 투입하고 있음을 보여줍니다. 이런 유형의 세션에서는 컨텍스트 엔지니어링이 비용에 미치는 영향이 복합적으로 커집니다.
간단히 말해, Claude는 더 많은 토큰을 읽습니다. 제공하는 컨텍스트가 모두 꼭 필요한 것인지 확인해야 하고, 그 컨텍스트를 최대한 캐시에서 읽도록 해야 합니다.
오래 실행되고 컨텍스트가 많은 세션을 더 비용 효율적으로 만드는 변화는 세 가지입니다. 가격 정책, 모델 동작 방식, 그리고 Claude Code 하네스입니다. 하나씩 살펴보겠습니다.
토큰 기반 과금의 경우, 입력·출력 토큰 비용을 20% 낮췄고, 캐시 토큰 읽기 비용은 60% 인하했습니다. 후자의 인하 폭이 더 중요한데, 에이전트 작업과 코딩 작업 비용의 대부분이 캐시 읽기에서 발생하기 때문입니다.
앞서 언급했듯 요청당 컨텍스트가 6개월 만에 약 2.6배 늘었는데, 이는 절감 효과가 올바른 방향으로 커지고 있다는 의미입니다. 동일한 가격 변경이라도 오늘날의 Claude Code 트래픽에서는 6개월 전보다 더 많은 비용을 아낄 수 있습니다. 재사용되는 컨텍스트가 청구 비용에서 차지하는 비중이 커졌기 때문입니다.
이 글을 게재하는 시점 기준으로, Opus 5.5의 캐시 토큰 비용은 경쟁 모델의 5분의 1 수준이면서 성능은 더 뛰어납니다.

이는 Opus 5.5 자체보다 지난 6개월간 Claude Code에 추가된 여러 기능의 결과에 가깝습니다. 앞서 살펴본 코딩 세션 트렌드를 보면 캐시 미스율이 높아졌을 것 같지만, 실제로는 반대입니다. 캐시를 벗어나는 입력이 50% 이상 줄었습니다.
예를 들어, 로그인 새로고침처럼 사소한 동작으로 캐시가 의도치 않게 깨지는 일을 줄였습니다. 대화 중 지시사항을 추가하거나 온디맨드로 툴을 불러오는 것처럼 더 큰 동작에 의한 캐시 초기화도 방지했습니다. Opus 5.5와 Fable 5.1 같은 신규 모델에서는 이제 세션 중 노력 수준을 바꿔도 캐시가 초기화되지 않습니다.
장기 실행 세션과 위임 세션에서의 캐시 활용도도 높였습니다. API 키나 클라우드 프로바이더를 사용하는 개발자는 이제 캐시 유지 시간을 1시간으로 설정할 수 있으며(구독자에게는 이미 제공된 기능), 분기된 서브에이전트는 동일한 컨텍스트 비용을 다시 부담하는 대신 부모 에이전트의 캐시에서 시작합니다.
Opus 5.5는 동일한 작업을 다른 모델보다 적은 턴으로 완수할 수 있습니다. Zeta Labs는 Opus 5 대비 작업당 턴 수와 툴 호출 횟수가 줄었으면서도, 비용은 절반 수준이고 가장 어려운 작업의 완료율은 2배에 달하는 결과를 확인했습니다.
물론 모든 작업에 해당하는 이야기는 아닙니다. Opus 5.5 작업 비용에서 Addy는 이렇게 썼습니다. "범위가 명확하게 정해진 작업에서는 두 모델 모두 비슷한 턴 수로 끝나며, 가격 인하만큼의 절감이 전부입니다. 격차는 모델이 잘못된 방향으로 여러 턴을 소모할 수 있는 개방형 작업에서 가장 크게 벌어집니다. 어떤 단일 수치도 모든 코드베이스에 들어맞지 않으므로, 직접 측정해 보세요."
다시 말해, 단순하고 짧으며 기계적인 작업은 턴 수가 동일하지만, 길고 어려운 작업일수록 Opus 5.5가 잘못된 접근에 토큰을 낭비하지 않을 여지가 큽니다. 턴 수를 줄이는 것은 캐시 토큰보다도 비용 효율이 높습니다.
특히 Claude가 오랫동안 감독 없이 혹은 중단 없이 작업하는 경우라면 주목할 점이 하나 더 있습니다. Opus 5.5는 Opus 5 대비 출력 속도가 30% 이상 빠릅니다. 캐시 히트율을 높이거나 토큰 사용량을 줄이지는 않지만, 장기 실행 작업에서 기다리는 시간이 줄어든다는 의미입니다.
에이전트 코딩이 성숙해지면서 조직의 관심사도 무조건적인 확장에서 효율적인 확장으로 옮겨갔습니다. Claude Code에서 /usage를 실행해 전체 사용량 중 캐시 읽기가 차지하는 비중을 확인하세요. 그리고 그 수치를 지켜야 합니다.
이러한 습관이 복합적으로 작용하는 개방형·고컨텍스트 작업에 Opus 5.5를 활용하고, 실제 수치는 Opus 5.5 작업 비용에서 확인하세요.