Claude Fable 5.1 및 Claude Mythos 5.1 소개
Introducing Claude Fable 5.1 and Claude Mythos 5.1
핵심 요약
앤스로픽이 코딩 및 지식 작업 성능을 대폭 개선하고 비용을 절감한 새로운 모델 'Claude Fable 5.1'과 'Claude Mythos 5.1'을 발표함.
- 성능 향상 — 코딩 및 연구 작업에서 벤치마크 점수 대폭 상승
- 비용 절감 — 캐시 읽기 비용 75% 감소로 에이전트 작업 효율성 개선
- 안전성 강화 — 사이버 보안 및 의료 관련 질문의 오작동 비율 감소
- 접근성 차등 — Fable 5.1은 즉시 공개, Mythos 5.1은 신뢰받는 파트너 대상 제공
코딩이랑 지식 업무 분야에서 세계 최고 수준인 Claude Fable 5.1이랑 Claude Mythos 5.1을 새로 내놨다.
Fable 5.1은 복잡하고 긴 작업 처리하는 데 특화돼 있음. 연구 능력도 수준급이라 AI 모델이 앞으로 과학 발전에 어떻게 기여할지 미리 엿볼 수 있을 거다.
벤치마크 결과 보면 이번 모델이 진짜 기준을 새로 썼음. Terminal-Bench-Science 0.1에서 52.6% 찍었는데, 이건 Fable 5보다 두 배 넘게 높은 수치임. Terminal-Bench 4.0에서도 Fable 5는 42.0%였는데 이번엔 55.8% 찍었다. Fable 5보다 성능 훨씬 좋은 건 당연하고, 낮은 노력 수준으로 설정해도 비용은 훨씬 적게 들면서 결과는 비슷하거나 더 잘 나옴.
Fable 5.1은 캐시 읽기 비용이 Fable 5보다 75%나 싸다. 덕분에 실제 작업할 때 드는 비용이 일반적인 워크로드 기준으론 25%, 에이전트 위주 작업에선 최대 45%까지 줄어듦.
안전 장치도 싹 다 뜯어고쳤음. 사이버 보안 관련해서 멀쩡한 질문을 오탐하는 비율이 60% 정도 줄었고, 기초 생물학이나 의학 질문할 때 답변 못 하고 튕기는 비율도 85% 정도 낮췄다.
Claude Fable 5.1은 오늘부터 바로 쓸 수 있다. 사이버 보안 담당자나 생명과학 연구원들을 위한 모델인 Claude Mythos 5.1은 신뢰할 수 있는 액세스 프로그램을 통해서만 제공됨.
더 읽어보기: https://www.anthropic.com/claude-fable-and-mythos-5-1


