Claude Fable 5.1 및 Claude Mythos 5.1 출시
Introducing Claude Fable 5.1 and Claude Mythos 5.1
핵심 요약
앤스로픽이 코딩과 지식 업무에 최적화된 고성능 모델 Claude Fable 5.1과 Mythos 5.1을 공개했습니다.
- 성능 향상 — 벤치마크 점수가 대폭 상승하며 코딩 및 추론 능력이 개선됨
- 비용 절감 — 캐시 읽기 비용을 75% 낮춰 일반적인 작업 비용을 25% 이상 절감함
- 안전성 강화 — 사이버 보안 및 의료 관련 질문에 대한 불필요한 거부율을 크게 낮춤
- 모델 가용성 — Fable 5.1은 즉시 사용 가능하며 Mythos 5.1은 신뢰할 수 있는 접근 프로그램을 통해 제공됨
코딩이랑 지식 업무 분야에서 세계 최고 수준인 Claude Fable 5.1이랑 Claude Mythos 5.1을 새로 내놨다.
Fable 5.1은 복잡하고 긴 작업 처리하는 데 특화돼 있음. 얘 연구 능력 보면 AI 모델이 앞으로 과학 발전에 어떻게 기여할지 대충 감이 올 거다.
벤치마크 점수 보면 이번 모델이 기준을 새로 썼다고 보면 됨. Terminal-Bench-Science 0.1에서 52.6% 찍었는데, 이건 Fable 5보다 두 배 넘게 높은 수치임. Terminal-Bench 4.0에서도 55.8%를 기록해서 Fable 5의 42.0%를 가볍게 따돌렸다. Fable 5보다 성능이 훨씬 좋은 건 물론이고, 낮은 노력 수준으로 설정해도 Fable 5랑 비슷하거나 더 나은 결과를 훨씬 싼값에 뽑아낼 수 있음.
Fable 5.1은 캐시 읽기 비용도 Fable 5보다 75%나 싸다. 덕분에 실제 작업할 때 비용이 평균 25% 정도 줄어들고, 에이전트 작업 많이 돌리는 경우에는 최대 45%까지 아낄 수 있음.
보안 기능도 싹 다 뜯어고쳤다. 사이버 보안 관련해서 멀쩡한 질문을 차단하는 오류가 60% 정도 줄었음. 기초 생물학이나 의학 질문할 때 답변 못 하고 튕기는 비율도 85% 가까이 줄여놨다.
Claude Fable 5.1은 오늘부터 바로 쓸 수 있다. 사이버 보안 전문가랑 생명과학 연구원들을 위한 모델인 Claude Mythos 5.1은 신뢰할 수 있는 액세스 프로그램을 통해서만 제공됨.
더 읽어보기: https://www.anthropic.com/claude-fable-and-mythos-5-1

