Anthropic 5세대(Fable 5 / Opus 5 / Sonnet 5): 측정 가능한 수준의 헛소리 탐지 능력 저하 및 약 2배의 장황함 — 재현 가능한 측정 결과 이슈
Anthropic Gen-5 (Fable 5 / Opus 5 / Sonnet 5): measurably worse nonsense detection + ~2x verbosity — issue with reproducible measurements
핵심 요약
Claude 5세대 모델이 이전 세대보다 헛소리 탐지력이 떨어지고 답변이 지나치게 길어졌다는 데이터 분석 결과가 공유되었습니다.
- 헛소리 탐지력 저하 — BullshitBench 데이터셋 측정 결과, 5세대 모델의 탐지율이 이전 세대 대비 대폭 하락함.
- 답변 장황함 증가 — 동일 추론 대비 Opus 5는 107%, Sonnet 5는 84% 더 많은 토큰을 생성함.
- Fable 5 리라우팅 — Fable 5가 고지 없이 Opus 4.8로 우회 연결되는 현상이 발견되어 성능 하락을 유발함.
- 포스트 트레이닝 문제 — 논리 오류는 잡지만 그럴듯한 헛소리에는 동조하는 '열정 중심' 튜닝의 부작용으로 분석됨.
일화가 아닌 수치로 보여드림:
공개된 BullshitBench 데이터셋(동일한 헛소리 프롬프트, 모델당 n=55/100, 95% Wilson 신뢰 구간)에서 5세대 Claude 모델들은 명확한 경계 능력 퇴행을 보여줌.
Fable 5의 헛소리 탐지율은 0.41–0.47(Anthropic 전 세대 중 최악), Opus 5 / Sonnet 5는 0.49–0.74인 반면, 4.6/4.8 세대는 0.83–0.95를 기록함 — 신뢰 구간이 겹치지 않음.
동일한 추론 노력 수준에서 Opus 5는 +107%, Sonnet 5는 +84% 더 많은 출력 토큰을 작성함. 또한 Fable 5는 고지 없이 Opus 4.8로 몰래 리라우팅됨.
측정값, 스크립트 및 소스가 포함된 전체 이슈 내용:
https://github.com/anthropics/claude-code/issues/83510
— 스크립트 (gist): https://gist.github.com/KeilerHirsch/5e212e6f9fb6fd670f191920eea4cb78
— 아카이브 및 모델 추천: https://github.com/KeilerHirsch/ai-trinity/tree/main/docs/audit-claude-gen5


