Claude Fable 5 증류 모델
Claude Fable 5 distilled
핵심 요약
Claude Fable-5의 데이터를 증류한 Qwable-v1 모델이 공개되었으나, 벤치마크 부재와 데이터 부족으로 회의적인 반응이 지배적입니다.
- 모델 증류 — Claude Fable-5의 데이터를 Qwen3.6-35B에 증류하여 학습함
- 데이터 출처 — Glint-Research의 공개된 4,659개 에이전트 코딩 추적 데이터를 사용함
- 벤치마크 부재 — 모델 성능을 입증할 벤치마크 결과가 전혀 공개되지 않음
- 커뮤니티 반응 — 성급한 공개와 성능에 대한 의구심으로 비판적인 의견이 많음
huggingface.co
원문 사이트로 이동
Qwable-v1을 공개함 — Anthropic의 Mythos급 프리뷰 모델인 Claude Fable-5(미국 수출 통제 지침에 따라 전 세계적으로 중단되기 전 약 4일간(2026-06-09 ~ 2026-06-12) 잠시 공개됨)에서 증류한 오픈 웨이트 Qwen3.6-35B-A3B 모델임.
Fable-5는 출시 당시 Anthropic의 가장 강력한 모델이었음 — SWE-bench Pro에서 80.3%를 기록했고, 출력 토큰당 $50였으며, API에 증류 방지 분류기가 내장되어 있어 실시간으로 사고 블록(thinking blocks)을 수정했음. Qwable-v1은 살아남은 데이터를 포착한 것임: 4,659개의 명확한 에이전트 코딩 추적(CoT가 포함된 유일한 공개 말뭉치인 Glint-Research/Fable-5-traces에서 재패키징됨)을 단일 H200에서 약 14시간 동안 Qwen3.6에 증류함. 에이전트 시스템 프롬프트를 주면, 이 모델은 Fable의 도구 인터페이스가 가중치에 스며들어 있어(단순 스타일뿐만 아니라) str_replace_editor와 같은 실제 Claude 스타일의 도구를 호출하는 올바른 형식의 <tool_use> XML을 출력함.
모델, GGUF(IQ4_XS / Q4_K_M / Q5_K_M / Q8_0) 및 SFT 데이터셋은 모두 HF에 공개되어 있음(업스트림에서 AGPL-3.0).


