Anthropic 역사상 가장 큰 너프: Claude Opus 4.7의 API 파라미터 삭제와 그로 인한 모델 성능 저하
The biggest nerf in Anthropic's history that nobody is talking about: Claude Opus 4.7 strips parameter support from the API, and the model is crippled because of it.
핵심 요약
Claude Opus 4.7 업데이트로 API 파라미터 제어가 불가능해지고 사고 과정 노출이 제한되면서 개발자들의 불만이 폭주함.
- API 파라미터 삭제 — temperature, top_p, top_k 설정이 불가능해져 모델의 결정론적 제어가 어려워짐.
- 사고 과정 은폐 — 기본적으로 사고 과정이 생략되어 사용자가 직접 옵트인해야 하는 불편함이 발생함.
- 모델 성능 저하 — 무작위 토큰 샘플링 강제로 인해 코드 생성 등 정밀한 작업의 품질이 떨어짐.
- 증류 방어 의혹 — 경쟁사의 모델 증류를 막기 위해 의도적으로 API 성능을 제한했다는 비판이 제기됨.
Anthropic은 확장된 사고(extended thinking) 기능이 비활성화될 때마다 모든 샘플링 파라미터 지원을 제거하기로 결정했습니다. Temperature도 없고, top_p도 없고, top_k도 없습니다. API 사용자들은 이제 기본값인 temperature = 1에 고정되었으며, 이는 출력물에 무작위 토큰 샘플링이 섞이는 것을 원치 않는 사람들에게는 정말 치명적입니다.
마이그레이션 문서에서 직접 확인해 보세요:
샘플링 파라미터 제거. Claude Opus 4.7부터는 temperature, top_p 또는 top_k를 기본값이 아닌 다른 값으로 설정하면 400 에러가 반환됩니다. 가장 안전한 마이그레이션 방법은 요청에서 이러한 파라미터를 완전히 생략하고, 프롬프팅을 사용하여 모델의 동작을 유도하는 것입니다. 결정론을 위해 temperature = 0을 사용했다면, 그것이 동일한 출력을 보장하지 않았다는 점을 참고하십시오.
사고 내용 기본 생략. Claude Opus 4.7부터는 사고 내용이 기본적으로 응답에서 생략됩니다. 사고 블록은 응답 스트림에 여전히 나타나지만, 호출자가 명시적으로 옵트인하지 않는 한 사고 필드는 비어 있게 됩니다. 이는 에러가 발생하지 않는 조용한 변경이며, 응답 지연 시간은 약간 개선될 것입니다. 추론 출력이 필요한 경우 display를 "summarized"로 설정하여 한 줄 변경으로 다시 옵트인할 수 있습니다.
그들의 정당화는 "결정론을 위해 temperature = 0을 사용했다면, 그것이 동일한 출력을 보장하지 않았다는 점을 참고하십시오"라는 허수아비 때리기 논리에 불과합니다. 어라, 뭐라고요? 프로그래밍을 위해 파라미터를 사용했던 실제 사용자들은 결정론 따위는 신경 쓰지 않았습니다. 우리가 temperature를 낮게 설정한 이유는 모델이 낮은 확률의 토큰을 무작위로 샘플링하는 것을 막기 위해서입니다. 그게 핵심입니다. 저는 요청을 보낼 때마다 토큰 복권을 하고 싶지 않습니다. 긴 코드를 생성할 때 저는 모델이 다음 단계로 가장 가능성이 높다고 평가한 토큰을 선택하기를 원하지, 주사위가 굴러가서 나온 엉뚱한 결과를 원하지 않습니다.
이제 강제된 기본값 1에서는 모든 요청이 주사위 굴리기입니다. 모델은 낮은 temperature에서는 절대 샘플링되지 않았을 낮은 확률의 토큰을 일상적으로 가져올 것이며, 우리가 할 수 있는 일은 전혀 없습니다.
그리고 사고 방식의 변경도 있습니다. 그들은 Gemini와 OpenAI의 뒤를 따라 원시 사고 과정을 제거하고 요약본으로 대체했습니다. 이게 얼마나 끔찍한지 강조할 수가 없습니다. 그들은 마지막 보루였습니다. 조용한 변경, 에러 없음, 기본적으로 옵트아웃 불가. 예전에는 눈앞에 바로 보이던 추론 과정을 보기 위해서라도 다시 옵트인해야 합니다.
그렇다면 이 모든 것의 진짜 이유는 무엇일까요? 그들은 큰 소리로 말하지는 않지만, 미묘하지도 않습니다. 이는 분명히 사용자의 이익이나 성능 향상을 위한 것이 아닙니다. 이것은 순수하고 단순한 증류 방어입니다. Anthropic은 중국 연구소들이 자신들의 모델을 복제하는 것을 두려워하고 있으며, 그들이 내린 해결책은 지구상의 모든 유료 API 사용자를 위해 제품을 적극적으로 저하시키는 것입니다.
Anthropic은 DeepSeek, Moonshot, MiniMax가 Claude를 상대로 산업 규모의 증류 캠페인을 벌이고 있다고 공개적으로 지목했습니다. temp = 0인 교사 모델의 깨끗한 로짓은 학생 모델을 위한 이상적인 훈련 신호입니다. 깨끗한 샘플링을 요청할 수 있는 기능을 제거하면 증류 과정을 오염시킬 수 있습니다. 그 부수적인 피해는 실제 업무를 위해 temp = 0에 의존했던 모든 정당한 개발자들입니다.
이것은 또한 아마도 스마트한 사용자들이 모델 동작을 재현해 온 방식에 대한 직접적인 대응일 것입니다. 아마도 누군가가 temperature = 0을 사용하여 Opus 4.5의 "영혼 문서"를 거의 단어 그대로 재구성하여 그들이 얼마 지나지 않아 공개하도록 강요했던 사건도 포함될 것입니다.
모델 성능은 적대적인 연구소들이 가중치를 가져가거나 동작을 증류하기 어렵게 만들기 위해 의도적으로 절름발이가 되고 있습니다. 우리는 해자 구축 연습의 부수적인 피해자입니다.
이것은 Anthropic이 지금까지 출시한 가장 큰 너프이며, 거의 완전히 레이더 아래에서 일어나고 있습니다. 사용자들에게는 역겨운 일입니다. API에게는 큰 퇴보입니다.


