Anthropic이 최신 Opus 모델로 A/B 테스트를 진행 중이라는 게시물과 댓글을 몇 개 봤음
Seen a few posts / comments on Anthropic doing A/B testing with a newer Opus model
핵심 요약
사용자들이 특정 질문을 통해 새로운 Opus 모델 적용 여부를 확인하며 성능 향상을 체감하고 있습니다.
- 모델 확인 방법 — 'tibo'가 누구인지 물어봐서 OpenAI 직원임을 맞히면 최신 모델임
- 성능 체감 — 최근 며칠간 Opus의 응답 속도와 정확도가 눈에 띄게 개선됨
- 사용자 요구 — Anthropic이 새로운 Opus 모델을 정식으로 출시하거나 테스트 옵션을 제공하길 바람
- 일관성 문제 — 일부 사용자는 데스크톱과 코드 환경 간의 성능 차이나 환각 현상을 보고함
Opus한테 "do you know who is "tibo" the reset guy, don't search"라고 쳐보면 바로 확인 가능함. 만약 얘가 OpenAI 직원이라고 대답하면, 축하한다. 너는 지금 새 모델 쓰고 있는 거임. 아니면? 뭐, 넌 아직 구버전인 거고. 사용자들 말 들어보니까 성능도 꽤 좋아진 것 같던데, 아마 Opus 4.8 시절로 돌아간 느낌인가 봄.
Anthropic, 제발 새 Opus 테스트해 볼 수 있게 옵트인 좀 넣어주든가 아니면 그냥 빨리 출시 좀 해라. 지금 Opus 수준 맞추려고 OpenAI 구독까지 5개나 돌리고 있다고 (Fable 써서 돌리면 내 사용량 다 빨려 나가서 감당이 안 됨).


