새로운 벤치마크 등장
New benchmark just dropped
핵심 요약
Claude의 새로운 벤치마크 결과에 대한 커뮤니티의 반응과 Anthropic의 정책에 대한 논의가 이어짐.
- 벤치마크 성능 — 높은 점수가 더 좋다는 당연한 사실에 대한 공감대 형성
- 지역 제한 논란 — 미국 시민권자조차 인증 문제로 서비스 이용이 어렵다는 불만 제기
- 마케팅 전략 — Anthropic이 자사 모델의 위험성을 과장하여 마케팅에 활용한다는 의혹
- 모델 발전 속도 — 몇 달 내로 모든 모델이 현재의 최상위 성능에 도달할 것이라는 전망
아마 OpenAI도 분발해야 할 듯.

