새롭게 업데이트된 선형 가격 대비 지능 및 응답 시간 차트
New updated linear pricing vs intelligence vs response time chart
핵심 요약
로그 스케일 대신 선형 스케일을 적용하여 모델별 가격, 지능, 응답 시간을 비교한 새로운 차트입니다.
- 선형 스케일 비교 — 로그 스케일 대신 직관적인 선형 스케일로 모델 성능과 비용을 시각화함
- 응답 시간 분석 — 모델별 지능뿐만 아니라 실제 작업 수행 시 소요되는 응답 시간을 함께 고려함
- 가성비 모델 추천 — Luna xhigh와 Sol medium이 성능과 비용 측면에서 효율적인 선택지로 주목받음
- Terra 모델 비판 — 가격 대비 응답 시간이 지나치게 느려 실용성이 떨어진다는 의견이 제기됨
Artificial Analysis에서 모델별 지능이랑 가격 비교해 놓은 거 봤는데, 로그 스케일 말고 선형 스케일로 다시 그려달라고 ChatGPT한테 시켜봤음. (도대체 누가 비선형 스케일로 생각하고 비교하냐? ㅋㅋㅋ) 7월 말에 OpenAI가 새로 책정한 가격도 반영했고. 모델들한테 똑같은 과제 던져줬을 때 얼마나 걸렸는지(즉, 얼마나 고민했는지)도 다 나와 있음. 나중에 다른 모델로 팩트체크도 해봤는데 얼추 맞는 듯. 혹시 틀린 거 있어도 나한테 뭐라 하지 마라. 5.5 데이터는 그대로임.
Luna max가 가성비랑 지능 면에서 괜찮아 보이는데, 시간까지 고려하면 Luna xhigh가 딱 적당한 스위트 스팟인 듯.
ChatGPT 메모:
OpenAI가 가격 80% 후려치고 나서 보니까, Luna max는 Intelligence Index 과제당 $0.05 꼴에 점수 52점인데, sol low는 $0.23이나 처먹으면서 점수는 51점임.
문제는 응답 속도임. Max급 추론은 존나 느려짐. AA 표준 엔드투엔드 테스트 기준으로 Luna max는 약 138초, sol max는 약 149초, terra max는 약 207초 걸림.
차트 하단에 출처랑 방법론 적혀 있음.


