Claude는 왜 일반적인 대화나 리서치 작업에서 이렇게 별로일까?
Why is claude so bad at plain talk and research?
핵심 요약
Claude의 과도한 신중함과 모호한 프롬프트 해석 능력 저하에 대한 사용자들의 상반된 경험과 불만 토로.
- 성능 불만 — 일반적인 대화나 리서치 작업에서 Claude의 과도한 신중함과 모호한 해석 능력이 문제됨.
- 프롬프트 해석 — 명확한 작업은 잘 수행하지만 모호한 지시사항을 이해하는 데 어려움을 겪음.
- 사용자 경험 — Claude의 지나친 교정 시도와 토큰 절약형 답변 방식이 작업 효율을 떨어뜨린다는 의견이 있음.
- 상반된 평가 — 리서치 작업에서 Claude가 ChatGPT보다 더 자연스럽고 효율적이라는 반대 의견도 존재함.
난 코드랑 디자인할 때 Claude 쓰는데, 이거 진짜 현존 최고 툴임.
근데 Opus 5 이 새끼는 "여기 비정형 메시지 리스트 있는데 여기서 게임 이름만 다 뽑아줘" 같은 존나 단순한 리서치나 대화 작업할 때도 가이드라인을 엄청나게 줘야 하고 티키타카를 계속해야 함. 엉뚱한 게임 가져오지 말고, 있는 게임 빼먹지 말고 그냥 제대로 하라고 이해시키는 데만 5분 걸림. 지난달에 Claude Max 쓰면서 이런 일을 한두 번 겪은 게 아님.
ChatGPT는 첫 시도에 바로 알아먹고, 리서치 속도도 Claude보다 훨씬 빠르고 핵심만 딱 짚어줌. Claude는 자꾸 무슨 "함정"을 피하려 하거나, 내가 실수한 걸 꼬투리 잡거나, 아니면 아예 현실 부정까지 해서 봇이랑 일하는 게 아니라 말싸움하는 기분이 들 때가 있음.
이게 뭐 신중하게 생각하는 메커니즘이 있는 게 아니라, 그냥 억지로 신중한 척하라는 지시가 박혀 있는 느낌임. Claude가 "너 이거 놓쳤어, 이게 핵심이야!"라고 할 때마다 존나 불안해지는데, 막상 까보면 그냥 오타 하나 난 거임. 사람 피 말리게 함.
그리고 얘네 출력 토큰 최대한 아끼려고 하는 거 다 보임. 분명 "답변 압축해서 내놔" 같은 지시사항 박아놨을 게 뻔함. 진짜 개빡침. 양쪽 회사 다 사용자한테 말도 안 하고 몰래 제한 걸어두는데, 덕분에 한 달에 한 번 결제하는 게 아니라 중간에 구독 갈아타야 할 판임.
문제 투성이다 진짜. 이 분야 좀 안정화되고 업계 표준 같은 거 생기기 전까진 답답해 죽겠네.


