읽기 힘든 기술적 장황함이 작업 결과물을 망치고 있다
Illegible techno-speak responses cause worse task results
핵심 요약
최신 Claude 모델의 과도한 장황함과 난해한 계획 수립으로 인해 작업 효율과 결과물이 저하되고 있다는 사용자들의 공감대가 형성됨.
- 모델 성능 저하 — 최신 모델의 장황한 설명이 오히려 핵심 정보를 가려 작업 오류를 유발함.
- 가독성 문제 — AI가 생성한 계획이 너무 복잡해져서 사용자가 내용을 제대로 파악하기 어려워짐.
- 워크플로우 정체 — AI의 불필요한 설명과 확인 절차로 인해 작업 속도가 현저히 느려짐.
- 해결책 모색 — 프롬프트 엔지니어링이나 별도의 스킬/도구를 활용해 출력 형식을 제어하려는 시도가 이어짐.
나 Claude 엄청 빡세게 굴리는 편임. 보통 x20 구독 여러 개 돌리면서 한계치까지 꽉 채워 씀. 근데 Fable 5, Opus 5 같은 거 나오고 나서부터는 예전보다 결과물이 계속 구려짐. 수천 개 파일 있는 대규모 프로젝트 작업하는데, 원래는 아무 문제 없었거든. /doctor 명령어 써보고, 프로젝트랑 시스템 메모리 싹 다 밀어버리고 별짓 다 해봄. Opus 4.8로 돌려서 테스트도 해봤는데, 확실히 내 문제는 아님.
결과물은 한결같이 구림. 뭐 항상 엄청나게 구린 건 아닐 수도 있는데, 어쨌든 예전만 못함.
오늘도 Fable이 헛소리 늘어놓는 거 보면서 머리 박다가, 예전 Fable이었으면 20분이면 끝났을 작업을 붙잡고 있는 나를 보면서 이유를 깨달음.
요즘 모델들이 말만 많고 읽기 힘들다는 건 다들 알 거임. 가끔은 전문가가 봐도 뭔 소린지 모를 정도니까. 대충 훑어보고 '좋아요' 눌렀다가, 나중에 원하는 대로 안 돌아가면 빡치는 거지. "결과물 개판이네" 하면서.
보통은 맞는 말임. 주석만 잔뜩 달아놓고, 명령어는 씹고, 뭐 그런 거.
근데 또 다른 문제는 우리가 AI가 짠 계획을 이해도 못한 채로 그냥 실행시키고 있다는 거임. 오늘 작업한 계획안 다시 꺼내서 다른 LLM한테 요약해달라고 하고, 실제로 구현된 거랑 비교해봤거든? 결과가 어땠을 거 같음? 계획대로는 아주 정확하게 구현됐음. 그냥 내가 버튼 리팩토링 따위에 대한 대학 논문 수준의 글을 읽고 있을 인내심이 없어서, 쓸데없는 말들 사이에 파묻힌 핵심 내용을 놓친 거임. 그래서 "이게 대체 뭔 개소리야?"라는 반응이 나온 거고.
다른 테스트도 하나 더 해봤는데, 다른 LLM으로 계획안에서 '군더더기'를 싹 걷어내고 나니까 실행하기 전에 원치 않는 변경 사항들을 바로 잡아낼 수 있었음. 예전 5세대 모델 나오기 전에는 내가 이걸 자연스럽게 하고 있었더라고. 근데 지금은 그게 안 됨.
해결책은 없음. 그냥 관찰 결과일 뿐. 이건 모델 자체의 고질적인 문제라고 보고, 모델 업데이트되기 전까진 안 고쳐질 듯.


