회사에서 Claude Code 사용량을 측정하고 'AI 성과'로 엔지니어를 줄 세우라네요. 이거 좀 아닌 것 같은데...
My company started measuring our Claude Code usage - now I'm asked to rank engineers on 'AI performance.' This feels wrong...
핵심 요약
회사에서 Claude Code 토큰 사용량을 기준으로 엔지니어 성과를 평가하라는 지시에 대한 고민과 조언을 구하는 글.
- 성과 측정 논란 — 토큰 사용량을 기준으로 엔지니어의 생산성을 평가하려는 회사의 방침에 대한 반발.
- 잘못된 지표 — 토큰 사용량이 많다고 반드시 생산성이 높은 것은 아니며 오히려 비효율적인 작업 방식일 수 있음.
- 평가 방식 고민 — AI 활용 능력을 정량화하기 어려운 상황에서 리더로서 어떻게 대응해야 할지 조언을 구함.
- 지표 조작 우려 — 성과 지표로 사용될 경우 직원들이 수치를 맞추기 위해 AI를 남용할 가능성이 큼.
회사에서 Claude Code 사용량을 추적하기 시작했어요. 토큰이랑 비용 같은 것들이요. 그런데 이제 매니저가 그 수치를 가지고 'AI 성과'를 기준으로 엔지니어들을 줄 세우라고 하네요.
저는 이게 좀 불편해요(물론 선택권은 없지만요). 토큰 사용량은 성과를 측정하기에 완전히 잘못된 지표 같아요. 제 팀에서 가장 뛰어난 엔지니어는 Claude를 아주 정교하게 사용하는데, 토큰을 10배나 더 쓰는 사람은 생산성이 10배 높기는커녕 오히려 더 낮은 경우도 많거든요. 이런 걸로 순위를 매기면 결국 사람들이 지표를 조작하는 법만 배우게 될 거예요.
그래서 매일 Claude를 사용하거나 팀을 이끄는 분들께 여쭤봅니다:
- 회사에서 'AI 성과'를 측정하기 시작했나요? 어떻게 하고 있나요?
- 단순히 많이 쓰는 사람에게 보상을 주는 게 아니라, 실제로 좋은 성과와 연결되는 Claude/AI 사용 지표가 있을까요?
- 이런 지표를 측정하라는 압박을 받는 리더로서, 대놓고 거부하지 않으면서 어떻게 대응해야 할까요?


