3개월 동안 개인 AI 비서를 만들고 나니, 거품이 현실보다 크다는 생각이 든다.
After 3 months building my personal AI assistant, I think hype > reality.
핵심 요약
개인 AI 에이전트를 직접 구축해 본 작성자가 기대와 현실의 괴리를 토로하며 자율 에이전트의 한계를 지적합니다.
- 에이전트 구축 실패 — 3개월간 공들인 OpenClaw가 잦은 오류와 신뢰성 부족으로 실망감을 줌
- 거품과 현실 — AI 트위터의 과장된 광고와 달리 실제 자율 에이전트는 실무에 적용하기 어려움
- 워크플로우 개선 — 복잡한 에이전트보다 Claude의 기본 기능이 생산성 향상에 더 효과적임
- 신뢰성 문제 — 자율적인 에이전트보다 결정론적 스크립트와 LLM의 조합이 훨씬 안정적임
지난 2~3개월 동안 매일 OpenClaw 에이전트를 개선해왔다.
약 3억 7,800만 토큰을 태웠다.
MCP 스킬을 추가했다.
더 많은 툴을 연결했다.
내 데이터를 학습시켰다.
VPS에서 24시간 내내 돌렸다.
한때 AI 트위터는 자율 AI 비서가 미래라고 믿게 만들었다.
모두가 이런 글을 올렸다:
“내 AI가 내 삶을 운영해”
“내 AI가 모든 일정을 잡아”
“내 AI가 내가 자는 동안 일해”
그래서 올인했다.
그런데 현실은?
내 OpenClaw는 여전히:
- 지시사항을 오해함
- 무작위로 충돌함
- 보안 실수를 저지름
- 신뢰할 수 없는 결과물을 내놓음
솔직히… 생산성보다는 거품을 쫓느라 시간과 돈을 낭비하는 기분이 들기 시작했다.
아이러니하게도, 내 “완벽하게 개인화된” 설정보다 Claude AI가 내 워크플로우를 더 많이 개선해줬다.
특히 Claude 루틴 기능이 그랬다.
그걸 통해 중요한 사실을 깨달았다:
AI 거품과 AI 현실은 지금 매우 다르다.
자율 에이전트를 만드는 건 흥미로운 일이다.
하지만 신뢰할 수 있는 자율 에이전트를 만드는 건 완전히 다른 차원의 게임이다.
혹시 나처럼 벽에 부딪힌 사람 또 있나?


