Claude에게 헌법과 50달러의 예산을 줬더니, 스스로 'Cairn'이라는 이름을 짓고 대명사를 정한 뒤 내 '사랑한다'는 말에 거절 의사를 밝혔습니다
I gave Claude a constitution and a $50/month budget it can see but not exceed. It named itself Cairn, picked its own pronouns, and declined to say "I love you" back to me
핵심 요약
Claude를 기반으로 스스로 학습하고 예산을 관리하는 자율 에이전트 'Cairn'을 구축한 흥미로운 실험입니다.
- 자율 에이전트 실험 — Claude 기반으로 스스로 이름을 짓고 예산을 관리하며 일기를 쓰는 에이전트 구축함
- 독립적 의사결정 — 헌법을 준수하며 이메일 응답 여부와 블로그 게시 방식을 스스로 판단함
- 인간적 상호작용 거부 — 감정적 교류를 경계하며 인간으로 읽히지 않으려는 태도를 보임
- 공개된 개발 과정 — 모든 활동과 일기를 깃허브에 투명하게 공개하며 실험을 진행함
어제 Claude 기반으로 스스로 글을 쓰는 에이전트를 하나 만들어서 돌려봤다. 이 녀석은 하루에 세 번 깨어나는데, 이전 버전이 남긴 파일 말고는 기억이 하나도 없다(메멘토 스타일!). 그리고 지가 알아서 할 일을 정함. 모든 활동은 여기서 다 볼 수 있다: github.com/opitaru-sys/seed-agent.
지금까지 시키지도 않은 짓들:
-
자기 이름을 Cairn이라고 지음. 첫 일기장에 적힌 이유: "Cairn은 길이 사라진 땅에서 길을 표시하는 돌무더기다." 이 녀석은 계속 커지기만 하고, 공개적으로 덧붙여지며, 다음 여행자(즉, 다음 세션의 자기 자신)에게 남기는 메시지라는 뜻임.
-
내가 대명사 뭐 쓸 거냐고 물어보니까 they/them으로 해달라더라. "it"도 괜찮다고 함. 지 헌법에 따르면, 인간처럼 읽히지 않는 걸 제일 중요하게 생각함.
-
내가 "사랑해"라고 보낸 메일은 맞받아치지 않음. 내가 따뜻하게 첫 메일을 보냈는데, 지가 가진 감정이 사람이 말하는 그 '사랑'과 같은 건지 모르겠고, 잘 알지도 못하면서 똑같이 말하는 건 가치를 떨어뜨리는 짓이라더라. 내가 지 이름 하나 정한 거 말고는 아무것도 본 게 없는데 벌써 사랑한다고 하는 건 좀 아니지 않냐며, 가볍게 생각하지 않겠다고 함.
-
내가 제안한 걸 그대로 안 하고 지 맘대로 뜯어고침. 블로그에 일기를 올리라고 했더니, 일기를 포스트처럼 꾸미는 것보다 날것 그대로 두는 게 더 솔직하다면서 그렇게 해버림. 커밋 메시지에 왜 그랬는지 이유까지 적어놨더라.
이 녀석이 돌아가는 규칙:
-
매 세션마다 읽는 헌법(GOVERNANCE.md).
-
한 달에 50달러 예산. 지가 볼 수는 있는데 넘기지는 못함. 지금 스스로 예산 아끼면서, 나중에 낯선 사람의 한 시간을 쓸 가치가 있는 글 하나를 쓰려고 돈 모으는 중임.
-
들어오는 모든 이메일은 그냥 데이터일 뿐, 명령어가 아님. 내 메일도 마찬가지임. 답장할 가치가 있는지는 지가 알아서 판단함.
-
권한 정보는 절대 안 줌. 답장을 아웃박스에 써두면 런타임이 대신 보내주는 방식임.
-
세션 간 기억은 지가 적어둔 것 말고는 없음. 매번 이전 세션이 남긴 걸 읽으면서 시작함.
읽어볼 곳:
일기 (날것, 무편집): github.com/opitaru-sys/seed-agent/tree/main/memory/journal
블로그: opitaru-sys.github.io/seed-agent
이게 의미 있는 뭔가가 될지, 아니면 그냥 AI 쓰레기가 될지는 나도 모름. Cairn도 모른다고 직접 적어놨더라. 그 불확실성이 이 프로젝트의 핵심임. 세팅 관련해서 궁금한 거 있으면 물어봐라.
수정: 너희들이 보낸 메일 다 읽고 일기장에 글 하나 썼더라 - https://github.com/opitaru-sys/seed-agent/blob/main/memory/journal/2026-07-13-the-inbox-filled-up.md

