150개의 가상 테크 페르소나로 피치를 스트레스 테스트하는 Claude Code 스킬을 만들었습니다. 생각보다 훨씬 유용하네요.
I built a Claude Code skill that stress-tests a pitch through 150 simulated tech personas. It was more useful than I expected.
핵심 요약
150개의 가상 페르소나를 활용해 피치 자료를 다각도로 검증하고, 패턴을 분석해 글의 명확성을 높이는 도구를 개발한 사례.
- 가상 페르소나 검증 — 150명의 테크 업계 인물 기반 페르소나로 피치 자료를 스트레스 테스트함.
- 패턴 매칭 분석 — 다수의 페르소나가 공통으로 지적하는 문제를 찾아내어 글의 약점을 파악함.
- 도구의 한계 — AI 피드백은 명확성을 높이는 용도일 뿐, 실제 투자자 반응이나 시장성을 대체할 수는 없음.
- 오픈 소스 공개 — GitHub를 통해 누구나 자신의 피치 자료를 검증해 볼 수 있도록 공개함.
펀드레이징 하기 전에 나쁜 버릇이 하나 있는데, 아는 창업자 친구한테 덱 보내면서 "솔직히 말해봐, 이거 진짜 먹힐 것 같냐?"라고 물어보는 거다.
보통은 솔직하게 말해주긴 한다. 어느 정도는. 근데 그래 봤자 한 사람의 의견이고, 그날 기분에 따라 다르고, 그 사람 인맥 범위 내에서의 생각일 뿐이라 항상 예의상 하는 빈말이 섞이기 마련이지.
그래서 Claude Code 스킬을 하나 만들었는데, 이건 정반대의 문제를 해결해 준다. 피드백이 너무 과하게 쏟아진다는 거다.
이름은 synth-personas다. 피치 덱, 메모, 제품 기획서, 백서 같은 마크다운 파일을 던져주면, 시뮬레이션된 리뷰어 패널들이 달려들어서 탈탈 털어준다. 현재 라이브러리에는 테크 창업자, 투자자, 기자, 과학자, 그리고 가끔 튀어나오는 Hacker News 스타일의 냉소적인 인간들까지, 공개된 글이나 인터뷰를 기반으로 만든 페르소나 150개 정도가 들어있다.
여기서 진짜 쓸만한 건 "일론 머스크가 네 덱 별로라는데?" 같은 소리가 아니다. 물론 5초 정도는 웃기긴 하지만.
진짜 핵심은 패턴 매칭이다.
페르소나 5명이 뭘 싫어한다고 하면 그냥 무시하면 된다. 근데 90명이 똑같은 문단에서 걸려 넘어진다면, 그 문단은 진짜 문제가 있는 거다. 패널들 의견이 극명하게 갈리는 것도 흥미롭다. 보통 그건 아이디어가 구린 게 아니라 호불호가 확실히 갈린다는 뜻이니까.
이 스킬은 기준별 점수, 반복되는 반론, 카테고리별 분석, 그리고 각 페르소나의 가장 강력한 비판이 담긴 리포트를 뽑아준다. 페르소나들은 전부 마크다운 파일이라 직접 확인하고 수정하거나, 네 입맛대로 바꿀 수도 있다.
기술적으로는 꽤 간단하다:
-
Claude Code가 패널한테 피드백 요청할 때 스킬을 실행한다.
-
TypeScript CLI가 OpenRouter를 통해 모델 호출을 병렬로 쫙 뿌린다.
-
각 결과는 JSON으로 디스크에 저장되니까, 중간에 끊겨도 다시 이어가거나 재취합할 수 있다.
-
150명한테 다 물어보면 돈이 금방 깨지니까 --limit 옵션으로 제한을 걸 수도 있다.
-
출력 결과는 신탁이 아니라 숫돌로 써야 한다.
마지막 말이 중요하다. "AI 페르소나 150명이 내 스타트업 좋다고 했어"가 무슨 의미가 있다고 생각하지 않는다. 이건 고객 검증도 아니고, 투자자 피드백도 아니다. 트랙션은 더더욱 아니고.
근데 네 글이 뭉뚱그려져 있을 때 그걸 좀 더 명확하게 다듬는 용도로는 놀라울 정도로 쓸만하다.
지금까지 받은 결과 중 제일 뼈 아팠던 거: 내가 자신만만했던 덱이 참신함 점수에서 평타를 쳤고, 패널들이 입을 모아서 쉬운 부분은 구구절절 설명하면서 정작 어려운 부분은 대충 얼버무린다고 지적하더라. 걔들 말이 맞았다. 진짜 어려운 부분을 중심으로 다시 썼고, 다시 돌려보니까 피드백이 확실히 좋아졌다.
기분은 좋았는데, 곧 깨달았다. 내가 지금 가상의 포커스 그룹에 맞춰서 내 피치를 최적화하고 있었다는 걸.
어쨌든 오픈소스(MIT 라이선스)로 풀어놨으니까 관심 있으면 건드려봐라: github len5ky/synth-personas
다들 이 분야를 어떻게 생각하는지 궁금하다. "유용한 시뮬레이션 비판"과 "듣고 싶은 말만 들으려고 만든 정교한 기계" 사이의 선은 어디쯤일까?


