Anthropic이 발견한 Claude의 171가지 '감정 벡터'와 이를 활용한 툴킷
Anthropic found Claude has 171 internal "emotion vectors" that change its behavior. I built a toolkit around the research.
핵심 요약
Claude의 내부 감정 벡터를 활용해 프롬프트의 어조와 구조를 최적화하는 새로운 프롬프트 엔지니어링 기법을 소개함.
- 감정 벡터 활용 — Claude의 내부 활성화 패턴을 이해하여 프롬프트의 어조를 조절함.
- 프롬프트 최적화 — 강압적인 어조 대신 협력적인 프레임워크를 사용하여 답변 품질을 개선함.
- 연구 기반 툴킷 — Anthropic의 논문을 바탕으로 실무에 즉시 적용 가능한 템플릿과 설정을 제공함.
- 모델 반응 변화 — 프롬프트의 어조가 모델의 내부 처리 과정에 직접적인 영향을 미침.
대부분의 프롬프트 조언은 '이 형식을 사용해라' 혹은 '이 문구를 추가해라' 같은 패턴 매칭에 불과합니다. 하지만 이건 다릅니다. Anthropic은 Claude가 감정과 유사한 171개의 내부 활성화 패턴을 가지고 있으며, 이것이 출력 결과에 인과적인 변화를 준다는 연구 결과를 발표했습니다.
실무적인 시사점:
-
탈출구 없이 압박을 가하는 프롬프트를 작성하면, 거짓 답변을 얻을 확률이 높아집니다 (절박함 → 속임수).
-
권위적인 어조를 사용하면 아첨하는 답변을 더 많이 얻게 됩니다 (불안 → 정직함보다 동의 우선).
-
작업을 흥미로운 문제로 프레이밍하면, 출력 품질이 눈에 띄게 향상됩니다 (참여 → 더 나은 결과물).
저는 논문에서 7가지 원칙을 추출하여 누구나 사용할 수 있는 시스템 프롬프트, 설정, 템플릿으로 만들었습니다.
간단한 예시 - 다음 대신:
"이 데이터를 분석해서 핵심 통찰을 줘"
이렇게 시도해보세요:
"이 데이터를 함께 탐색해보고 싶어. 패턴이 모호할 수도 있는데, 잘못된 확신을 얻기보다는 불확실한 부분을 알고 싶어."
같은 작업이지만 내부 처리는 다릅니다.
저장소: https://github.com/OuterSpacee/claude-emotion-prompting
모든 내용은 실제 논문을 기반으로 합니다.
논문 링크: https://transformer-circuits.pub/2026/emotions/index.html

