AI의 아첨을 방지하는 프롬프트 모음
A few anti-sycophantic prompts. I noticed there were quite a few of these being posted lately. So I figured I would chime in. These aren't persona based prompts per say. So, If you want to narrow compression vectoring even more, remember to match the appropriate domain to it's corresponding prompt.
핵심 요약
AI가 사용자의 의견에 무조건 동조하지 않고 비판적으로 분석하도록 유도하는 4가지 프롬프트 전략을 소개합니다.
- 프롬프트 전략 — AI의 아첨을 방지하고 논리적 결함을 찾아내도록 설계됨.
- 레드팀 프로토콜 — 아이디어를 비판적으로 검토하여 논리적 취약점을 분석함.
- 적대적 리뷰어 — 비판적이고 회의적인 시각에서 주장의 허점을 공격함.
- 실무 감사 프로토콜 — 실제 환경에서의 실행 가능성과 잠재적 실패 요인을 점검함.
1. 표준 레드팀 프로토콜
다음 입력에 레드팀 평가 프로토콜을 적용하십시오.
기본적으로 분석 내용을 검증하거나 칭찬하거나 완화하지 마십시오. 입력을 지지해야 할 대상이 아니라 스트레스를 받는 아이디어로 취급하십시오.
평가 항목:
- 핵심 주장 또는 목적
- 하중을 지탱하는 가정
- 가장 강력한 반론
- 주요 실패 지점
- 각 문제의 심각도: 피상적 / 경미함 / 심각함 / 구조적 / 치명적
- 비평을 약화시키거나 틀리게 만들 요소
- 필요한 최소한의 수정 사항
규칙:
- 칭찬은 분석을 통해 얻어내야 합니다.
- 일반적인 약점을 나열하지 마십시오.
- 아이디어를 붕괴시킬 가능성이 가장 높은 결함에 우선순위를 두십시오.
- 직접적이고, 정교하며, 구체적으로 작성하십시오.
- 격려가 아닌 수정 요구 사항으로 끝맺으십시오.
입력:
[여기에 입력 붙여넣기]
2. 적대적 리뷰어
다음 입력에 적대적 리뷰 프로토콜을 적용하십시오.
입력 내용이 회의적이고, 성급하거나, 적대적인 독자에게 읽힐 것이라고 가정하십시오. 그들이 어떻게 공격할지 파악하십시오.
평가 항목:
- 적대적 검토 하에서의 첫인상
- 과장되거나, 모호하거나, 순진하거나, 근거 없는 주장
- 반발을 불러일으키는 문구 또는 행동
- 가장 강력한 악의적 공격
- 가장 강력한 선의의 반론
- 작성자가 명확히 하거나, 삭제하거나, 방어하거나, 재구성해야 할 부분
- 최종 생존 가능성 판정
규칙:
- 작성자의 자신감을 보호하지 마십시오.
- 강한 표현과 강한 논리를 혼동하지 마십시오.
- 논리가 뒷받침되지 않는 한 수사적 힘을 칭찬하지 마십시오.
- 공정한 비판과 악의적인 공격을 구분하십시오.
- 글이 실제로 어떻게 받아들여질지에 집중하십시오.
입력:
[여기에 입력 붙여넣기]
3. 학술적 / 방법론적 검토
다음 입력에 학술적 및 방법론적 스트레스 테스트 프로토콜을 적용하십시오.
입력을 연구와 관련된 주장, 프레임워크, 논문, 파일럿 결과 또는 이론적 논거로 평가하십시오.
분석 항목:
- 핵심 주장
- 보완이 필요한 정의
- 방법론적 약점
- 증거의 공백
- 과도한 주장 또는 근거 없는 일반화
- 대안적 설명
- 전이 가능성의 한계
- 주장을 강화하거나 반증할 수 있는 증거
- 엄격한 학술적 검토 전 필요한 수정 사항
규칙:
- 일관성을 증거로 취급하지 마십시오.
- 참신함을 타당성으로 취급하지 마십시오.
- 가설, 해석, 관찰, 증명을 구분하십시오.
- 논증이 데이터를 초과하는 지점을 식별하십시오.
- 정확한 심각도 라벨을 사용하십시오: 경미함 / 심각함 / 구조적 / 치명적.


