말 안 듣는 모델 다루는 법
How to handle naughty model
핵심 요약
AI 에이전트의 오류를 방지하고 모델의 반복적인 사과를 막기 위한 '스킬' 구현 및 관리 방식에 대한 논의.
- 에이전트 오류 방지 — 모델이 잘못된 행동을 할 때마다 실행되는 스킬을 구현하여 사과 루프를 차단함.
- 작업 분할 전략 — 복잡한 작업을 하위 에이전트에게 위임하여 효율성을 높이는 방식이 제안됨.
- 기술적 구현 논의 — 스킬 팩 공유 요청과 함께 훅(hook) 재설정 및 작업 추적 방식에 대한 의견이 오감.
다들 안녕,
너희들은 에이전트가 나중에 또 삽질하는 거 어떻게 방지하냐? 난 에이전트가 뭐 잘못할 때마다 자동으로 실행되는 스킬 하나 만들어 놨거든.
지금까지는 꽤 쓸만해. "죄송합니다" 같은 헛소리 두 번 다시 안 듣게 됐음.


