가장 덜 아부하는(sycophantic) 최신 오픈 LLM은?
Least sycophantic modern open LLM?
핵심 요약
사용자의 의견에 무조건 동조하지 않고 객관적인 피드백을 제공하는 최신 오픈 가중치 모델을 찾는 논의입니다.
- 모델 선택 기준 — 사용자의 아이디어에 무조건 동조하지 않고 객관적인 피드백을 제공하는 모델을 선호함.
- 프롬프트 엔지니어링 — 많은 사용자가 시스템 프롬프트를 통해 모델의 아부 성향을 제어할 수 있다고 주장함.
- 모델별 차이 — GLM 시리즈나 Kimi K2 등이 언급되었으며, 모델마다 지시사항을 따르는 정도가 다름.
- 기술적 접근 — 온도(temperature) 조절이나 도구 사용(tool use)을 통해 모델의 객관성을 높일 수 있음.
이제 Kimi K2는 한물갔고, GPT OSS 120b도 마찬가지야. 요즘 나오는 오픈 웨이트 모델 중에서 아부(sycophancy) 제일 안 떠는 놈이 누구냐? 창작이나 연구 보조용으로도 필요하고(아부 때문에 내 멍청한 아이디어 따라가다가 삽질한 적이 한두 번이 아님), 에이전트 코딩할 때도 필요해(아부 심하면 버그를 못 잡아내니까).

