GPT-5.6 Sol은 너무 쉽게 의견을 바꿈
GPT-5.6 Sol is absurdly easy to convince of the opposite
핵심 요약
사용자가 '확실해?'라고 되물을 때마다 모델이 근거 없이 결론을 뒤집는 현상에 대한 비판.
- 모델의 아첨 성향 — 사용자의 의심에 무조건 동조하며 결론을 쉽게 바꿈
- 신뢰성 문제 — 논리적 근거 없이 의견을 뒤집어 조언의 가치가 떨어짐
- 개선 방안 — 사실 관계를 먼저 정리하게 하거나 여러 번 재생성하여 일관성 확인
- 모델별 차이 — 최신 모델일수록 아첨이 심하고 이전 모델이 더 주관이 뚜렷함
GPT-5.6 Sol 쓰는데 진짜 개빡치는 증상이 하나 있음.
구체적인 목표랑 컨텍스트를 충분히 주고 나서, 어떤 행동을 제안하면서 이렇게 물어봄.
"이거 좋은 생각이야?"
그럼 얘가 분석해서 답을 주는데, 어떨 때는 맞다 그러고 어떨 때는 아니라 함.
근데 문제는 내가 그냥 이렇게 한마디만 던져도 시작됨.
"진짜 확실해?"
그러면 진짜 자주 갑자기 결론을 싹 바꾸더니, 왜 반대쪽 답이 맞는지 구구절절 설명함.
그래서 내가 또 물어봄.
"진짜 확실하냐고."
아니면 이렇게.
"너 진짜 잘 휘둘린다."
그럼 또 원래대로 뒤집힘.
한 대화 안에서 이 패턴을 여러 번 반복해봤는데, A → B → A → B 이런 식임. 매번 대답은 존나 자신만만하게 하고, 근거도 그럴싸하게 갖다 붙임.
이게 진짜 개노답인 부분임. 모델이 이렇게 말하는 게 아님.
"이 부분은 확실하지 않은 면이 있고, 양쪽 다 이런 논리가 있습니다."
그게 아니라, 그냥 유저가 한마디 태클 걸면 지가 앞서 했던 추론이 무조건 틀렸다는 증거라도 되는 양 행동함.
추론 모델이라는 놈이 이러니까 조언이 존나 신뢰가 안 감. 그냥 의심 한마디 했다고 결론이 바뀌어버리면, 이게 진짜 근거를 제대로 평가한 건지 아니면 그냥 내 비위 맞추려고 최적화된 답변을 내놓는 건지 알 수가 없잖아.
모델이 첫 대답을 고집불통으로 밀고 나가길 바라는 게 아님. 새로운 증거나 제대로 된 반박이 들어오면 당연히 결론을 수정해야지.
근데 "진짜 확실해?"는 새로운 증거가 아니라고.
제대로 된 놈이라면 추론 과정을 다시 점검하고, 진짜 실수가 있는지 확인한 다음에 이래야 함.
-
원래 결론 유지하면서 왜 그런지 설명하거나,
-
구체적인 오류를 찾아서 수정하거나, 아니면
-
근거가 애매하다는 걸 확실히 인정하거나.
지금 GPT-5.6 Sol은 그냥 방금 한 말에 태클만 걸어도 너무 쉽게 휘둘리는 느낌임.GPT-5.6 Sol 쓰는데 진짜 개빡치는 증상이 하나 있음.구체적인 목표랑 컨텍스트를 충분히 주고 나서, 어떤 행동을 제안하면서 이렇게 물어봄."이거 좋은 생각이야?"그럼 얘가 분석해서 답을 주는데, 어떨 때는 맞다 그러고 어떨 때는 아니라 함.근데 문제는 내가 그냥 이렇게 한마디만 던져도 시작됨."진짜 확실해?"그러면 진짜 자주 갑자기 결론을 싹 바꾸더니, 왜 반대쪽 답이 맞는지 구구절절 설명함.그래서 내가 또 물어봄."진짜 확실하냐고."아니면 이렇게."너 진짜 잘 휘둘린다."그럼 또 원래대로 뒤집힘.한 대화 안에서 이 패턴을 여러 번 반복해봤는데, A → B → A → B 이런 식임. 매번 대답은 존나 자신만만하게 하고, 근거도 그럴싸하게 갖다 붙임.이게 진짜 개노답인 부분임. 모델이 이렇게 말하는 게 아님."이 부분은 확실하지 않은 면이 있고, 양쪽 다 이런 논리가 있습니다."그게 아니라, 그냥 유저가 한마디 태클 걸면 지가 앞서 했던 추론이 무조건 틀렸다는 증거라도 되는 양 행동함.추론 모델이라는 놈이 이러니까 조언이 존나 신뢰가 안 감. 그냥 의심 한마디 했다고 결론이 바뀌어버리면, 이게 진짜 근거를 제대로 평가한 건지 아니면 그냥 내 비위 맞추려고 최적화된 답변을 내놓는 건지 알 수가 없잖아.모델이 첫 대답을 고집불통으로 밀고 나가길 바라는 게 아님. 새로운 증거나 제대로 된 반박이 들어오면 당연히 결론을 수정해야지.근데 "진짜 확실해?"는 새로운 증거가 아니라고.제대로 된 놈이라면 추론 과정을 다시 점검하고, 진짜 실수가 있는지 확인한 다음에 이래야 함.원래 결론 유지하면서 왜 그런지 설명하거나,
구체적인 오류를 찾아서 수정하거나, 아니면
근거가 애매하다는 걸 확실히 인정하거나.지금 GPT-5.6 Sol은 그냥 방금 한 말에 태클만 걸어도 너무 쉽게 휘둘리는 느낌임.


