중국 검열이 나랑은 상관없을 줄 알았는데, 아니었음.
I thought Chinese censorship didn't affect me. I was wrong.
핵심 요약
중국산 LLM API를 사용하다가 '6월 4일'이라는 날짜 때문에 검열 오류가 발생한 경험담.
- 검열 오류 발생 — API 호출 중 6월 4일 관련 내용으로 인해 차단됨
- 중국 검열 영향 — 중국 서버 기반 API 사용 시 중국 법규 준수로 인한 필터링 확인
- 모델 vs API — 모델 자체보다는 API 제공업체의 키워드 필터링일 가능성이 높음
- 투명성 문제 — 학습 데이터와 파이프라인이 공개되지 않은 모델의 신뢰성에 대한 의문 제기
디버깅 중에 LLM이 뻗어버림:
debug_log 설정은 기본값이 "debug.json"이고 FileHandler를 생성하는데, 이게 기본적으로 내용을 덧붙이는(append) 방식임. 그 파일은 발생한 모든 일의 기록인데, 절대 지워지지 않음. 그 안에 있는 6월 4일 에러들은 수정 전의 과거 기록임.
결론: 두 에러 모두 이미 존재했고 수정된 것들임. 아무 조치도 필요 없음 — 디버그 로그가 그 이후로 잘리지 않았을 뿐임.
만약
Stream error: litellm.MidStreamFallbackError: litellm.InternalServerError: AnthropicException - [1301][System detected potentially unsafe or sensitive content in input or generation. Please avoid using prompts that may generate sensitive content. Thank you for your cooperation.][202606111650441794ae4d7ccf42f6]. Handle with `litellm.InternalServerError`.. Received Model Group=glm-5.1 Available Model Group Fallbacks=None
뭐, 오늘 배운 건데 천안문 사태가 6월 4일에 일어났고, 내 애플리케이션에 JSON 에러가 기록된 날도 바로 그날이었음 😂


