Hugging Face가 abliterated 모델을 제재하기 시작한 걸까?
Is HF starting to move against abliterated models?
핵심 요약
Hugging Face가 안전 인프라 구축을 위해 협력한다는 소식에, 오픈소스 커뮤니티는 검열 없는 모델의 미래를 우려하며 대안을 모색하고 있습니다.
- 안전 인프라 협력 — Hugging Face가 Baseten 등과 협력해 오픈 모델의 안전성 평가 및 모니터링을 강화함
- 검열 우려 — abliterated 모델을 '위험'하다고 규정한 발표에 대해 커뮤니티가 검열 가능성을 경계함
- 탈중앙화 대안 — 토렌트나 분산형 저장소 등 Hugging Face를 대체할 오픈소스 배포 방안이 논의됨
- 기술적 무용론 — 로컬 환경에서 직접 모델을 abliterate 할 수 있어 중앙화된 제재가 실효성이 낮다는 의견이 지배적임
techcrunch.com
원문 사이트로 이동
Baseten(https://www.baseten.co)이 수요일에 Base Labs 연구 부서와 함께 새로운 안전 인프라 표준을 발표했어. Hugging Face, Goodfire AI랑 손잡고 오픈 웨이트 모델을 위한 안전성 평가 및 모니터링 인프라를 구축하겠다는 건데.
이번 발표는 오픈 웨이트 모델의 안전성을 둘러싼 논쟁이 한창일 때 나왔어. abliteration이라는 기법으로 안전장치를 죄다 제거해서 모델을 위험하게 만드는 일이 늘고 있거든. 문제 규모가 장난 아냐. 오픈 소스 AI 모델을 호스팅하는 Hugging Face에 현재 6,000개가 넘는 abliterated 모델이 올라와 있거든.
이 '파트너십'이 정확히 어떤 의미를 갖는지, Hugging Face의 모델 호스팅 측면에 구체적으로 어떤 영향을 줄지는 잘 모르겠어. 근데 Hugging Face가 "위험한" 검열되지 않은 모델들을 콕 집어 언급하면서 '인프라 안전' 협력을 발표하는 게 좀 꺼림칙하네. 다들 어떻게 생각해?


