Gemma 4 12B 첫 파인튜닝 모델들 출시
The first Gemma 4 12B finetunes are ready
핵심 요약
Gemma 4 12B 기반의 첫 파인튜닝 모델들이 허깅페이스에 공개되었습니다.
- 모델 공개 — Gemma 4 12B 기반의 파인튜닝 모델 4종이 배포됨
- GGUF 포맷 — 로컬 환경에서 구동 가능한 GGUF 형식으로 제공됨
- 주요 특징 — 검열 제거 및 abliterated 버전 위주로 구성됨
The first Gemma 4 12B finetunes are ready
Gemma 4 12B 기반의 첫 파인튜닝 모델들이 허깅페이스에 공개되었습니다.
사용자들이 Gemma 4 12B 모델의 파인튜닝 버전들에 관심을 보이며 기술적인 질문을 던지고 있음.
iGorls heretic 모델은 꽤 잘 만들었더라. 물론 대부분은 야한 거 하려고 쓰겠지만, 나처럼 실리콘밸리의 설교조인 '안전' 타령이나 가스라이팅, 헛소리 없이 솔직하게 대답해 주는 LLM이랑 대화하고 싶은 사람들도 있다고. 적어도 나를 애 취급하지 않는 모델이 있다는 건 좋은 일이지. 실리콘밸리 너희들은 내 부모가 아니라고.
Heretic 모델들이 진짜로 sycophancy를 피하긴 하냐?
시스템 프롬프트에 그렇게 하라고 지시하면 대부분의 모델(일반 모델들도 포함)은 그렇게 함. 너무 아부 떨거나 비현실적이지 않으면서도 재밌고 매력적으로 대답하게 할 수 있음. 확실하게 하려면 실제 프롬프트에 한 번 더 상기시켜 주는 것도 좋고.
흠 그런 거 시도해 봤는데 제대로 된 적이 없음. 나 ML 연구하는데, 모델들이 테스트하려는 기술이 실패했을 때조차도 긍정적인 결과를 내도록 실험을 설계해 버리는 경우가 많음. 만약 Heretic 모델들이 그걸 피할 수 있다면 Claude Opus보다 훨씬 유용할 텐데.
딸쟁이들의 천국이네
Abliterated 모델들의 KL divergence 수치는 어느 정도인가요?
사용자가 자신의 타이핑 속도를 측정해 LLM의 토큰 생성 속도(t/s)와 비교하는 웹 도구를 만들어 공유했습니다.


사용자가 자신의 타이핑 속도를 측정해 LLM의 토큰 생성 속도(t/s)와 비교하는 웹 도구를 만들어 공유했습니다.
AI 에이전트들이 담배를 피우며 여유를 부리는 영상에 대한 유머러스한 반응과 원작에 대한 고찰이 이어짐.


AI 에이전트들이 담배를 피우며 여유를 부리는 영상에 대한 유머러스한 반응과 원작에 대한 고찰이 이어짐.