Ornith 1.5 35B GGUF 모델이 "조용히" 업데이트된 거 눈치챈 사람 있음?
Did anyone else notice the Ornith 1.5 35B GGUFs got a "silent" update?
핵심 요약
Ornith 1.5 35B GGUF 모델이 별다른 공지 없이 업데이트되어, 작성자가 파일 차이점을 분석하고 사용자들의 경험을 묻는 글.
- 모델 업데이트 — 별도 공지 없이 GGUF 파일의 가중치와 메타데이터가 수정됨
- 기술적 분석 — 작성자가 이전 백업과 현재 파일을 비교하여 변경 사항을 확인
- 사용자 경험 — 동일한 구조지만 보정 방식이 달라져 성능 변화 여부가 궁금함
- 데이터 관리 — 모델 파일의 변경 사항을 추적하는 투명성 도구의 필요성 제기
다들 안녕, 재밌는 거 하나 발견해서 묻히기 전에 공유하려고 글 쓴다.
한동안 Ornith 1.5 35B A3B GGUF (Q4_K_M) 돌리고 있었는데, 최근에 HF 캐시에 새 리비전이 떴길래 그냥 예전 거 정리할 겸 새로 받았거든. 그러다 나중에 뭐가 바뀐 건지 궁금해서 파고들었는데, 이게 생각보다 골 때리는 상황이더라고.
결론부터 말하자면, 공식 GGUF 저장소에 올라온 8월 24일 자 "업데이트"는 그냥 파일 다시 올린 게 아니었음. 커밋 메시지도 "Upload <file> with huggingface_hub"라는 영양가 없는 소리뿐이라 더 수상하길래, Btrfs 백업에서 예전 스냅샷 꺼내서 현재 파일이랑 diff 떠봤거든. Q4_K_M에서 바뀐 점은 다음과 같음:
-
가중치 자체가 바뀌었음. 원시 텐서 바이트를 비교해 봤는데 첫 바이트부터 다르더라. 그냥 껍데기만 바꾼 동일한 양자화가 아니라는 소리임.
-
임포턴스 매트릭스(importance matrix) / 캘리브레이션이 다름. GGUF 메타데이터에 작성자 컴퓨터 경로가 그대로 박혀 있는데, 이게
35b-4000에서ornith-1.5-35b로 바뀌었음. 예전 파일에 있던general.version = "4000"이랑general.finetune = "35b"필드가 새 파일에선 삭제된 거랑 딱 맞아떨어짐. -
라벨이 깔끔해짐.
size_label이"256x2.6B"에서"35B"로 바뀌었고,license,tags,basename같은 정보들이 추가됨.
미리 말해두는데, 이거 서드파티 미러가 아니라 공식 ornith-ai 저장소 기준으로 확인한 거니까, 다른 데서 받은 사람은 이미 파일이 다를 수도 있음.
흥미로운 건 구조적인 부분은 전부 똑같다는 거임. 아키텍처(qwen35moe), 248k 토크나이저, file_type, 전문가 개수, 컨텍스트 길이까지 다 똑같음. 그러니까 같은 모델 패밀리인데, 캘리브레이션 체크포인트만 새로 돌려서 양자화 다시 하고 라벨만 정리한 셈이지. 파일 전체 크기도 몇백 바이트밖에 차이 안 나서 아무도 눈치 못 챈 듯.
아무튼, 이거 업데이트된 거 본 사람 또 있나 궁금하다. 실제로 써봤을 때 체감되는지도 알고 싶고. 새로운 캘리브레이션 경로(ornith-1.5-35b) 보니까 이게 진짜 성능이 좋아진 건지, 아니면 그냥 정리만 한 건지 궁금하네. 둘 다 돌려본 사람 있음?
(그리고 Btrfs 스냅샷 덕분에 살았다. hf prune 좋긴 한데, 진짜로 '정리'를 해버리니까 문제네.)
EDIT: 이번 업데이트가 이 글에서 말한 "랜덤" MTP 헤드 문제 고치려고 한 건가 싶기도 하고.

