감사합니다 :) Swift Qwen 3.8 27B 다운로드 10만 회 돌파, HuggingFace 트렌딩 1위 파인튜닝 모델 및 9위 모델 등극
Thank you :) Swift Qwen 3.8 27B now has 100k+ downloads, is #1 finetune and #9 model on HuggingFace Trending
핵심 요약
Swift Qwen 3.8 27B 모델의 성공적인 출시를 기념하며 커뮤니티의 기여에 감사를 표하고 향후 업데이트 계획을 공유함.
- 모델 성능 최적화 — 불필요한 사고 패턴을 제거하여 토큰 사용량 58.3% 감소 및 속도 1.95배 향상
- 커뮤니티 협업 — 사용자들의 파인튜닝 및 양자화 기여로 모델의 인지도와 성능이 크게 개선됨
- 향후 업데이트 예고 — Swift1.5 버전 및 Flash Next 모델 출시를 통해 벤치마크 성능 강화 예정
- 언센서드 버전 공유 — 커뮤니티의 요청에 따라 검열이 제거된 다양한 파인튜닝 버전들이 활발히 공유됨
다들 안녕,
UkisAI의 Jovan이야. 우리는 작은 규모의 프론티어 LLM을 가능하게 만드는 기술을 개발하는 작은 연구소고, 당연히 오픈소스로 하고 있어!
이 글을 쓴 이유는 그냥 우리 모델에 관심을 가져주고, 원본 릴리즈 이후에 기가 막힌 파인튜닝이랑 양자화, 그리고 전반적인 개선을 해준 커뮤니티 형들한테 고맙다는 말을 하려고 왔어. 덕분에 우리가 이 방향으로 계속 개발할 수 있는 힘을 얻었거든! 형들이 시간 쪼개서 기여해주지 않았으면 지금 결과물의 절반도 못 냈을 거야.
참고로 말하자면:
Swift Qwen 3.8 27B는 우리가 처음으로 공개한 오픈소스 모델이야. 작은 LLM 내부에서 발생하는 병적인 과잉 사고 패턴을 페널티로 제어하면, 단순히 짧게 생각하게 만드는 게 아니라 더 효율적으로 생각하게 만들어서 정확도 손실 없이 토큰 사용량을 -58.3% 줄이고 속도를 1.95배 높일 수 있다는 걸 증명했지.
우리는 계속 개발 중이고 곧 다음 모델들을 내놓을 거야:
- Swift1.5 Qwen3.8 27B (학습 버그 좀 잡고 RL 더 때려 박아서 개선한 체크포인트)
- Swift Qwen3.8 Flash Next (다음 주쯤 나올 예정인데, 설레발치거나 불완전한 결과 내놓기 싫어서 지금 벤치마크 돌리는 중이야)
이번에는 형들이 제안해준 대로 코딩이랑 장기 문맥(long horizon) 테스트를 포함해서 벤치마크를 훨씬 더 많이 돌렸어!
Swift 써본 형들은 다음 모델 릴리즈 때 어떤 양자화나 기능, 변경 사항이 필요한지 알려주면 진짜 대박일 것 같아. 저번에는 형들이 요청한 것들 절반도 생각 못 했거든. 이번엔 더 잘해보고 싶어 :)
자, 이제 쓰레기 같은 파인튜닝은 끝내고 제대로 된 시대 한번 열어보자고!
EDIT: 링크 - https://huggingface.co/ukisai/Swift-Qwen3.8-27b https://huggingface.co/ukisai/Swift-Qwen3.8-27B-GGUF https://huggingface.co/bartowski/ukisai_Swift-Qwen3.8-27b-GGUF


