새로운 모델: Spark-X2.5-4B, Spark-X2.5-1.7B
New Model: Spark-X2.5-4B, Spark-X2.5-1.7B
핵심 요약
iFlytek에서 출시한 1.7B 및 4B 규모의 새로운 경량 LLM인 Spark-X2.5 시리즈를 소개합니다.
- 독자적 아키텍처 — Qwen 파인튜닝이 아닌 자체 사전 학습된 모델 라인업임
- 성능 및 컨텍스트 — 4B 모델은 Qwen 3.5 9B와 대등하며 1M 컨텍스트를 지원함
- llama.cpp 호환성 — 현재 공식 지원은 대기 중이며 커스텀 포크를 통해 사용 가능함
- 학습 데이터 규모 — 20T 토큰이라는 방대한 데이터를 학습에 사용함
huggingface.co
원문 사이트로 이동
HF에서 작은 LLM들 좀 둘러보다가 이 모델 발견함. 파인튜닝 모델은 아닌 거 같고, 자체 아키텍처를 쓴 모델임.
https://huggingface.co/XHToken/Spark-X2.5-1.7B
https://huggingface.co/XHToken/Spark-X2.5-4B
4B랑 1.7B 버전이 있는데, 벤치마크가 꽤 흥미로움(4B가 Qwen 3.5 9B랑 거의 비등비등함). HF 페이지 보니까 두 모델 다 네이티브 1M 컨텍스트 사이즈 지원한다고 주장하네.
현재 llama.cpp에서 바로 돌리는 건 안 되고, 이 PR 대기 중임: https://github.com/ggml-org/llama.cpp/pull/27868
얘네가 돌려놓은 llama.cpp 커스텀 포크가 따로 있긴 함. 혹시 이거 써본 사람 있음?
업데이트:
GGUF 파일들(지금은 커스텀 포크 필수):
https://huggingface.co/XHToken/Spark-X2.5-1.7B-GGUF
https://huggingface.co/XHToken/Spark-X2.5-4B-GGUF


