PrismML, Qwen-3.6-27B 압축 버전 공개 - 아이폰에서 역대 최대 규모 AI 모델 구동 주장
Compressed Version of Qwen-3.6-27B coming from PrismML - Khosla-Backed Startup Claims Breakthrough With Largest-Ever AI Model on an iPhone
핵심 요약
PrismML이 27B 파라미터의 Qwen 3.6 모델을 4GB 미만으로 압축해 아이폰에서 구동하는 기술을 선보였습니다.
- 모델 압축 기술 — 27B 파라미터 모델을 54GB에서 4GB 미만으로 축소함
- 온디바이스 구동 — 아이폰 17 Pro에서 전체 파라미터를 활성화하여 복잡한 작업 수행
- 학술적 배경 — 칼텍(Caltech) 연구진이 설립한 스타트업으로 독점 특허 기술 보유
- 향후 전망 — 3년 내 AI 연산의 95%가 로컬 기기에서 처리될 것으로 예측
archive.is
원문 사이트로 이동
스타트업인 PrismML은 중국 인터넷 거물 알리바바가 개발한 오픈소스 거대 언어 모델인 Qwen 3.6을 아이폰 17 Pro에서 돌아가게끔 압축했다고 밝혔다. 이 모델은 270억 개의 파라미터를 가지고 있는데, 이는 뇌의 시냅스와 대략 비슷한 개념으로 모델이 처리할 수 있는 데이터의 복잡성을 결정하는 데 도움을 준다. 반면, 현재 모바일 폰에서 돌아가는 대부분의 모델은 한 번에 활성화되는 파라미터가 고작 몇십억 개 수준이다.
파라미터가 수조 개에 달하는 가장 거대한 AI 모델들은 여전히 모바일 기기에서 돌리기엔 너무 크다. 하지만 PrismML이 아이폰에서 작동시킨 모델은 복잡한 채팅, 추론, 완전 자율 에이전트, 소프트웨어 코딩 같은 작업이 가능하다는 게 스타트업 측 설명이다. 이 오픈소스 모델은 다음 주 화요일부터 다운로드할 수 있다.
PrismML의 CEO인 바박 하시비(Babak Hassibi)는 인터뷰에서 앞으로 AI의 대다수가 결국 기기 자체에서 처리될 것이라고 내다봤다.
하시비는 "한 3년 뒤쯤을 상상해 봐. 필요한 지능의 95%는 내 폰, 노트북, 가전제품 같은 로컬 기기에서 바로 쓸 수 있고, 진짜 고사양 작업 5% 정도만 클라우드에 접속하면 되는 세상 말이야."라고 말했다. "사람들도 다 그렇게 미래가 흘러갈 거라고 보고 있어."
그는 모델을 기기에서 돌아가게끔 줄이는 게 "AI의 경제 구조를 근본적으로 바꾼다"고 덧붙였다.
PrismML은 수학적 트릭을 써서 Qwen 3.6 모델을 원래 크기의 아주 작은 수준으로 줄였다. 보통 모델을 줄이면 성능이 떨어지기 마련인데, 이 회사는 자기네 AI 모델 경량화 기술은 성능 저하가 없다고 주장한다. PrismML은 Qwen 3.6의 크기를 기존 약 54기가바이트에서 4기가바이트 미만으로 압축했다.
PrismML은 캘리포니아 공과대학교(Caltech)에서 분사한 기업이다. 이 학교 전기공학 교수인 하시비와 공동 창업자들은 스타트업 기술의 기반이 된 수학적 연구를 바로 이곳에서 진행했다. 해당 기술의 특허는 칼텍이 보유하고 있지만, PrismML에 독점 라이선스를 줬다.
하시비는 PrismML이 앞으로 파라미터가 수조 개 단위인 더 큰 AI 모델들도 계속 압축할 계획이며, 이렇게 되면 OpenAI의 GPT나 Anthropic의 Claude 같은 최첨단 모델 영역까지 넘볼 수 있게 될 것이라고 말했다.
애플은 새로운 시리(Siri) 발표의 일환으로 일부 아이폰 신규 AI 기능이 기기 자체에서 구동될 것이라고 밝혔다. 애플의 새로운 온디바이스 모델 하나는 200억 개의 파라미터를 가지고 있지만, 이른바 '희소(sparse) 아키텍처'를 사용해서 한 번에 10억~40억 개의 파라미터만 활성화된다. 반면 PrismML의 온디바이스 모델은 270억 개의 파라미터가 전부 동시에 활성화된다.


