와 이거 진짜 대박 논문이네; 컨텍스트 언어 모델
Y'all this is a sexy paper; context language models
핵심 요약
모델이 컨텍스트를 파일처럼 실시간으로 수정하게 하여 성능과 효율을 높이는 새로운 접근 방식을 다룬 논문입니다.
- 컨텍스트 관리 — 모델이 컨텍스트를 파일처럼 직접 수정하여 메모리 효율 개선
- 성능 향상 — 장기 작업 및 복잡한 연구 과제에서 결과물 품질 개선
- 계산 효율성 — SGLang 캐싱 최적화를 통해 추론 속도 및 자원 효율 최적화
- 기술적 한계 — 특정 엔진 의존성 및 프롬프트 인젝션 위험 증가 가능성
arxiv.org
원문 사이트로 이동
논문 링크 - Context Language Models
이 논문의 핵심 아이디어는 존나 간단함. 모델한테 파일을 수정하듯이 실시간으로 컨텍스트를 수정할 수 있는 능력을 주면, 작업 성능이랑 컨텍스트 관리(메모리), 심지어 계산 효율성(실제 소요 시간 및 총 FLOPs)까지 싹 다 좋아진다는 거임. 논문 보면 장점은 개쩌는데 단점은 별로 없음.
pi용 플러그인으로 직접 써볼 수도 있음.
요약: 장단점
장점:
-
장기 실행 작업에서 결과물 퀄리티 상승
-
코딩이나 심층 연구 작업
-
오픈 디스커버리 문제(장기 연구 과제, /goal 루프 등)
-
-
추론 과정에서 계산 효율이랑 실제 소요 시간 단축 가능
- 참고로 이건 추론 엔진의 캐싱 최적화에 따라 다름
-
컨텍스트 낭비가 훨씬 줄어들어서 (V)RAM 효율이 좋아짐
-
느리고 불안정한 요약(compacts) 과정이 필요 없음
단점:
-
캐시 최적화는 SGLang에서만 지원함
-
프롬프트 인젝션(환각 지시 포함)을 까먹을 확률이 훨씬 낮아져서 위험성 증가
-
하네스 커스텀이 필요함 (저자들이 pi 플러그인 제공함)
추가 정보
이 방식은 하네스를 수정해서 컨텍스트를 파일처럼 접근하게 만드는 식으로 작동함. 모델이 다른 파일 수정하듯이 컨텍스트를 마음대로 고칠 수 있게 해주는 거임.
qwen3.6 9b 같은 작은 모델부터 qwen3.8 27b, claude sonnet 4.6까지 테스트해 봤다고 함.
그냥 시스템 프롬프트에 살짝 추가해서 컨텍스트를 파일처럼 수정하는 도구만 쥐여줘도, 작업 성능이나 컨텍스트 관리, 효율성 지표가 비슷하거나 조금 더 좋아짐. 특히 작은 모델인 qwen3.6 9b는 효율이 살짝 떨어지는 걸 봐서, 덩치 크고 똑똑한 모델일수록 효과가 좋은 듯.
저자들이 직접 한 것처럼 RL 학습까지 곁들이면 성능이 미친 듯이 올라감.
써보고 싶냐?
pi를 쓰고 있다면 지금 당장 써볼 수 있음.
-
플러그인 https://github.com/lolipopshock/pi-clm을 설치하셈. 저자들이 직접 만든 거임.
-
설치하고 나서
/clm settings로 설정을 조정하셈:-
Set steering to
house-brief.md(modifies the system prompt, I suppose this should be left disabled for RL'd models only, of which there are none right now)
-

