리만 가설을 풀기 위해 RTX 3090에서 63시간 동안 구동한 Qwen 3.8 27B
Qwen 3.8 27B Running for 63 hours on a RTX 3090 to solve the Riemann hypothesis
핵심 요약
사용자가 Qwen 27B 모델을 63시간 동안 자율 구동하여 리만 가설 해결을 시도한 실험을 공유했습니다.
- 실험 내용 — 4비트 양자화된 Qwen 27B 모델을 10만 컨텍스트 윈도우로 63시간 동안 자율 구동함.
- 모델 성능 — 환각 없이 스스로 오류를 수정하며 지속적으로 새로운 전략을 시도함.
- 향후 계획 — 더 똑똑한 오픈 모델이나 에이전트 스웜을 활용해 수학 문제 해결에 재도전할 예정임.
- 데이터 공유 — 실험 과정에서 생성된 내부 메모리, 코드, 전략 등을 허깅페이스에 공개함.
Qwen 3.8 27B 4bit 양자화 모델에 100K 컨텍스트 윈도우를 먹이고 63시간 동안(토큰 5천만 개 이상) 자율적으로 돌려서 리만 가설(RH)을 풀어보라고 시켜봤다.
당연히 풀지는 못했지만, 실험을 통해 모델의 내부 작동 방식, 메모리 구성, 사용하는 전략 같은 것들을 엿볼 수 있었다.
흥미로운 점은 얘가 답을 지어내거나(환각) 해결책을 찾으려는 시도를 멈추지 않았다는 거다.
심지어 자기 실수를 스스로 수정하는 모습도 여러 번 보여줬다.
앞으로 12개월 안에 오픈 소스 모델 기반의 에이전트나 에이전트 스웜이 밀레니엄 난제 중 하나를 해결할 수 있을 거라는 희망이 보인다.
모델의 내부 메모리나 코드, 전략 같은 게 궁금하면 내가 HF에 다 올려놨으니 확인해 봐: https://huggingface.co/datasets/gr0010/artificium-riemannhypothesis-experiment
다음 목표는 GLM 5.3 flash 같이 더 똑똑한 오픈 모델을 쓰거나 에이전트 스웜을 구성해서 진짜 미해결 수학 문제를 풀어보는 거다.
비슷한 거 시도해 본 사람 있으면 알려주고, 다음에 어떤 문제를 건드려보면 좋을지, 궁금한 거 있으면 뭐든 물어봐.
혹시 GPU 좀 돌릴 수 있는 사람 있으면 연락해라. 에이전트 여러 개 굴려서 스웜 만들고, 간단하지만 아직 안 풀린 수학이나 코딩 문제 같이 해결해 보자.


