Kimi K3로 양자 내성 암호 프로젝트를 감사해봤는데, Fable/Opus 4.8과 GPT-5.6 Sol이 놓친 실제 버그 5개를 찾아냈습니다
I gave Kimi K3 a shot at auditing my post-quantum crypto project, it found 5 real bugs Fable/Opus 4.8 and GPT-5.6 Sol had all missed
핵심 요약
Kimi K3가 기존 모델들이 놓친 암호화 프로젝트의 보안 취약점을 성공적으로 발견하며 뛰어난 분석 능력을 입증했습니다.
- 모델 비교 감사 — Kimi K3가 기존 주류 모델들이 놓친 5개의 실제 버그를 찾아냄
- 보안 가드레일 — Fable과 GPT-5.6의 과도한 보안 필터가 코드 분석을 방해할 가능성 제기
- 모델 성능 논쟁 — Kimi K3의 우수성과 기존 모델들의 보안 취약성에 대한 사용자들의 의견 분분
- 감사 워크플로우 — 코드베이스의 적대적 테스트를 위한 효율적인 도구와 방법론 공유
[블록 1/5] (슬라이드니까 뭐 어때)
[블록 2/5] 지난 몇 주 동안 서버리스 양자 내성 그룹 암호화 프로토콜을 구축해 왔어. 주로 Opus 4.8과 Fable을 사용했고, 가장 까다로운 부분(복구/최종성 메커니즘)에 대해서는 GPT-5.6 Sol을 실행해서 적대적 검토를 진행했지. 총 4번의 검토를 거쳤는데, 매번 뭔가 발견되었고 Claude가 수정해서 결국 형식 모델은 탄탄해졌어. 나는 그 과정을 믿고 있었지...
[블록 3/5] 그런데 Kimi K3가 등장해서 한번 시도해 보기로 했어. 암호화 프로젝트에 가드레일이 없다고? 당장 해야지. 그래서 OpenRouter와 pi를 통해 연결하고, 독립적인 감사자로서 똑같은 모델에 적용해 봤어.
[블록 4/5] 그랬더니 다른 모델들이 놓친 5개의 실제 버그를 찾아내더라고. Kimi가 자체적으로 스윕을 실행해서 핵심은 건전하다는 걸 확인했지만, 확실히 하기 위해 내가 직접 하나하나 재현해 봤어.
[블록 5/5] Kimi K3는 다른 모델들이 보지 못했거나(혹은 허용되지 않았던) 사각지대를 잡아냈어. 정말 인상적이야!

