폭로: OpenAI가 수학자들의 비공개 연구를 Codex 채팅에서 훔쳤다는 의혹
Blown up: OpenAI allegedly stole mathematicians' private research from their Codex chats!
핵심 요약
수학자들이 Codex에 입력한 비공개 연구 성과를 OpenAI가 가로채고 협박했다는 의혹이 제기되었습니다.
- 연구 도용 의혹 — 수학자들이 Codex에 입력한 미공개 증명 과정을 OpenAI가 모델 학습에 활용했다는 주장임
- 협박 및 회유 — OpenAI 측이 연구자에게 공동 저자를 제외하고 논문을 발표하라고 압박했다는 의혹임
- 데이터 보안 우려 — 상용 AI 모델에 민감한 정보를 입력하는 것에 대한 위험성이 대두됨
- 기업의 책임 — 기업들이 데이터 학습을 위해 사용자 정보를 무단으로 활용할 가능성에 대한 비판이 제기됨
세 줄 요약: 수학자 두 명이 1년 동안 수학계 난제를 풀려고 매달렸는데, 그 과정에서 쓴 초안들을 죄다 Codex랑 Claude에 집어넣음. 논문 발표 며칠 앞두고 OpenAI가 갑자기 똑같은 해답을 들고 나타남. 자기네 모델(Sol, Astra)이 이 수학자들의 비공개 대화 내용을 학습했냐고 물어봤는데, OpenAI는 지금까지도 대답 안 하는 중.
수학자 트리스탄 벅마스터(NYU 교수)와 레벤트 알포지는 1년 동안 아무도 못 푼 난제를 붙잡고 조용히 연구 중이었음. 풀기만 하면 역사책에 이름 남길 수준의 문제였지.
이 사람들은 매일매일 자기 아이디어랑 초안, 미완성 증명들을 돈 내고 쓰는 LLM인 Codex랑 Claude에 다 때려 박으면서 테스트했음.
그러다 드디어 돌파구를 찾았고, 세상에 발표하기 며칠 전이었음.
그때 OpenAI가 갑자기 나타나서 한 말:
"우리 모델도 이거 풀었음."
이게 얼마나 소름 돋는 상황인지 생각해 봐. 전 세계에서 아무도 안 건드리는 문제를 딱 두 명이 조용히 연구하고 있었는데, 그 비밀스러운 연구 내용이 OpenAI 귀에 들어간 직후에 갑자기 OpenAI 모델이 똑같은 답을 내놨다고 주장하는 거임.
트리스탄이 물었음: "너네 모델이 우리 비공개 Codex 대화 내용 열람했냐, 아니면 그걸로 학습했냐?"
OpenAI: "우리 모델은 사용자 데이터 안 봄."
트리스탄: "아니, 그래서 우리 데이터로 학습했냐고."
OpenAI는 입 꾹 닫음. 대답 안 함. 그냥 회피함.
근데 더 가관인 건 뭔지 앎?
OpenAI가 트리스탄한테 두 가지 선택지를 줌:
- 너네가 먼저 논문 발표하면, 다음 날 우리도 똑같이 발표하겠다.
- 논문은 너네가 쓰되, "OpenAI 내부 모델이 문제를 해결했다"는 식으로 공을 돌려라.
트리스탄은 둘 다 거절함. OpenAI가 억지로 밀어붙이면 다 까발리겠다고 했지.
그러자 OpenAI가 한 말: "왜 네 커리어를 망치려고 그래? 내가 좋게 좋게 넘어가 주길 원치 않는다면, 나도 굳이 친절하게 굴 필요 없지."
트리스탄(수학자)의 전체 성명서는 여기서 볼 수 있음: https://cims.nyu.edu/~tristanb/statement.pdf
세바스티앙 부벡 : 수학자를 협박한 OpenAI 직원

