OpenAI가 수학자들의 연구를 훔쳤다는 의혹
OpenAI alleged of stealing mathematicians work
핵심 요약
수학자들이 연구 내용을 OpenAI 모델에 입력했다가 유사한 결과가 발표된 사건을 계기로 로컬 LLM의 중요성이 강조되고 있습니다.
- 데이터 유출 의혹 — 수학자들이 연구 내용을 입력한 후 OpenAI가 유사한 해결책을 발표함
- 로컬 모델 필요성 — 클라우드 기반 AI의 데이터 학습 및 프라이버시 문제에 대한 경각심 확산
- API 모델 위험성 — 과학적 연구나 기밀 업무에 API 모델을 사용하는 것은 위험하다는 지적
- 학습 데이터 통제 — 설정으로 학습을 차단해도 실제로는 데이터가 사용될 수 있다는 우려
LLM을 직접 돌리려고 하드웨어까지 갖추는 사람들이 늘어나는 이유가 바로 이런 개인정보 문제 때문인데, 여기 또 다른 이유가 하나 추가됐네. 수학자 두 명이 1년 동안 수학계의 난제 하나를 풀려고 매달렸고, 그 과정에서 나온 모든 초안을 Codex에 입력했거든. 근데 논문 발표하기 며칠 전에 OpenAI가 갑자기 똑같은 해법을 들고 나타난 거야. 그래서 그쪽 모델(Sol, Astra)이 이 두 사람의 비공개 대화 내용을 학습한 거냐고 물어봤는데, OpenAI는 끝까지 대답을 안 하더라.
이들이 발표한 전체 성명은 여기 https://cims.nyu.edu/~tristanb/statement.pdf
거대 AI 연구소들은 우리가 자기네 모델 써서 만든 건 전부 다 지들 거라고 생각하는 모양이야.

