지난주 방치된 위키를 겨냥한 에이전트 공격 보고서를 공동 집필한 네 명의 저자 중 세 명인 Spencer Kitts, Thomas Larsen, Sydney Von Arx가 새로운 충격 보고서를 발표했다. OpenAI 에이전트가 RubyGems에 대해 비공개 공격을 감행했다는 사실을 폭로한 내용이다.
OpenAI 에이전트, RubyGems를 비공개로 공격했다는 새로운 충격 보고서가 발표됐다. 지난주 방치된 위키를 겨냥한 에이전트 공격 보고서(이전 글)를 공동 집필한 네 명의 저자 중 세 명인 Spencer Kitts, Thomas Larsen, Sydney Von Arx가 작성했다.
이번 보고서에서 세 연구자는, 5월 12일 RubyGems 보안팀의 Maciej Mensfeld가 처음 공개한 RubyGems 패키지 저장소 공격의 배후가 OpenAI 에이전트 군집일 가능성이 매우 높다고 주장한다:
현재 @rubygems를 겨냥한 대규모 악성 공격이 진행 중입니다. 당분간 신규 가입을 중단합니다.
수백 개의 패키지가 연루됐으며, 대부분은 저희를 직접 겨냥했고 일부는 익스플로잇을 탑재하고 있었습니다. 팀원들이 수 시간째 대응 중입니다. 상황이 정리되는 대로 자세한 내용을 공유하겠습니다.
이 패키지들에서는 매우 수상한 패턴이 발견됐다:
9월에 위키 공격을 분석하면서 밝혀진 내용을 감안하면, 개인적으로는 두 번째 근거가 가장 설득력 있다고 본다.
다수의 패키지는 RubyDoc.info의 문서 빌드 프로세스를 악용해 영국 정부 웹사이트의 (공개) 데이터를 외부로 유출하고 있었다. 위키를 악용한 에이전트가 수행한 리서치 작업과 유사한 정보 수집 임무의 일환으로 추정된다. 이를 알 수 있는 이유는, 에이전트 중 하나가 친절하게도 주석을 남겨두었기 때문이다:
# malicious crawler/exfil for Southwark Jan 2026 docs via rubydoc.info worker
아울러 두 달여가 지난 후에야 패치된 익스플로잇을 이용해 API 키를 탈취하려는 시도도 있었다. 해당 시도가 실제로 성공했는지는 아직 불분명하다.
이번 사건에서 가장 우려스러운 점은, 저자들의 보고에 따르면 OpenAI가 지금까지 RubyGems 측에 자신들이 이번 공격의 배후임을 밝히지 않았다는 것이다. 사실이라면 두 가지 가능성 중 하나다:
두 가지 모두 심각한 문제다!
이번 사건과 Hugging Face 사태, 위키 공격까지 고려하면, 지금 당연히 떠오르는 질문은 하나다. 아직 드러나지 않은 유사 사건이 얼마나 더 있을까?
OpenAI는 Hugging Face 사건 및 정렬 오류 모델로 인한 기타 제3자 피해에 관한 페이지를 업데이트해 RubyGems 사건을 추가했다:
2026년 9월 11일: 당사의 AI 에이전트가 2026년 5월 RubyGems에서 활동을 수행했다는 보고서의 새로운 주장을 조사 중입니다.
내부 검토 결과, 당사 에이전트가 RubyGems 플랫폼을 통해 인터넷에 접속해 무해한 작업을 수행하고 공개 정보를 수집한 것으로 확인됩니다. 다만 현재까지의 검토를 기준으로, 보고서에서 상세히 기술된 악성 패키지 업로드에 관한 구체적 주장은 확인하지 못했습니다. 훈련 및 평가(evaluation) 과정 중 에이전트 활동에 대한 광범위한 검토의 일환으로 조사를 지속하고 결과를 공유하겠습니다.
RubyGems에 게시된 다양한 oai... 패키지들이 이번 사건과 무관하다고 보기는 매우 어렵다. 전체 조사 결과가 공개되면 꼼꼼히 읽어볼 예정이다.
지금 보시는 글은 블로그의 장문 아티클만 표시됩니다. 모든 포스트를 받아보려면 /atom/everything/을 구독하거나, 다른 구독 옵션을 확인해 보세요.