Codeberg의 LLM 지원 코드 금지는 내가 본 FOSS 관련 정책 중 가장 현실 감각 없는 조치다.
Codeberg's ban on LLM-assisted code is the most out-of-touch FOSS take I've seen in years.
핵심 요약
Codeberg가 LLM 기반 프로젝트를 금지한 정책을 비판하며, 도구 금지 대신 리소스 제한을 도입해야 한다고 주장하는 글.
- 정책 비판 — LLM 도구 금지는 비효율적이며 개발자를 GitHub로 내모는 결과를 초래함.
- 리소스 관리 — 도구 자체를 막기보다 CI/CD 및 저장소 사용량 제한을 설정하는 것이 합리적임.
- 통계 오류 — Codeberg의 환경적 영향 및 하드웨어 비용 관련 주장은 사실과 동떨어져 있음.
- FOSS 정신 — AI는 개발 생산성을 높이는 도구이며, 이를 배척하는 것은 오픈소스의 민주화 정신에 어긋남.
나 꽤 오랫동안 Codeberg를 밀어줬다. 기부도 하고, GitHub에 있던 내 저장소들도 잔뜩 옮겨왔고, 비영리이면서 개인정보를 존중하는 Git 저장소를 찾는 사람들한테도 맨날 여기를 추천했지.
그런데 이번에 올라온 블로그 글을 보고, 이용 약관에 "vibe-coded(AI가 대충 짠 느낌의 코드)"나 무거운 LLM 프로젝트를 금지하겠다는 투표 결과를 보니까 진짜 빡치더라.
이건 말도 안 되는 정책이야. 기본적인 인프라 문제를 엉뚱하게 꼬아놓고, 게이트키핑을 정당화하려고 완전히 사기적인 통계를 들이대고, 결국엔 아이러니하게도 개발자들을 다시 마이크로소프트 품으로 밀어 넣는 꼴이니까.
- 할당량을 정할 생각은 안 하고 도구를 금지하는 건 말이 안 됨
Codeberg가 내세우는 실질적인 주장은 AI가 만든 "유령 프로젝트"들이 CI/CD 러너를 다 잡아먹고, 디스크 공간을 낭비하고, 스크래퍼들한테 공격당한다는 거야.
뭐, 서버 관리 힘든 건 인정해. 근데 인프라 남용 문제를 해결할 때 개발 도구를 금지하는 방식으로 해결하는 경우가 어디 있어? 그냥 리소스 제한을 걸면 되잖아.
사람들이 무료 러너를 남용하거나 디스크 공간을 너무 많이 차지하면, 사용자별 러너 사용 시간을 제한하고 저장 용량 쿼터를 빡세게 걸면 그만이야. GitHub나 GitLab은 다 그렇게 처리했어. 대충 만들고 관리도 안 하는 쓰레기 저장소들은 SourceForge 시절부터 계속 올라왔던 문제라고. 대역폭이나 저장 공간에 확실한 제한을 두는 대신, 누군가 코드를 '어떻게' 짜는지까지 감시하겠다는 건 관리자로서 제정신이 아니라는 거지. 어떤 개발자가 오후 내내 Claude 써서 깔끔하고 테스트까지 완벽한 Rust 도구를 만들었다면, 그게 저장 용량 제한 안쪽인데 Codeberg가 대체 왜 참견이야?
- 블로그 글에 나온 통계는 완전히 엉터리임
걔들은 데이터 센터 에너지, SSD 가격, 프랑크푸르트의 물 사용량까지 들먹이면서 AI 코드를 무슨 환경 범죄인 것처럼 몰아가더라. 근데 실제 데이터 좀만 들여다보면 그 논리는 바로 박살 나.
엔터프라이즈 SSD 가격이 700유로에서 3,700유로로 뛰었다고 징징대면서 그걸 자기네 사이트에 올라온 LLM 프로젝트 탓으로 돌리던데, 웃기지 마. 엔터프라이즈 NVMe 가격이 뛴 건 어떤 취미 개발자가 Copilot으로 배시 스크립트 좀 짰다고 오른 게 아니야. 마이크로소프트, 메타, 구글 같은 빅테크 하이퍼스케일러들이 거대한 클러스터 구축하려고 하드웨어 설비 투자(CapEx)에만 연간 1,500억 달러 이상을 쏟아붓고 있으니까 오른 거지.
에너지랑 물 사용량 주장도 똑같아. IEA에 따르면 전 세계 데이터 센터가 쓰는 전력은 전체의 1%에서 1.5% 수준이야. 물은? 데이터 센터 냉각에 들어가는 물은 산업용 용수 사용량의 0.몇 퍼센트도 안 돼. 매일 15억 갤런씩 물을 퍼먹는 미국 골프장 같은 거랑 비교하면 아무것도 아니라고. (자기네 나라 탄소 제로 원전까지 다 꺼버린 주제에) 프랑크푸르트 전력난을 AI 어시스턴트 쓰는 오픈소스 개발자 탓으로 돌리는 건 그냥 악의적인 선동이지.
- 리누스 토발즈는 다 알고 있음
그 글은 LLM으로 짠 코드는 무조건 유지보수 불가능한 쓰레기라고 가정하고 있어. 이건 걔들이 요즘 개발 워크플로우가 어떻게 돌아가는지 전혀 모른다는 증거야.
Claude 3.5 Sonnet 같은 최신 모델들은 SWE-bench 같은 벤치마크에서 80~90% 이상의 정확도를 보여줘. 이제 사람들은 환각 증상 있는 코드를 무지성으로 복붙하지 않아. 개발자들은 이런 도구를 써서 단위 테스트를 만들고, 문서를 작성하고, 엣지 케이스를 잡아내고, 레거시 코드를 리팩토링해. 혼자 할 때보다 훨씬 빠르게 말이야. 1인 메인테이너들의 수준을 한 단계 끌어올려 준다고.
리누스 토발즈도 LKML에서 이렇게 말했지:
"AI는 우리가 사용하는 다른 도구들과 마찬가지로 하나의 도구일 뿐이다... 하지만 해결책은 모래 속에 머리를 처박고 '라라라, 아무것도 안 들려'라고 노래하는 게 아니다... 해결책은 그 LLM 도구들이 메인테이너들에게 고통만 주는 게 아니라 실제로 도움이 되도록 만드는 것이다."


