어떤 오픈 모델이 생태계에 더 도움이 될까?
Which open models help the eco system more?
핵심 요약
모델의 개방성 지표를 두고 데이터 공개 여부와 생태계 기여도에 대한 논쟁이 벌어짐.
- 개방성 지표 — 학습 데이터와 방법론 공개 여부를 기준으로 모델의 개방성을 평가함.
- DeepSeek 논란 — 기술적 영향력은 크지만 데이터 공개가 부족해 지표상 낮은 평가를 받음.
- 평가 기준 — 라이선스 허용 범위와 학습 데이터 공개 여부가 주요 평가 항목임.
- 생태계 기여 — 단순히 모델의 성능뿐만 아니라 기술 공유와 재현 가능성이 중요함.
https://artificialanalysis.ai/evaluations/artificial-analysis-openness-index
개방성을 지지하고 싶다면, 어떤 모델들은 다른 모델들보다 더 개방적이라는 점을 알아야 함.
업데이트:
K2 think v2가 가장 높은 평가를 받은 이유는 학습 데이터와 학습 방식을 제공하기 때문임. 덕분에 충분한 자원만 있다면 누구나 모델을 재현할 수 있음.
Deep seek는 모델을 어떻게 학습시켰는지, 학습 데이터가 무엇인지 공개하지 않아서 낮은 점수를 받음.
소프트웨어를 LLM과 비교해보자면, 한 단계는 무료로 사용할 수 있게 바이너리를 제공하는 것이고, 더 높은 단계는 소스 코드를 제공하는 것임.

