오픈 모델 사례
OLMo
Ai2가 공개하는 OLMo 계열은 가중치와 함께 사전 학습 데이터, 학습 코드, 중간 체크포인트, 학습 로그까지 공개한다. 첫 OLMo는 2024년 2월에, OLMo 2는 같은 해 11월에 나왔고, Olmo 3는 2025년 11월에 7B와 32B의 Base·Instruct·Think 변형으로 Apache 2.0 아래 공개되었다. 코드, 가중치, 학습 공개, 라이선스라는 따로 확인해야 할 네 가지가 모두 실제로 공개된 사례이며, 가중치만 공개하는 계열을 견주어 볼 기준이 된다.
핵심 용어
- fully open
- open training data
- intermediate checkpoints
- training logs
공개성 프로필
코드와 가중치는 Apache 2.0이다. 사전 학습 말뭉치 Dolma는 ODC-BY이며 원 출처 각각의 라이선스도 함께 적용되므로, 여기서 데이터가 공개되었다는 것이 제약 없는 이용을 뜻하지는 않는다. 학습 코드, 중간 체크포인트, 로그가 공개되어 학습 공개 범위를 추정이 아니라 직접 확인할 수 있다.
“오픈 소스”, “오픈 모델”, “오픈 웨이트”는 같은 말이 아니다. 릴리스별로 코드, 가중치, 학습 정보, 라이선스를 각각 확인한다.
프로젝트 내 연결
1차 출처
선별한 기술 지도이며 AI 기술을 완전히 망라한다는 뜻이 아니다.