開放模型案例
OLMo
Ai2 發布的 OLMo 家族在權重之外,同時公開預訓練資料、訓練程式碼、中間檢查點與訓練紀錄。首個 OLMo 發布於2024年2月,OLMo 2 於同年11月發布,Olmo 3 於2025年11月發布,包含 7B 與 32B 的 Base、Instruct 和 Think 變體,採用 Apache 2.0 授權。它是程式碼、權重、訓練揭露與授權條款這四項真正全部公開的案例,因而可以作為參照,用來衡量那些只發布權重的模型家族。
關鍵術語
- fully open
- open training data
- intermediate checkpoints
- training logs
開放性說明
程式碼與權重採用 Apache 2.0 授權。Dolma 預訓練語料採用 ODC-BY,並仍受其原始來源各自授權條款的約束,因此這裡的開放資料並不等於無限制使用。訓練程式碼、中間檢查點與紀錄均已公開,訓練揭露可以直接查核,而不必依靠推斷。
「開源」、「開放模型」與「開放權重」不可互換。每個版本都應分別核對程式碼、權重、訓練資訊與授權條款。
專案內關聯
第一手來源
這是經過選編的技術圖譜,並非對 AI 技術的完整涵蓋聲明。