Cas de modèles ouverts
OLMo
Ai2 publie la famille OLMo avec ses données de pré-entraînement, son code d’entraînement, ses points de contrôle intermédiaires et ses journaux, en plus des poids. Le premier OLMo est paru en février 2024, OLMo 2 en novembre de la même année, et Olmo 3 en novembre 2025, avec des variantes Base, Instruct et Think en 7B et 32B sous licence Apache 2.0. C’est le cas où les quatre éléments à vérifier séparément — code, poids, informations d’entraînement et licence — sont tous réellement publiés, ce qui en fait un point de repère face aux familles qui ne diffusent que les poids.
Termes clés
- fully open
- open training data
- intermediate checkpoints
- training logs
Profil d’ouverture
Le code et les poids sont sous Apache 2.0. Le corpus de pré-entraînement Dolma est sous ODC-BY et reste soumis aux licences de ses sources d’origine : des données ouvertes ne signifient donc pas des données sans restriction. Le code d’entraînement, les points de contrôle intermédiaires et les journaux étant publiés, les informations d’entraînement se vérifient au lieu de se déduire.
« Open source », « modèle ouvert » et « poids ouverts » ne sont pas interchangeables. Code, poids, informations d’entraînement et licence sont examinés séparément pour chaque version.
Liens dans le projet
Articles liés
Contexte historique
Rubriques liées
Sources primaires
Cette carte est une sélection éditoriale, non une prétention à l’exhaustivité.