Casos de modelos abiertos
OLMo
Ai2 publica la familia OLMo con sus datos de preentrenamiento, su código de entrenamiento, sus puntos de control intermedios y sus registros, además de los pesos. El primer OLMo apareció en febrero de 2024, OLMo 2 en noviembre del mismo año y Olmo 3 en noviembre de 2025, con variantes Base, Instruct y Think de 7B y 32B bajo licencia Apache 2.0. Es el caso en que los cuatro elementos que conviene revisar por separado — código, pesos, datos de entrenamiento y licencia — están realmente todos publicados, lo que lo convierte en un punto de referencia frente a familias que solo difunden los pesos.
Términos clave
- fully open
- open training data
- intermediate checkpoints
- training logs
Perfil de apertura
El código y los pesos están bajo Apache 2.0. El corpus de preentrenamiento Dolma está bajo ODC-BY y sigue sujeto a las licencias de sus fuentes originales, de modo que aquí datos abiertos no significa datos sin restricciones. Como el código de entrenamiento, los puntos de control intermedios y los registros están publicados, la divulgación del entrenamiento se comprueba en lugar de deducirse.
«Código abierto», «modelo abierto» y «pesos abiertos» no son equivalentes. Código, pesos, información de entrenamiento y licencia se revisan por separado en cada versión.
Conexiones en el proyecto
Artículos relacionados
Contexto histórico
Secciones relacionadas
Fuentes primarias
Este es un mapa técnico seleccionado, no una afirmación de cobertura completa.