Español
← Volver a Tecnologías de IA

Casos de modelos abiertos

OLMo

Ai2 publica la familia OLMo con sus datos de preentrenamiento, su código de entrenamiento, sus puntos de control intermedios y sus registros, además de los pesos. El primer OLMo apareció en febrero de 2024, OLMo 2 en noviembre del mismo año y Olmo 3 en noviembre de 2025, con variantes Base, Instruct y Think de 7B y 32B bajo licencia Apache 2.0. Es el caso en que los cuatro elementos que conviene revisar por separado — código, pesos, datos de entrenamiento y licencia — están realmente todos publicados, lo que lo convierte en un punto de referencia frente a familias que solo difunden los pesos.

Periodo de referencia
2024
Última revisión

Términos clave

  • fully open
  • open training data
  • intermediate checkpoints
  • training logs

Perfil de apertura

El código y los pesos están bajo Apache 2.0. El corpus de preentrenamiento Dolma está bajo ODC-BY y sigue sujeto a las licencias de sus fuentes originales, de modo que aquí datos abiertos no significa datos sin restricciones. Como el código de entrenamiento, los puntos de control intermedios y los registros están publicados, la divulgación del entrenamiento se comprueba en lugar de deducirse.

«Código abierto», «modelo abierto» y «pesos abiertos» no son equivalentes. Código, pesos, información de entrenamiento y licencia se revisan por separado en cada versión.

Conexiones en el proyecto

Fuentes primarias

  1. OLMo
  2. OLMo repository
  3. OLMo 2 model card
  4. Olmo 3 model card
  5. Dolma dataset

Este es un mapa técnico seleccionado, no una afirmación de cobertura completa.