Casos de modelos abertos
OLMo
A Ai2 publica a família OLMo com os dados de pré-treino, o código de treino, os pontos de controlo intermédios e os registos, além dos pesos. O primeiro OLMo saiu em fevereiro de 2024, o OLMo 2 em novembro do mesmo ano e o Olmo 3 em novembro de 2025, com variantes Base, Instruct e Think de 7B e 32B sob licença Apache 2.0. É o caso em que os quatro elementos a verificar separadamente — código, pesos, divulgação do treino e licença — estão de facto todos publicados, o que faz dele um ponto de referência perante famílias que difundem apenas os pesos.
Termos-chave
- fully open
- open training data
- intermediate checkpoints
- training logs
Perfil de abertura
Código e pesos estão sob Apache 2.0. O corpus de pré-treino Dolma está sob ODC-BY e continua sujeito às licenças das suas fontes originais, pelo que dados abertos não significam aqui dados sem restrições. Como o código de treino, os pontos de controlo intermédios e os registos são publicados, a divulgação do treino verifica-se em vez de se deduzir.
«Open source», «modelo aberto» e «pesos abertos» não são equivalentes. Código, pesos, informação de treino e licença são revistos separadamente em cada versão.
Ligações no projeto
Artigos relacionados
Contexto histórico
Secções relacionadas
Fontes primárias
Este é um mapa técnico selecionado, não uma afirmação de cobertura completa.