Italiano
← Torna alle tecnologie dell’IA

Casi di modelli aperti

OLMo

Ai2 pubblica la famiglia OLMo con i dati di pre-addestramento, il codice di addestramento, i checkpoint intermedi e i log, oltre ai pesi. Il primo OLMo è uscito nel febbraio 2024, OLMo 2 nel novembre dello stesso anno e Olmo 3 nel novembre 2025, con varianti Base, Instruct e Think da 7B e 32B sotto licenza Apache 2.0. È il caso in cui i quattro elementi da verificare separatamente — codice, pesi, divulgazione dell’addestramento e licenza — sono davvero tutti pubblicati, il che ne fa un termine di paragone per le famiglie che diffondono soltanto i pesi.

Periodo di riferimento
2024
Ultima verifica

Termini chiave

  • fully open
  • open training data
  • intermediate checkpoints
  • training logs

Profilo di apertura

Codice e pesi sono sotto Apache 2.0. Il corpus di pre-addestramento Dolma è sotto ODC-BY e resta soggetto alle licenze delle fonti originali: dati aperti non significa quindi dati senza vincoli. Poiché codice di addestramento, checkpoint intermedi e log sono pubblicati, la divulgazione dell’addestramento si verifica invece di dedursi.

«Open source», «modello aperto» e «pesi aperti» non sono sinonimi. Per ogni versione vanno esaminati separatamente codice, pesi, informazioni di training e licenza.

Collegamenti nel progetto

Fonti primarie

  1. OLMo
  2. OLMo repository
  3. OLMo 2 model card
  4. Olmo 3 model card
  5. Dolma dataset

Questa è una mappa tecnica curata, non una pretesa di copertura completa.