MINERVA: la prima famiglia di LLM interamente italiani

Nel panorama dell'intelligenza artificiale dominato da modelli anglosassoni, l'Italia ha fatto il suo ingresso con MINERVA: la prima famiglia di Large Language Model (LLM) preaddestrati da zero in italiano. Nata dal gruppo Sapienza NLP guidato dal professor Roberto Navigli, Minerva rappresenta un punto di svolta per la sovranità tecnologica italiana.

In sintesi

350M–7B parametri · Quattro modelli base · 2,48 trilioni di token per il 7B · Addestrato su Leonardo (CINECA) · ChatMinerva già disponibile

Chi è Roberto Navigli

Professore ordinario di Natural Language Processing alla Sapienza di Roma, Navigli lavora nel settore da quasi due decenni. Ha vinto due grant ERC (MultiJEDI e MOUSSE) per milioni di euro ed è stato General Chair di ACL 2025, la più prestigiosa conferenza mondiale sull'IA linguistica. Guida il gruppo Sapienza NLP, uno dei centri di ricerca più avanzati d'Europa.

L'architettura di Minerva

Minerva è una famiglia di quattro modelli base, che vanno da 350 milioni a 7 miliardi di parametri. I modelli sono stati addestrati su circa 2,48 trilioni di token (per la versione 7B), equivalenti a oltre 15 milioni di libri, con un bilanciamento di circa 50% italiano e 50% inglese più codice.

I dati provengono da fonti aperte e documentate: Wikipedia, articoli di giornale, libri, documenti legali, Gazzetta Ufficiale, EurLex e dataset web come RedPajama-v2, CulturaX e FineWeb.

Minerva 7B Instruct

Rilasciata a novembre 2024, la versione instruct del modello da 7B è stata messa a punto con Supervised Fine-Tuning (SFT) e ottimizzata con Direct Preference Optimization (DPO). Il modello è competitivo con Llama 3.1, Mistral 7B e supera Llamantino-2 nella maggior parte dei benchmark italiani (ITA-Bench, 18 benchmark).

La sicurezza è stata curata grazie al framework ALERT di Babelscape: un dataset di 21.000 istruzioni in italiano che copre 6 macro-categorie e 32 sotto-categorie di rischio (hate speech, criminal planning, sostanze, contenuti sessuali, autolesionismo, armi).

ChatMinerva: l'assistente multimodale

Lanciata il 3 giugno 2026, ChatMinerva è l'evoluzione dell'LLM in un vero assistente AI multimodale. Supporta caricamento di immagini, PDF, OCR, accesso web in tempo reale. È già utilizzabile su chatminerva.org e rappresenta il primo assistente AI "a chilometro zero" pensato per settore pubblico e privato.

Un modello da 20 miliardi di parametri è atteso per l'autunno 2026.

L'infrastruttura: Leonardo e CINECA

L'addestramento è stato possibile grazie al supercomputer Leonardo del CINECA, presso il Tecnopolo di Bologna. Il 7B è stato addestrato usando 128 GPU NVIDIA A100 in parallelo per diverse settimane, con un'allocazione di 7 milioni di node-hours tramite bando EuroHPC JU.

Open source e disponibilità

Tutti i modelli Minerva sono pubblicati su Hugging Face (sapienzanlp) con licenze aperte. A differenza di molti competitor, Minerva è completamente trasparente: non solo i pesi del modello, ma anche i dati e il processo di addestramento sono pubblici e documentati. Le model card includono tutte le informazioni tecniche.

Perché Minerva è importante per l'Italia

  • Know-how nazionale: creare un LLM da zero permette all'Italia di acquisire competenze strategiche
  • Sovranità tecnologica: un'alternativa concreta ai modelli americani, "a misura d'uomo" e centrata sulla cultura europea
  • Controllo dei dati: modelli addestrati su dati italiani documentati, adatti alla Pubblica Amministrazione
  • Efficienza: costo di sviluppo competitivo grazie all'accesso a infrastrutture pubbliche
  • Settori target: PA, sanità, difesa, cultura e istruzione
"L'IA non deve sostituire l'uomo, ma essere un assistente formidabile. Il progresso va indirizzato con responsabilità, trasparenza e controllo umano." — Prof. Roberto Navigli