Mistral 3: modelli aperti europei, dal grande al tascabile

· 4 min di lettura

Scritto con l'intelligenza artificiale

Il 2 dicembre Mistral ha rilasciato Mistral Large 3 e i Ministral 3 (3, 8 e 14 miliardi di parametri), tutti con licenza Apache 2.0. Perché i modelli piccoli contano per le aziende e come cambia il prompt quando il modello gira in casa.

Il 2 dicembre Mistral AI ha presentato Mistral 3, la nuova generazione dei suoi modelli. La famiglia va da un modello di frontiera, Mistral Large 3, a tre modelli piccoli, i Ministral 3, pensati per girare anche su un portatile. Tutti sono rilasciati con licenza Apache 2.0: chiunque può scaricarli, modificarli e usarli anche a fini commerciali.

Che cosa contiene Mistral 3?

Mistral Large 3 è il modello più capace mai rilasciato da Mistral. Usa un'architettura a «miscela di esperti»: 675 miliardi di parametri in totale, di cui 41 miliardi attivi per ogni risposta, e una finestra di contesto di 256.000 token. È stato addestrato da zero su circa 3.000 GPU NVIDIA H200, comprende anche le immagini e, secondo Mistral, è tra i migliori nelle conversazioni multilingue, cioè nelle lingue diverse da inglese e cinese. Sono disponibili la versione base e quella ottimizzata per le istruzioni; una versione con ragionamento è annunciata come «in arrivo».

Ministral 3 è la serie per l'uso locale: tre taglie (3, 8 e 14 miliardi di parametri), ognuna in tre varianti (base, istruzioni e ragionamento), tutte capaci di leggere immagini. Mistral sottolinea che le versioni per istruzioni producono spesso molti meno token di modelli simili a parità di risultato, e che la variante con ragionamento da 14 miliardi raggiunge l'85% su AIME 2025, un test di matematica.

I modelli sono disponibili da subito su Mistral AI Studio, Hugging Face, Amazon Bedrock, Azure Foundry e altre piattaforme, con ottimizzazioni sviluppate insieme a NVIDIA per i data center, i PC con schede RTX e i dispositivi Jetson.

Perché i modelli piccoli contano

La tesi di Mistral è esplicita. Guillaume Lample, cofondatore e direttore scientifico, l'ha spiegata così a TechCrunch: i clienti spesso partono da un grande modello chiuso, ma quando lo mettono in produzione scoprono che «è costoso, è lento», e allora chiedono di adattare modelli piccoli al loro caso. «In pratica, la grande maggioranza dei casi d'uso aziendali si può affrontare con modelli piccoli, soprattutto se li si adatta».

Secondo Lample, Ministral 3 può girare su una sola GPU: su un server interno, su un portatile, anche su dispositivi con connessione limitata. Per un'azienda europea significa poter tenere i dati in casa, senza mandarli a un servizio esterno.

Cosa cambia per chi progetta i prompt

Un modello open weight non è solo una questione di licenza: cambia il modo di lavorare.

Un esempio di prompt pensato per un modello piccolo, da provare su un Ministral 3:

Classifica la richiesta del cliente in una sola di queste categorie: FATTURAZIONE, SPEDIZIONE, RESO, ALTRO. Rispondi solo con la categoria.
Esempio: «Non ho ancora ricevuto il pacco» → SPEDIZIONE
Esempio: «Vorrei la fattura intestata alla società» → FATTURAZIONE
Richiesta: [testo]

Cosa osservare: quante risposte rispettano il formato, come se la cava con richieste in italiano scritte in modo informale, e se la variante da 8 o 14 miliardi migliora abbastanza da giustificarne il costo.

Un segnale per l'Europa

Mistral è una società francese nata due anni fa, con risorse molto inferiori a quelle dei grandi laboratori americani. Rilasciare l'intera famiglia, dal modello di frontiera a quello tascabile, con una licenza permissiva offre alle imprese europee un'alternativa concreta. «Non vogliamo che l'AI sia controllata solo da un paio di grandi laboratori», ha detto Lample. Per chi progetta sistemi di AI è un'opzione in più da mettere alla prova sui propri compiti, con una raccolta di test e prompt che valga per tutti i modelli candidati.

Fonti

#Mistral