Il 6 ottobre 2026 l'azienda francese di IA Mistral AI ha rilasciato un'anteprima pubblica del suo nuovo grande modello linguistico, Mistral Large 4. All'interno dell'azienda è chiamato con il soprannome «Le Chonk».
L'annuncio in sintesi
Secondo l'annuncio ufficiale, Mistral Large 4 è un modello con architettura MoE (Mixture of Experts) da mille miliardi di parametri totali, di cui 49 miliardi vengono utilizzati a ogni elaborazione (parametri attivi). È un modello multimodale in grado di gestire testo e immagini, e un unico modello offre sia una modalità che risponde rapidamente sia una che si prende il tempo di ragionare a fondo.
Per l'addestramento sono state usate 3.800 GPU NVIDIA Grace Blackwell nei data center che Mistral gestisce direttamente in Europa. L'azienda afferma che supporta oltre 160 lingue, comprese tutte le lingue ufficiali dell'UE.
I numeri principali
Ecco i principali dati pubblicati da Mistral:
- 61,7% su DeepSWE v1.1, una valutazione dello sviluppo software
- 28,3% su Terminal-Bench 4.0, una valutazione della programmazione agentica
- 59,9% su AutomationBench, una valutazione dell'automazione delle attività aziendali
- 93% su Cybench, che raccoglie 40 sfide di competizioni di sicurezza
- Prezzo dell'API per milione di token: 1,36 dollari in input e 4,18 dollari in output
Tutti i dati dei benchmark provengono dall'annuncio della stessa Mistral. Secondo Mistral, le sue prestazioni sono nettamente superiori a quelle di qualsiasi modello open-weight sviluppato negli Stati Uniti o in Europa.
Dove usarlo e prossimi passi
Al momento il modello è disponibile in anteprima tramite l'API di Mistral Studio, la piattaforma per gli sviluppatori (ID del modello: mistral-large-4-0). Mistral prevede di pubblicare i pesi del modello entro la fine di ottobre; da quel momento chiunque potrà scaricarli ed eseguire il modello sui propri server.
Mistral avverte che l'anteprima è ancora in fase di messa a punto tramite apprendimento per rinforzo, per cui la sua qualità potrebbe differire da quella della versione definitiva. Inoltre, viste le elevate capacità in ambito di sicurezza informatica, l'azienda sta collaborando con società di sicurezza, enti pubblici e altri soggetti per verificarlo (red teaming).
Il punto di vista di CoAI
L'arrivo di modelli open-weight ad alte prestazioni, sviluppati da aziende europee ed eseguibili nel proprio ambiente, rappresenta un'opzione importante per le aziende che non vogliono far uscire i propri dati. Tuttavia, eseguire internamente un modello da mille miliardi di parametri richiede notevoli risorse di calcolo. L'approccio più realistico è provarne prima le prestazioni tramite l'API e, dopo la pubblicazione dei pesi a fine mese, verificare le condizioni di licenza e l'ambiente necessario.