Granite 4.2: IBM lancia nuovi modelli LLM con capacità di ragionamento avanzata
IBM ha presentato Granite 4.2, una serie di modelli LLM con 3B, 8B e 30B parametri, in grado di ragionare, chiamare strumenti e gestire contesti di 512K token. Open source e pronto all’uso in Italia.

Cosa è successo
Il 25 agosto 2026 IBM ha pubblicato Granite 4.2, la prima famiglia di modelli di linguaggio dense e decoder‑only focalizzati sul ragionamento. La nuova release comprende tre versioni – 3B, 8B e 30B – tutte addestrate da zero su circa 15 trilioni di token, con una strategia a cinque fasi che estende la finestra di contesto a 512 000 token.
Il modello è stato fine‑tuned con dati di chain‑of‑thought, reasoning e agentic‑trajectory, e successivamente post‑addestrato con una pipeline di reinforcement learning multi‑stadio. I 8B e 30B hanno subito un blocco di agentic RL, imparando a interagire con strumenti, a eseguire codice e a navigare terminali e web in sandbox reali.
Granite 4.2 è distribuito sotto licenza Apache 2.0, supporta chiamate di strumenti native e può essere eseguito tramite endpoint compatibili con OpenAI, emettendo chiamate di funzione in formato OpenAI function‑calling. È inoltre integrabile con SGLang per un servizio rapido.
Cosa cambia in pratica
- Privacy: essendo open source, i dati non vengono inviati a terze parti; l’utente può eseguire il modello localmente.
- Account: non è richiesto alcun account IBM o OpenAI; l’implementazione è completamente autonoma.
- Costo: il modello è gratuito sotto licenza Apache 2.0, ma richiede hardware GPU di fascia media‑alta per l’esecuzione in tempo reale.
- Cosa fa davvero: oltre a rispondere, il modello genera una catena di ragionamento, può passare da modalità “pensare” a “non pensare” e invocare strumenti in modo nativo.
Cosa significa per chi compra in Italia
Per gli acquirenti italiani, Granite 4.2 rappresenta un’opportunità di sfruttare un potente modello di intelligenza artificiale senza costi di licenza e con pieno controllo sui dati. Le aziende possono integrarlo nei propri servizi di customer support, analisi di testo o sviluppo software, mantenendo i dati in Italia o nell’UE. Tuttavia, l’implementazione richiede un’infrastruttura GPU adeguata e competenze tecniche per il deployment e la manutenzione.
La disponibilità di una versione 3B rende possibile l’uso anche su hardware meno potente, ideale per startup o piccoli team che vogliono testare l’IA senza investimenti elevati.
| Modello | Parametri | Livelli | Head di attenzione | Finestra di contesto |
|---|---|---|---|---|
| 3B | 3 B | 40 | 64 | 512 000 token |
| 8B | 8 B | 40 | 128 | 512 000 token |
| 30B | 30 B | 64 | 128 | 512 000 token |
Per approfondire le potenzialità dei modelli LLM in ambito informatico, visita la nostra sezione informatica.
Domande frequenti
Il modello è veramente open source?
Sì, Granite 4.2 è rilasciato sotto licenza Apache 2.0, quindi è gratuito e può essere modificato e distribuito liberamente.
Posso usarlo su un laptop con GPU di fascia media?
La versione 3B è progettata per funzionare su GPU di fascia media, mentre 8B e 30B richiedono risorse più elevate.
Come garantisco la privacy dei miei dati?
Poiché il modello può essere eseguito localmente, i dati rimangono sul tuo hardware; non vi è alcuna trasmissione verso server esterni.
È necessario un account IBM o OpenAI?
No, l’implementazione è autonoma; non è richiesto alcun account esterno.
