I nuovi, potenti modelli di Chat GPT

I nuovi modelli di OpenAI, rilasciati sulla piattaforma Chat GPT, introducono innovazioni importanti: potenziano il ragionamento complesso, combinano logica testuale e visiva per analizzare e risolvere problemi e agiscono come agenti autonomi. Migliorata anche la sicurezza, con sistemi che bloccano malware, attività di produzione di sostanze pericolose e tentativi di eludere le protezioni

Tempo di lettura:

5 minuti


L’azienda Open AI ha pubblicato lo scorso 16 aprile tre nuovi modelli AI (o3, o4-mini e o4- mini-high), e utilizzabili tramite la piattaforma ChatGPT. Con l’implementazione di questi nuovi modelli, vengono garantiti all’utente degli output artificiali molto più dettagliati di quelli a cui siamo abituati.

Si tratta dei modelli più intelligenti pubblicati finora da Open AI, con un incremento delle capacità visive (come l’analisi delle immagini) e di programmazione, per tutti e tre i modelli, mentre l’o3 presenta inoltre, particolari potenzialità per il business e per l’ideazione creativa, mentre l’o4- mini eccelle anche nel campo della matematica. Inoltre, è stata introdotta una variante dell’o4-mini, chiamata o4-mini-high, progettato per bilanciare ottime prestazioni con un minore sforzo computazionali. Il cambiamento risiede nella capacità di eseguire ragionamenti più complessi e sofisticati, ottimizzando la capacità dei modelli di adattamento e problem solving.

La piattaforma d’intelligenza generativa Chat GPT, è stata introdotta al pubblico per la prima volta il 30 novembre 2022. La sua creazione ha rappresentato un momento di svolta per lo sviluppo del digitale, portando questi strumenti all’attenzione di un’utenza ampia e diffusa e l’azienda sta continuando ad incrementare le potenzialità dei suoi modelli, in un processo evolutivo che appare ormai irreversibile.

Si tratta di sistemi IA basati su “Large Language Model” (LLM), modelli linguistici di grandi dimensioni, preaddestrati su una grande quantità di dati, basati su strutture a “reti neurali”, composte da centinaia o anche migliaia di unità di elaborazione interconnesse, analogamente alla struttura del cervello umano in cui i neuroni sono collegati tra loro attraverso connessioni chiamate sinapsi.

La maggior parte dei sistemi IA è istruito attraverso il deep learning, un tipo di apprendimento automatico che si basa sui dati già presenti, e che li utilizza per riuscire ad interpretare e a riconoscere correttamente i nuovi input. I sistemi, infatti, apprendono da una quantità sempre maggiore di dati (big data). Quest’ultimi vengono inseriti continuamente da chi addestra il modello o derivano dai dati presenti online. I big data quindi, rappresentano ad oggi una risorsa molto importante, utilizzabile anche dalle aziende e, garantendo loro un vantaggio in qualsiasi settore di mercato.

Questi ultimi tre modelli rilasciati fanno parte della serie “Omni”, progettata con l’intento di ottenere un’interazione più naturale tra uomo e computer. La gamma Omni è stata introdotta il 13 maggio 2024 grazie alla pubblicazione del suo primo modello GPT-4o. Già in quel caso la gamma “o” mirava ad ottimizzare la comprensione di input multimodali (visivi, testuali e di audio), ed a garantire un modello end-to-end, in cui ogni input viene elaborato da un unico modello e da un’unica rete neurale.

Un ulteriore avanzamento introdotto nella gamma “o”, visibile nei tre modelli recentemente rilasciati, riguarda il modo in cui tali modelli affrontano e risolvono i compiti assegnati. Questi sistemi mostrano una maggiore autonomia nelle operazioni: sono in grado di prendere decisioni e di interagire in modo proattivo con diversi ambienti digitali per raggiungere un obiettivo. L’intelligenza artificiale assume quindi, un comportamento da “agente”, in grado di esplorare, apprendere dal contesto e alla luce di questo, generare l’output che ritiene più adatto.

In particolare, il modello o3 viene presentato come il modello IA di ragionamento più potente in assoluto. Riesce ad eccellere in attività di programmazione avanzata e di risoluzione dei compiti complessi avvalendosi degli algoritmi, ma spicca anche in ambito scientifico e nella comprensione d’immagini. Secondo OpenAI, il modello o3 è riuscito ad ottenere prestazioni mai raggiunte prima da un modello IA, in test effettuati su Codeforces, SWE-bench e MMMU, stabilendo nuovi standard su queste piattaforme, che si occupano di collaudare la bravura dell’IA in ambiti di programmazione, comprensione e risoluzione di problemi reali e complessi.

Mentre per quanto riguarda le capacità di analisi di immagini, o3 risulta essere in grado di interpretare correttamente le informazioni visive, anche quelle più impercettibili e dettagliate. Ciò potrebbe essere un supporto a professioni mediche, ingegneristiche o scientifiche, che hanno a che fare con l’interpretazione di TAC, radiografie ma anche di grafici complessi.

Rispetto al modello o3, GPT o4-mini possiede dimensioni ridotte, ed è perciò meno potente e meno preciso nelle risposte. L’aspetto positivo però, è che essendo leggero, è anche più veloce e meno costoso in termini di sforzo e risorse da impiegare. Un altro vantaggio riguarda il fatto di avere meno restrizioni giornaliere (che si presentano con la dicitura: “Hai raggiunto il limite di richieste oggi”), ed è l’ideale per chi vuole interagire frequentemente con l’IA.

O4-mini, pur essendo un modello più piccolo rispetto a o3 o o3-mini, resta comunque molto efficiente e funzionale negli ambiti della matematica, programmazione e compiti visivi.

Dai test svolti notiamo come sia riuscito a ottenere prestazioni eccellenti, in particolare in un test di matematica avanzata: AIME (American Invitational Mathematics Examination) 2024 e 2025, che si occupa di valutare gli studenti più brillanti delle scuole superiori, risultando il modello che ha restituito più risposte esatte in assoluto.

Test matematico svolto sul modello o4-mini
Immagine 1. Risultati competizione matematica su AIME 2024 e 2025

Inoltre, la funzionalità del modello o4-mini può essere incrementata grazie alla sua versione -high, che risulta offrire un ragionamento potenziato rispetto alla sua versione base, e quindi più efficiente e simile a quello dei modelli più grandi, come l’o3. Nonostante la sua potenza, o4-mini è un modello relativamente leggero, con un costo computazionale contenuto. Grazie a questo, riesce ad offrire un buon compromesso tra prestazioni e velocità. Infine, anche l’o4-mini-high, come per tutta la linea “o”, si distingue per la capacità di elaborare input multimodali.

Un’altra novità, comune ai modelli appena rilasciati, è la capacità di pensare attraverso l’utilizzo delle immagini. Durante il ragionamento, infatti, l’intelligenza artificiale può integrare contenuti visivi, come immagini, grafici, diagrammi o tabelle, alle informazioni scritte, come spiegazioni o testi descrittivi.

Può inoltre, intervenire direttamente sulle immagini al fine di interpretarle al meglio, applicando rotazioni, zoom o trasformazioni visive. “Questo apre una nuova classe di problem-solving che fonde ragionamento visivo e testuale”. La capacità di ragionare combinando queste due modalità ha permesso di ottenere alla linea “o”, successi significativi nei test progettati per valutare i modelli multimodali.

Chat GPT implementa il ragionamento visivo
Immagine 2. Esempio di ragionamento con immagini

Open AI, in occasione dell’implementazione dei nuovi modelli, ha rielaborato i dati di addestramento relativi alla sicurezza, introducendo nuovi standard di protezione e nuove aree di monitoraggio, al fine di garantire affidabilità agli utenti della piattaforma Chat GPT. Le migliorie apportate riguardano il rifiuto di nuovi prompt potenzialmente pericolosi in tre particolari ambiti, tra cui la creazione di sostanze biologiche dannose (biorischio), scrittura di malware e tentativi di aggirare i limiti del modello (jailbreak).

I test recentemente compiuti, si basano sul Preparedness Framework, un insieme di pratiche e linee guida etiche di cui si avvale Open AI per la messa in sicurezza dei suoi modelli, e risultano essere i test più duri e rigorosi svolti finora sull’IA. Tra i risultati pubblicati nella scheda di sistema, o3 e o4-mini non hanno superato la soglia ‘Alta’, significa che hanno dimostrato di avere prestazioni adeguate e sotto controllo in tutte e tre le aree valutate (biologica e chimica, sicurezza informatica e auto- miglioramento dell’IA), senza evidenziare rischi significativi che possano compromettere la sicurezza o l’affidabilità del sistema.

I nuovi modelli della gamma “o” segnano un passo in avanti importante nello sviluppo dell’intelligenza artificiale. Con o3, o4-mini e la sua versione high, OpenAI propone sistemi più reattivi, versatili e capaci di affrontare compiti complessi in modo autonomo, adattandosi a contesti diversi e sfruttando strumenti esterni in modo intelligente. Le novità introdotte, dalla capacità di ragionare su contenuti visivi fino al comportamento da “agente”, e un ulteriore rafforzamento delle misure di sicurezza confermano la creazione di modelli sempre più intelligenti, dinamici e vicini a una comprensione più profonda delle richieste umane.

Alcune immagini,traduzioni e sintesi possono essere stati realizzati con ausilio di strumenti di intelligenza artificiale.

I contenuti sono sottoposti a revisione e controllo editoriale umano