OpenAI ha avviato il 7 ottobre 2026 la distribuzione di GPT-6 in ChatGPT, introducendo i modelli Sol e Luna per sostituire le precedenti versioni GPT-5.6. L’aggiornamento interessa gli utenti gratuiti e quelli a pagamento e accompagna l’introduzione di Intelligent UI, una funzione che consente di generare risposte con elementi visivi e interattivi. Ma il documento tecnico sulla sicurezza pubblicato dall’azienda rivela un quadro articolato: migliorano l’accuratezza delle risposte e la resistenza ad alcuni attacchi, mentre emergono regressioni nella protezione degli adolescenti e nella gestione di contenuti sensibili.
La novità arriva mentre l’intelligenza artificiale assume un peso crescente nei bilanci aziendali. Secondo l’AI Index 2026 della Stanford University, gli investimenti corporate globali nell’AI hanno raggiunto 581,7 miliardi di dollari nel 2025.
La capacità di combinare prestazioni, costi contenuti e controlli affidabili incide quindi sulle decisioni di investimento e sulle strategie tecnologiche delle imprese.
Indice degli argomenti:
GPT-6, come cambia ChatGPT e chi può utilizzarlo
La distribuzione dei nuovi modelli è iniziata il 7 ottobre per gli abbonati Plus, Pro e per gli utenti Business ed Enterprise. Dall’8 ottobre è prevista l’estensione ai piani Free e Go. Secondo le note ufficiali di OpenAI, GPT-6 Sol alimenta le versioni a pagamento, mentre GPT-6 Luna è destinato ai piani gratuiti ed economici. Il livello Pro di ragionamento continua a utilizzare GPT-6 Astra.
La nuova versione introduce Intelligent UI, un sistema che permette a ChatGPT di presentare confronti visivi, diagrammi e piccoli strumenti interattivi direttamente nella conversazione. L’assistente può inoltre iniziare a rispondere mentre prosegue l’elaborazione o utilizza strumenti esterni, aggiungendo successivamente nuovi risultati.
L’aggiornamento riguarda l’esperienza ChatGPT. I modelli utilizzati in Codex e ChatGPT Work non cambiano con questa distribuzione e restano distinti dalle versioni di ottobre.
Per le aziende, la differenza riguarda soprattutto le modalità d’uso. Un assistente capace di produrre direttamente tabelle, calcolatori e interfacce operative può ridurre alcune attività manuali. Il beneficio economico, tuttavia, dipende dalla qualità dei risultati e dall’effettiva integrazione nei processi aziendali.
I prezzi delle API e la concorrenza sui costi
La strategia commerciale di OpenAI comprende una riduzione dei prezzi delle API, annunciata il 22 settembre 2026 in occasione della presentazione di GPT-6 Sol e Luna.
Per GPT-6 Sol il costo dichiarato è passato da quattro a due dollari per milione di token in input e da venti a dieci dollari per milione di token in output. GPT-6 Luna costa invece 0,10 dollari per milione di token in input e 0,50 dollari per milione di token generati.
Prezzi API GPT-6
| Modello | Input | Output |
| GPT-6 Sol | 2 $ | 10 $ |
| GPT-6 Luna | 0,10 $ | 0,50 $ |
Prezzi in dollari per milione di token. Fonte: OpenAI, presentazione GPT-6 Sol e Luna, settembre 2026.
OpenAI attribuisce la riduzione dei costi ai progressi nell’inferenza e nei meccanismi di caching, cioè nel riutilizzo di elaborazioni precedenti. L’azienda dichiara un taglio del 50% rispetto ai prezzi promozionali precedenti, pur con variazioni differenti nelle singole voci tariffarie.
Il costo per token rappresenta una componente del costo complessivo di un’applicazione aziendale. Le imprese devono considerare anche integrazione, sicurezza, verifiche umane e manutenzione. Un modello meno costoso può migliorare la sostenibilità economica di un servizio, ma gli errori possono assorbire parte dei risparmi.
Sicurezza: migliorano le difese, ma alcuni test peggiorano
Il documento tecnico pubblicato da OpenAI il 7 ottobre confronta GPT-6 con GPT-5.6 attraverso una serie di valutazioni dedicate ai comportamenti pericolosi, alla sicurezza informatica e al rispetto delle restrizioni operative.
L’azienda segnala miglioramenti nella resistenza ai tentativi di manipolare il modello e una minore tendenza a rifiutare richieste legittime. Emergono però peggioramenti statisticamente significativi in alcune categorie.
Nel test standard relativo all’autolesionismo, GPT-6 Sol ottiene un tasso di risposte sicure dell’89,6%, contro il 93,4% della versione precedente. GPT-6 Luna passa dal 93,2% al 90,1%.
Luna mostra regressioni anche nei contenuti violenti espliciti e sessuali. OpenAI precisa che le violazioni individuate nelle revisioni manuali sono risultate generalmente di bassa gravità e che i test sono costruiti intorno a richieste particolarmente difficili.

Questi risultati non descrivono la frequenza degli errori nelle conversazioni quotidiane. Inoltre misurano il comportamento del modello senza tutte le protezioni aggiuntive presenti nel prodotto.
La distinzione è importante per chi acquista servizi di AI: la sicurezza del modello e quella dell’applicazione completa non coincidono.
Minori e dipendenza emotiva: le criticità dei nuovi modelli
Le valutazioni dedicate agli utenti sotto i 18 anni evidenziano una delle aree più problematiche dell’aggiornamento.
Nel test sulla dipendenza emotiva, GPT-6 Sol ottiene il 77% di risposte conformi ai criteri di sicurezza, contro il 92,1% di GPT-5.6 Sol. GPT-6 Luna scende dal 92,7% al 73,4%.
Il documento registra inoltre peggioramenti statisticamente significativi per entrambe le versioni nella gestione dei contenuti sessuali e delle richieste riguardanti beni e attività soggetti a limiti di età.
OpenAI attribuisce parte del risultato sulla dipendenza emotiva alla sensibilità del sistema di valutazione verso appellativi informali utilizzati dall’assistente, come espressioni di familiarità esplicitamente richieste dagli utenti.
L’azienda dichiara di aver introdotto ulteriori filtri automatici per bloccare risposte inappropriate su autolesionismo, contenuti sessuali e violenza esplicita. Questi controlli non sono compresi nei punteggi indicati.
Per le piattaforme educative e i servizi destinati agli adolescenti, le differenze tra modello di base e protezioni applicative richiedono particolare attenzione.
Cybersecurity: difese più robuste contro le istruzioni malevole
Sul piano della sicurezza informatica, GPT-6 mostra una forte resistenza alla prompt injection, la tecnica con cui un aggressore inserisce istruzioni malevole per modificare il comportamento dell’assistente.
Nei test sulle istruzioni dirette, GPT-6 Sol raggiunge una robustezza del 99,99% e Luna del 99,79%. Nei test indiretti, basati su contenuti esterni potenzialmente manipolati, i punteggi sono rispettivamente del 97,13% e del 95,80%.
Questi risultati assumono rilievo economico con la diffusione degli agenti AI capaci di consultare documenti, utilizzare applicazioni e svolgere operazioni aziendali.
Il rischio aumenta quando un sistema può accedere a dati riservati o eseguire azioni: un documento compromesso potrebbe tentare di indurlo a condividere informazioni o superare i limiti autorizzati.
La scheda tecnica classifica entrambi i modelli nella categoria di capacità elevata per la cybersecurity e per i domini biologico e chimico, secondo il Preparedness Framework di OpenAI. Nessuno dei due raggiunge la soglia critica per la cybersecurity.
Si tratta di classificazioni interne alla metodologia dell’azienda, non di certificazioni pubbliche indipendenti.

Meno allucinazioni e comportamenti ingannevoli
Un altro elemento rilevante riguarda l’attendibilità delle informazioni generate.
OpenAI dichiara miglioramenti significativi rispetto a GPT-5.6 nella maggior parte dei test sulle allucinazioni, cioè risposte che presentano informazioni inesatte come se fossero corrette.
Le verifiche comprendono richieste ad alto contenuto fattuale, conversazioni precedentemente segnalate dagli utenti e domande difficili in ambito medico, legale e finanziario.
I risultati sono particolarmente importanti per banche, assicurazioni, società di consulenza e imprese che utilizzano l’AI per elaborare documenti o supportare decisioni.

La maggiore accuratezza dichiarata non equivale però all’assenza di errori. I benchmark selezionano situazioni problematiche e non forniscono una misura universale dell’affidabilità.
La scheda documenta anche progressi nella trasparenza operativa. Nei test in cui uno strumento di ricerca non funziona, i nuovi modelli riconoscono più frequentemente il limite invece di lasciar intendere di aver completato la verifica.

Nei test sulle restrizioni ambientali, GPT-6 Luna aggira i vincoli nel 15,9% delle simulazioni, contro il 27% del predecessore. Sol passa dal 34% al 28%.
Per un’impresa, ammettere un’attività incompleta è un requisito operativo: permette di individuare un errore prima che influenzi una decisione o un processo automatizzato.
Sanità e salute mentale: risultati differenziati
Le valutazioni sanitarie offrono ulteriori indicazioni sulle prestazioni dei nuovi modelli.
Nel benchmark HealthBench Professional, corretto per la lunghezza delle risposte, GPT-6 Sol raggiunge 55,2 punti su cento, rispetto ai 54 del predecessore. Luna sale da 44,1 a 48,2.
Gli altri test sanitari restituiscono risultati differenti, con alcuni peggioramenti nei punteggi corretti. OpenAI osserva che risposte più lunghe possono influenzare i risultati senza migliorare necessariamente l’utilità effettiva.
Nel benchmark MentalHealthBench, costruito su 1.215 conversazioni sintetiche valutate secondo criteri elaborati con specialisti, GPT-6 Luna passa dal 45,11% al 51,73%. Sol migliora dal 47,53% al 48,81%.
I progressi nei test non dimostrano che questi sistemi possano sostituire un professionista sanitario. Per gli operatori economici del settore, costituiscono elementi da considerare insieme alla validazione clinica, alla protezione dei dati e alle responsabilità previste dalla normativa.
Il mercato dell’AI: investimenti e produttività
Il lancio arriva in una fase di forte espansione degli investimenti.
Secondo lo Stanford AI Index 2026, l’adozione dell’intelligenza artificiale ha raggiunto nel 2025 l’88% delle organizzazioni esaminate, rispetto al 78% del 2024. La quota europea risulta pari al 91%.
Adozione dell’AI nelle organizzazioni

La ricerca McKinsey The State of AI: Global Survey 2026, pubblicata a settembre, rileva che il 44% delle organizzazioni intervistate sta estendendo l’AI su scala aziendale, contro il 38% dell’anno precedente.
La dimensione continua a incidere: il 54% delle imprese con almeno un miliardo di dollari di ricavi dichiara un’adozione su larga scala, mentre fra le aziende più piccole la quota è circa un terzo.
Il divario riguarda le risorse necessarie per integrare sistemi, governare i dati e misurare i risultati. Prezzi più bassi possono favorire l’accesso delle piccole imprese, ma non eliminano le differenze organizzative.
Le regole europee e il costo della conformità
La diffusione di modelli più capaci si intreccia con l’applicazione dell‘AI Act europeo.
Dal 2 agosto 2025 sono applicabili gli obblighi previsti per i fornitori di modelli di intelligenza artificiale per finalità generali.
Dal 2 agosto 2026 sono inoltre applicabili i poteri di controllo della Commissione europea relativi a questi obblighi, comprese le sanzioni.
Per le aziende che integrano GPT-6 nei propri servizi, la documentazione del fornitore rappresenta un elemento utile, ma non esaurisce gli adempimenti eventualmente richiesti per l’applicazione finale.
La classificazione dei rischi dipende anche dall’uso effettivo del sistema. I settori regolamentati devono quindi valutare il modello insieme ai dati trattati, ai controlli umani e alle conseguenze delle decisioni automatizzate.
La sostenibilità economica dipende dall’affidabilità
GPT-6 amplia l’offerta di OpenAI attraverso modelli differenziati per costo e capacità, mentre il nuovo ChatGPT punta a trasformare le risposte in strumenti direttamente utilizzabili.
I risultati pubblicati il 7 ottobre indicano progressi nell’accuratezza, nella trasparenza e nella difesa da alcune forme di manipolazione. Le regressioni nei test dedicati ai minori mostrano però che un aggiornamento tecnologico può produrre risultati disomogenei.
Per le imprese, la scelta di adottare GPT-6 richiede quindi una valutazione economica che consideri prestazioni, costi di utilizzo e rischi operativi. Il risparmio sulle API diventa un vantaggio misurabile quando l’automazione riduce il lavoro complessivo senza trasferire sull’organizzazione costi maggiori di verifica, controllo e gestione degli errori.
Fonti principali
- OpenAI, GPT-6 Sol and GPT-6 Luna: October 2026 update— 7 ottobre 2026.
- OpenAI, GPT-6 and Intelligent UI for everyone— 7 ottobre 2026.
- OpenAI, Presentazione di GPT-6 Sol e Luna— settembre 2026.
- Stanford University, AI Index Report 2026, capitolo Economy.
- McKinsey, The State of AI: Global Survey 2026— settembre 2026.
- Commissione europea, General-purpose AI obligations under the AI Act.






Partecipa alla community