Tutti i modelli

GPT 5.6 Sol su VM0. Il nuovo modello di ragionamento di punta di OpenAI

Il livello di punta della generazione preview GPT-5.6 di OpenAI. La scelta più potente per il coding agentico, il ragionamento profondo e i lunghi cicli di computer-use sul fronte OpenAI.

400K tokens · Text / Vision / Code · Prompt cache

GPT 5.6 Sol è il livello di vertice della generazione preview GPT-5.6 di OpenAI ed è il modello a cui rivolgersi quando il lavoro richiede sia un ragionamento profondo sia un uso affidabile degli strumenti: orchestrare cicli agentici a più passaggi, modifiche al codice che devono andare a segno al primo tentativo e flussi di computer-use che comprendono molte azioni nella GUI.

Il prezzo di listino vendor è di $5 / $30 per 1M di token, con input in cache a $0,50 / 1M. Si colloca al livello di credito ×2 su VM0 — la fascia di prezzo dei modelli di punta di frontiera — quindi il pattern più conveniente è mantenere GPT 5.6 Terra o Claude Sonnet 4.6 come default onnipresente e instradare verso Sol solo i passaggi più difficili. GPT-5.6 è attualmente una famiglia in preview su VM0; GPT-5.5 rimane il modello OpenAI predefinito finché Sol non esce dalla preview.

Cos'è GPT 5.6 Sol?

Preview di luglio 2026 (livello di vertice della famiglia GPT-5.6) · Livello di punta della famiglia GPT-5.6, sopra GPT 5.6 Terra e GPT 5.6 Luna. Il nuovo modello di frontiera di OpenAI per il coding agentico e il ragionamento.

GPT-5.6 è la nuova generazione GPT di OpenAI, introdotta a luglio 2026 come famiglia a tre livelli — Sol, Terra e Luna — anziché come modello unico. Sol è il modello di punta: il livello che OpenAI posiziona per il lavoro più difficile di coding agentico, ragionamento e computer-use. La finestra di contesto da 400K token e il parametro reasoning_effort restano invariati rispetto a GPT-5.5, così gli agenti Codex esistenti si integrano senza riscritture.

Rispetto a GPT-5.5 (il precedente modello di punta), Sol dedica più risorse di calcolo per token al ragionamento e, nei materiali di preview di OpenAI, produce patch più solide al primo tentativo su refactoring multi-file, meno chiamate agli strumenti mal instradate su cicli lunghi e migliora nel ragionamento scientifico di livello universitario avanzato e nella matematica competitiva. Il compromesso è che condivide il prezzo di listino di GPT-5.5 ($5 / $30 per 1M di token) e il moltiplicatore di credito ×2 su VM0, motivo per cui OpenAI presenta Sol come il livello di pianificazione o escalation anziché come default onnipresente.

Poiché GPT-5.6 è una famiglia in preview, i numeri pubblicati sono preliminari e cambieranno. OpenAI ha segnalato una contaminazione dei dati di addestramento su SWE-bench Verified tra i modelli di frontiera, quindi qualsiasi punteggio assoluto va considerato indicativo. Il segnale duraturo è il comportamento strutturato: accuratezza delle chiamate agli strumenti, affidabilità del computer-use e qualità delle patch al primo tentativo, tutti aspetti che i dati di preview mostrano in miglioramento rispetto a GPT-5.5.

Cosa rende notevole GPT 5.6 Sol

Caratteristiche principali di architettura e capacità.

GPT 5.6 Sol mantiene la finestra di contesto da 400K token della linea GPT-5, fatturata al prezzo di input standard sull'intera finestra. Supporta il parametro reasoning_effort, il prompt caching dove l'input in cache viene fatturato a un decimo della tariffa di input ($0,50 / 1M) più un costo di scrittura in cache ($6,25 / 1M) e la superficie Responses API che la codex CLI utilizza per impostazione predefinita. Uso degli strumenti, output strutturati e computer-use sono ereditati da GPT-5.5. Gli input sono multimodali tra testo, visione e codice; non esiste generazione nativa di immagini (usare l'Images API).

Specifiche in breve

FamigliaGenerazione GPT-5.6 (preview)
ModalitàText, Vision, Code
LinguePrima l'inglese, multilingue
Prompt cachingSupported (OpenAI)
Finestra di contesto400K token
Output massimoFino a 128K token
Sforzo di ragionamentoMinimal / Low / Medium / High
Prezzo di listino vendor$5 input / $30 output per 1M

Benchmark di GPT 5.6 Sol

Cifre di preview dai materiali GPT-5.6 Sol di OpenAI, mostrate a confronto con i numeri pubblici di GPT-5.5. Considera tutte le percentuali come indicative: la famiglia è in preview e OpenAI ha segnalato una contaminazione dei dati di addestramento su SWE-bench Verified tra i modelli di frontiera.

SWE-bench Verifiedpreview; in aumento rispetto al ~82% di 5.5
~84%
Terminal-Bench 2.0uso degli strumenti in preview
~72%
AIME 2025 (no tools)matematica competitiva in preview
~97%
GPQA Diamondscienza di livello universitario avanzato in preview
~90%
OSWorld (computer use)preview
~77%
MMMU (multimodal)preview
In testa alla famiglia GPT-5.6
Speedsforzo medio, stima preliminare
~70 tokens/sec

Prezzi di GPT 5.6 Sol

Prezzo di listino del provider, per 1M di token.

Input$5.00
Output$30.00
Lettura cache$0.50
Scrittura cache$6.25

Come si comporta GPT 5.6 Sol nella pratica

Comportamento osservato dalle esecuzioni di agenti in produzione.

Instradamento degli strumenti

Il tasso più basso di chiamate agli strumenti mal instradate nella famiglia GPT-5.6. Il divario rispetto a GPT-5.5 emerge nei casi limite più difficili: selezione condizionale degli strumenti, argomenti profondamente annidati e chiamate agli strumenti effettuate dopo lunghi tratti di ragionamento.

Modifiche al codice al primo tentativo

La qualità delle patch più elevata della famiglia. La scelta giusta quando un agente deve modificare codice che deve continuare a compilare e superare i test, soprattutto quando la patch si estende su più file. Il punteggio SWE-bench Verified in preview lo riflette direttamente.

Computer use

Più affidabile di GPT-5.5 nelle sequenze GUI a più passaggi, il che è ciò che cattura il delta di OSWorld. Da usare quando l'agente pilota un browser o un'app desktop per decine di passaggi e un deragliamento a metà esecuzione è costoso.

Velocità

Più lento di Terra e molto più lento di Luna. Intorno ai 70 token/sec con sforzo medio nei test preliminari. Riservalo ai passaggi che necessitano davvero della maggiore profondità di ragionamento ed esegui in parallelo i livelli più leggeri.

Comportamento sulle allucinazioni

Sol eredita la calibrazione più rigorosa di OpenAI dalla linea GPT-5 e tende ad ammettere l'incertezza anziché confabulare, motivo per cui i team continuano a pagare il sovrapprezzo per il ragionamento ad alto rischio anche mentre i modelli più economici recuperano nei benchmark.

I migliori task per agenti con GPT 5.6 Sol

L'orchestratore che gestisce un piano multi-strumento

Usa Sol come pianificatore che scompone una richiesta in dieci passaggi, ne assegna ciascuno a un sub-agente di livello Terra o Luna e ricompone i risultati. Eseguire Sol solo al livello del pianificatore costa una frazione rispetto a eseguirlo end-to-end, preservando la maggior parte della qualità.

Le modifiche al codice al primo tentativo che non sprecano un'esecuzione CI

Chiedi a Sol di migrare una codebase da 50 file da un ORM a un altro, rifattorizzare un modulo aggrovigliato o applicare una correzione di sicurezza sull'intero repository. La patch si applica correttamente al primo tentativo più spesso di qualsiasi altro livello della famiglia — che è esattamente ciò che riflette la tua bolletta CI.

L'agente di computer-use che deve portare a termine il flusso di lavoro

Quando l'agente pilota un browser attraverso un flusso di prenotazione a più passaggi, un'app desktop o una vecchia interfaccia di amministrazione, il punteggio OSWorld più alto di Sol significa meno deragliamenti a metà esecuzione e meno interventi umani.

Il passaggio di ricerca matematica o scientifica difficile

Fornisci un set di matematica di livello competitivo o una derivazione di fisica universitaria avanzata e Sol lo elabora senza gli errori di un'unità che si osservano nei livelli più leggeri. AIME 2025 e GPQA Diamond colgono esattamente questo comportamento.

Quando evitare GPT 5.6 Sol

Evita Sol nel lavoro di routine ad alto volume dove GPT 5.6 Terra raggiunge la stessa soglia di qualità a metà del costo in crediti, nelle risposte di chat sensibili alla latenza dove GPT 5.6 Luna è molto più veloce e nei lavori massivi di classificazione o estrazione dove Luna è l'opzione supportata più economica.

GPT 5.6 Sol vs altri modelli

GPT 5.6 Sol vs GPT 5.6 Terra

Terra è il cavallo di battaglia bilanciato della famiglia GPT-5.6 e la scelta giusta per la maggior parte degli agenti. Promuovi a Sol solo quando Terra fallisce in modo evidente su ragionamento difficile, cicli agentici lunghi o modifiche al codice al primo tentativo — di solito come l'orchestratore che delega verso il basso a Terra e Luna.

GPT 5.6 Sol vs GPT-5.5

Stesso ruolo, generazione più recente. Sol è il successore in preview di GPT-5.5 allo stesso prezzo di listino e livello di credito, con punteggi di preview più alti nel coding agentico e nel computer-use. Finché GPT-5.6 non esce dalla preview, GPT-5.5 resta il modello OpenAI predefinito su VM0; rivolgiti a Sol quando desideri la più recente profondità di ragionamento.

GPT 5.6 Sol vs Claude Opus 4.8

Modelli di punta di pari livello in famiglie diverse: l'orchestratore ad alto rischio a cui fare escalation quando il livello più economico fallisce. Opus 4.8 offre la finestra di contesto da 1M di token e il profilo di sicurezza di Anthropic; Sol offre l'ecosistema Codex e i punteggi di computer-use di OpenAI. Scegli in base a quale framework puntano i tuoi agenti esistenti.

In sintesi: dovresti usare GPT 5.6 Sol?

GPT 5.6 Sol è il nuovo livello di escalation sul fronte OpenAI. Usa Terra come default; promuovi a Sol solo nei passaggi specifici in cui Terra è chiaramente insufficiente, e aspettati che i punteggi di preview continuino a cambiare.

Domande frequenti

Qual è la finestra di contesto di GPT 5.6 Sol?

400.000 token, con fino a 128K token di output per risposta. L'intera finestra viene fatturata alle tariffe standard.

GPT-5.6 è disponibile in modo generale su VM0?

È in preview. Tutti e tre i livelli — Sol, Terra e Luna — sono selezionabili, ma GPT-5.5 rimane il modello OpenAI predefinito finché la famiglia GPT-5.6 non esce dalla preview. I numeri dei benchmark di preview sono preliminari e cambieranno.

Quando dovrei scegliere Sol invece di GPT 5.6 Terra?

Quando (a) l'agente è il pianificatore e le decisioni si propagano a cascata, (b) l'esecuzione è abbastanza lunga da far sì che Terra inizi a instradare male le chiamate agli strumenti, oppure (c) l'output deve applicarsi correttamente al primo tentativo — modifiche al codice, payload strutturati, flussi di computer-use.

GPT 5.6 Sol supporta il prompt caching?

Sì. L'input in cache viene fatturato a $0,50 per 1M di token — uno sconto di 10× sulla porzione in cache — con un costo di scrittura in cache di $6,25 per 1M. Vale la pena usarlo ogni volta che il tuo prompt di sistema o lo schema degli strumenti è stabile tra una chiamata e l'altra.

Quale framework usa GPT 5.6 Sol su VM0?

Codex. VM0 instrada GPT-5.6 attraverso la superficie Responses API del framework Codex, che è ciò che la codex CLI usa per impostazione predefinita. Gli agenti basati sul framework Claude Code non sono compatibili con i modelli GPT-5 su VM0.

Alternative

Usare GPT 5.6 Sol su VM0

Due modi per accedere a GPT 5.6 Sol su VM0

VM0 supporta GPT 5.6 Sol come modello Built-in fatturato in crediti VM0 e tramite bring-your-own con una OpenAI API key. Il percorso Built-in usa il routing VM0 Managed e il moltiplicatore di crediti spiegato di seguito; il percorso bring-your-own ti fattura direttamente con il fornitore upstream e salta del tutto la conversione in crediti VM0.

La raccomandazione di VM0

VM0 posiziona GPT 5.6 Sol come modello agente core, consigliato insieme a Claude Opus 4.7, Claude Opus 4.6 e Claude Sonnet 4.6 per i passi che determinano il risultato effettivo di un'esecuzione di un agente. Sono i modelli che sceglieremmo per il ruolo di orchestratore, per gli agenti che toccano il codice e per qualsiasi passo in cui una risposta sbagliata è costosa.

Crediti e il moltiplicatore ×2

Ogni modello Built-in su VM0 è prezzato come un multiplo di Claude Sonnet 4.6, che si colloca alla baseline di crediti ×1. GPT 5.6 Sol viene fatturato a ×2 crediti. Il moltiplicatore è ciò che compare sulla tua fattura VM0; il prezzo di listino del fornitore nella tabella prezzi sopra è ciò che il provider upstream addebita prima che VM0 lo converta in crediti.

GPT 5.6 Sol viene fatturato a ×2, il che significa che un passo qui costa 2× i crediti di un passo equivalente su Sonnet 4.6 (la baseline ×1). È un tier premium su VM0, quindi il pattern conveniente è quello di usare come predefinito un modello più economico e indirizzare a GPT 5.6 Sol solo i passi che hanno davvero bisogno della profondità di ragionamento aggiuntiva.

Disponibile su VM0 dal July 2026 (preview).