GPT 5.6 Sol na VM0. O mais novo modelo de raciocínio de ponta da OpenAI
O nível de ponta da geração de prévia GPT-5.6 da OpenAI. A escolha mais forte para programação agêntica, raciocínio profundo e longos loops de uso de computador do lado da OpenAI.
400K tokens · Text / Vision / Code · Prompt cache
O GPT 5.6 Sol é o nível mais alto da geração de prévia GPT-5.6 da OpenAI e o modelo ao qual você recorre quando o trabalho exige tanto raciocínio profundo quanto uso confiável de ferramentas: orquestrar loops de agentes de múltiplas etapas, edições de código que precisam acertar de primeira e fluxos de uso de computador que abrangem muitas ações de GUI.
O preço de tabela do fornecedor é de $5 / $30 por 1M de tokens, com entrada em cache a $0,50 / 1M. Ele fica no nível de crédito ×2 na VM0 — a faixa de preço de topo de linha — então o padrão econômico é manter o GPT 5.6 Terra ou o Claude Sonnet 4.6 como o padrão universal e rotear apenas as etapas mais difíceis para o Sol. O GPT-5.6 é atualmente uma família em prévia na VM0; o GPT-5.5 continua sendo o modelo padrão da OpenAI até o Sol se formar.
O que é o GPT 5.6 Sol?
Prévia de julho de 2026 (nível de topo da família GPT-5.6) · Nível de ponta da família GPT-5.6, acima do GPT 5.6 Terra e do GPT 5.6 Luna. O mais novo modelo de fronteira da OpenAI para programação agêntica e raciocínio.
O GPT-5.6 é a mais nova geração de GPT da OpenAI, apresentada em julho de 2026 como uma família de três níveis — Sol, Terra e Luna — em vez de um único modelo. O Sol é o topo de linha: o nível que a OpenAI posiciona para os trabalhos mais difíceis de programação agêntica, raciocínio e uso de computador. A janela de contexto de 400K tokens e o parâmetro reasoning_effort são herdados do GPT-5.5 sem alterações, então os agentes Codex existentes entram sem reescritas.
Em relação ao GPT-5.5 (o topo de linha anterior), o Sol gasta mais poder computacional por token em raciocínio e, nos materiais de prévia da OpenAI, entrega correções mais fortes de primeira tentativa em refatorações de múltiplos arquivos, menos chamadas de ferramentas mal roteadas em loops longos e ganhos em raciocínio científico de nível de pós-graduação e matemática de competição. O contrapeso é que ele compartilha o preço de tabela do GPT-5.5 ($5 / $30 por 1M de tokens) e o multiplicador de crédito ×2 na VM0, motivo pelo qual a OpenAI apresenta o Sol como o nível de planejamento ou de escalonamento, em vez de padrão universal.
Como o GPT-5.6 é uma família em prévia, os números publicados são preliminares e vão mudar. A OpenAI sinalizou contaminação de dados de treinamento no SWE-bench Verified entre os modelos de fronteira, então trate qualquer pontuação absoluta como direcional. O sinal duradouro é o comportamento estruturado: precisão de chamada de ferramentas, confiabilidade de uso de computador e qualidade de correção de primeira tentativa, todos os quais os dados da prévia mostram melhorando em relação ao GPT-5.5.
O que se destaca no GPT 5.6 Sol
Principais recursos de arquitetura e capacidade.
O GPT 5.6 Sol mantém a janela de contexto de 400K tokens da linha GPT-5, cobrada ao preço de entrada padrão em toda a janela. Ele oferece suporte ao parâmetro reasoning_effort, cache de prompt em que a entrada em cache é cobrada a um décimo da taxa de entrada ($0,50 / 1M) mais um custo de escrita em cache ($6,25 / 1M), e a superfície da Responses API que a codex CLI usa por padrão. Uso de ferramentas, saídas estruturadas e uso de computador são herdados do GPT-5.5. As entradas são multimodais em texto, visão e código; não há geração nativa de imagens (use a Images API).
Especificações em resumo
Benchmarks do GPT 5.6 Sol
Números de prévia dos materiais do GPT-5.6 Sol da OpenAI, exibidos em relação aos números públicos do GPT-5.5. Trate todas as porcentagens como direcionais: a família está em prévia e a OpenAI sinalizou contaminação de dados de treinamento no SWE-bench Verified entre os modelos de fronteira.
Preços do GPT 5.6 Sol
Preço de tabela do provedor, por 1M de tokens.
Como o GPT 5.6 Sol se comporta na prática
Comportamento observado em execuções de agentes em produção.
Roteamento de ferramentas
A menor taxa de chamadas de ferramentas mal roteadas na família GPT-5.6. A diferença em relação ao GPT-5.5 aparece nos casos-limite difíceis: seleção condicional de ferramentas, argumentos profundamente aninhados e chamadas de ferramentas disparadas após longos trechos de raciocínio.
Edições de código de primeira tentativa
A melhor qualidade de correção da família. A escolha certa quando um agente precisa modificar código que deve continuar compilando e passando nos testes, especialmente quando a correção abrange múltiplos arquivos. O SWE-bench Verified da prévia reflete isso diretamente.
Uso de computador
Mais confiável do que o GPT-5.5 em sequências de GUI de múltiplas etapas, que é o que a diferença no OSWorld captura. Recorra a ele quando o agente conduz um navegador ou aplicativo de desktop ao longo de dezenas de etapas e um descarrilamento no meio da execução é custoso.
Velocidade
Mais lento que o Terra e muito mais lento que o Luna. Cerca de 70 tokens/seg em esforço médio nos testes iniciais. Reserve-o para as etapas que realmente precisam da profundidade extra de raciocínio e execute níveis mais leves em paralelo.
Comportamento de alucinação
O Sol carrega a calibração mais rigorosa da OpenAI da linha GPT-5 e tende a admitir incerteza em vez de inventar, motivo pelo qual as equipes continuam pagando o prêmio por raciocínio de alto risco mesmo enquanto modelos mais baratos alcançam nos benchmarks.
Melhores tarefas de agente para o GPT 5.6 Sol
O orquestrador executando um plano de múltiplas ferramentas
Use o Sol como o planejador que divide uma solicitação em dez etapas, despacha cada uma para um subagente de nível Terra ou Luna e recompõe os resultados. Executar o Sol apenas na camada de planejamento custa uma fração de executá-lo de ponta a ponta, com a maior parte da qualidade preservada.
As edições de código de primeira tentativa que não desperdiçam uma execução de CI
Peça ao Sol para migrar uma base de código de 50 arquivos de um ORM para outro, refatorar um módulo emaranhado ou aplicar uma correção de segurança em todo o repositório. A correção se aplica de forma limpa na primeira tentativa com mais frequência do que qualquer outro nível da família — que é exatamente o que sua conta de CI reflete.
O agente de uso de computador que precisa concluir o fluxo de trabalho
Quando o agente conduz um navegador por um fluxo de reserva de múltiplas etapas, um aplicativo de desktop ou uma interface administrativa legada, a pontuação mais forte do Sol no OSWorld significa menos descarrilamentos no meio da execução e menos intervenções humanas.
A etapa de pesquisa de matemática ou ciência difícil
Insira um conjunto de matemática de nível de competição ou uma derivação de física de pós-graduação e o Sol resolve tudo sem os deslizes de um a um que você vê em níveis mais leves. O AIME 2025 e o GPQA Diamond captam exatamente esse comportamento.
Quando dispensar o GPT 5.6 Sol
Evite o Sol em trabalho rotineiro de alto volume onde o GPT 5.6 Terra atinge o mesmo nível de qualidade pela metade do custo de crédito, em respostas de chat sensíveis à latência onde o GPT 5.6 Luna é muito mais rápido e em tarefas de classificação ou extração em massa onde o Luna é a opção compatível mais barata.
GPT 5.6 Sol vs outros modelos
GPT 5.6 Sol vs GPT 5.6 Terra
O Terra é o cavalo de batalha equilibrado da família GPT-5.6 e a escolha certa para a maioria dos agentes. Promova para o Sol apenas quando o Terra falhar visivelmente em raciocínio difícil, longos loops agênticos ou edições de código de primeira tentativa — geralmente como o orquestrador que delega para baixo, ao Terra e ao Luna.
GPT 5.6 Sol vs GPT-5.5
Mesmo papel, geração mais nova. O Sol é o sucessor de prévia do GPT-5.5 ao mesmo preço de tabela e nível de crédito, com pontuações de prévia mais fortes em programação agêntica e uso de computador. Até o GPT-5.6 se formar da prévia, o GPT-5.5 continua sendo o modelo padrão da OpenAI na VM0; recorra ao Sol quando quiser a mais nova profundidade de raciocínio.
GPT 5.6 Sol vs Claude Opus 4.8
Topos de linha equivalentes em famílias diferentes: o orquestrador de alto risco ao qual você escala quando o nível mais barato falha. O Opus 4.8 tem a janela de contexto de 1M de tokens e o perfil de segurança da Anthropic; o Sol tem o ecossistema Codex e as pontuações de uso de computador da OpenAI. Escolha pelo framework que seus agentes existentes visam.
Conclusão: você deveria usar o GPT 5.6 Sol?
O GPT 5.6 Sol é o mais novo nível de escalonamento do lado da OpenAI. Use o Terra como padrão; promova para o Sol apenas nas etapas específicas onde o Terra fica visivelmente aquém, e espere que as pontuações de prévia continuem mudando.
Perguntas frequentes
Qual é a janela de contexto do GPT 5.6 Sol?
400.000 tokens, com até 128K tokens de saída por resposta. A janela completa é cobrada às taxas padrão.
O GPT-5.6 está disponível de forma geral na VM0?
Ele está em prévia. Todos os três níveis — Sol, Terra e Luna — são selecionáveis, mas o GPT-5.5 continua sendo o modelo padrão da OpenAI até a família GPT-5.6 se formar. Os números de benchmark da prévia são preliminares e vão mudar.
Quando devo escolher o Sol em vez do GPT 5.6 Terra?
Quando (a) o agente é o planejador e as decisões se propagam em cascata, (b) a execução é longa o suficiente para que o Terra comece a rotear mal as chamadas de ferramentas ou (c) a saída deve se aplicar de forma limpa na primeira tentativa — edições de código, payloads estruturados, fluxos de uso de computador.
O GPT 5.6 Sol oferece suporte a cache de prompt?
Sim. A entrada em cache é cobrada a $0,50 por 1M de tokens — um desconto de 10× na porção em cache — com um custo de escrita em cache de $6,25 por 1M. Vale a pena usar sempre que seu prompt de sistema ou esquema de ferramentas for estável entre as chamadas.
Qual framework o GPT 5.6 Sol usa na VM0?
Codex. A VM0 roteia o GPT-5.6 pela superfície da Responses API do framework Codex, que é o que a codex CLI usa por padrão. Agentes do framework Claude Code não são compatíveis com modelos GPT-5 na VM0.
Alternativas
Usando o GPT 5.6 Sol na VM0
Duas formas de acessar o GPT 5.6 Sol na VM0
A VM0 suporta o GPT 5.6 Sol como um modelo Built-in cobrado em créditos VM0 e via bring-your-own com uma OpenAI API key. O caminho Built-in usa o roteamento Gerenciado da VM0 e o multiplicador de créditos explicado abaixo; o caminho bring-your-own cobra você diretamente com o fornecedor upstream e pula totalmente a conversão de créditos da VM0.
A recomendação da VM0
A VM0 posiciona o GPT 5.6 Sol como um modelo de agente central, recomendado ao lado do Claude Opus 4.7, do Claude Opus 4.6 e do Claude Sonnet 4.6 para os passos que determinam o resultado de fato de uma execução de agente. São os modelos que escolheríamos para o papel de orquestrador, para agentes que tocam em código e para qualquer passo em que uma resposta errada sai cara.
Créditos e o multiplicador ×2
Todo modelo Built-in na VM0 é precificado como um múltiplo do Claude Sonnet 4.6, que fica na linha de base de ×1 crédito. O GPT 5.6 Sol cobra a ×2 créditos. O multiplicador é o que aparece na sua fatura da VM0; o preço de tabela do fornecedor na tabela de preços acima é o que o provedor upstream cobra antes de a VM0 convertê-lo em créditos.
O GPT 5.6 Sol cobra a ×2, o que significa que um passo aqui custa 2× os créditos de um passo equivalente no Sonnet 4.6 (a linha de base de ×1). É um tier premium na VM0, então o padrão custo-efetivo é usar por padrão um modelo mais barato e rotear para o GPT 5.6 Sol apenas os passos que de fato precisam da profundidade extra de raciocínio.
Disponível na VM0 desde July 2026 (preview).