Tous les modèles

GPT 5.6 Luna sur VM0. Le niveau GPT-5.6 rapide et économique

Le niveau économique de la famille en préversion GPT-5.6 d'OpenAI. Rapide, bon marché et multimodal — conçu pour l'utilisation d'outils à fort volume, le travail en masse et les réponses sensibles à la latence.

400K tokens · Text / Vision / Code · Prompt cache

GPT 5.6 Luna est le niveau économique de la génération préliminaire GPT-5.6 d'OpenAI — le membre rapide et bon marché de la famille, conçu pour l'utilisation d'outils à fort volume, la classification et l'extraction en masse, et le chat sensible à la latence où la vitesse et le coût comptent plus que la profondeur de raisonnement de pointe.

Le tarif catalogue du fournisseur est de 1 $ / 6 $ par 1M de tokens, avec une entrée mise en cache à 0,10 $ / 1M — le plus bas de la famille GPT-5.6. Il se situe dans la tranche de crédit économique de VM0, ce qui en fait le niveau vers lequel se tourner pour la large base du travail routinier, tandis que GPT 5.6 Terra gère l'agent au quotidien et que Sol ne prend que les étapes les plus difficiles. GPT-5.6 est actuellement une famille en préversion ; GPT-5.5 reste le modèle OpenAI par défaut jusqu'à sa promotion.

Qu'est-ce que GPT 5.6 Luna ?

Préversion de juillet 2026 (niveau économique de la famille GPT-5.6) · Niveau économique de la famille GPT-5.6, en dessous de Sol et Terra. L'option rapide et peu coûteuse pour le travail à fort volume et sensible à la latence.

GPT-5.6 est sorti en juillet 2026 sous la forme d'une famille à trois niveaux — Sol, Terra et Luna. Luna est le niveau économique : OpenAI le positionne pour la base à fort volume et sensible à la latence de la charge de travail d'un agent, le rôle que jouait GPT-5.4 Mini dans la génération précédente. Il conserve la fenêtre de contexte de 400K tokens et le paramètre reasoning_effort de la famille, de sorte qu'il s'intègre sans modification aux agents Codex existants.

Luna échange le raisonnement haut de gamme contre la vitesse et le coût. À 1 $ / 6 $ par 1M de tokens, il représente une fraction du prix de Sol et constitue le niveau GPT-5.6 pris en charge le moins cher sur VM0. Dans les documents de préversion d'OpenAI, il tient bien la route sur l'utilisation d'outils simple, la classification et l'extraction, et ne décroche vraiment que sur les tâches de raisonnement difficile et à longue boucle qui relèvent de toute façon de Terra ou Sol.

Comme pour le reste de la famille en préversion, les chiffres sont préliminaires et indicatifs. Ce qui est stable, c'est le rôle de Luna : c'est le niveau que l'on fait tourner à la large base d'un pipeline — de nombreux appels rapides et bon marché — tout en promouvant la petite fraction d'étapes véritablement difficiles vers Terra et Sol. Cette stratification est ce qui rend un agent GPT-5.6 à la fois performant et abordable.

Ce qui distingue GPT 5.6 Luna

Principales caractéristiques d'architecture et de capacités.

GPT 5.6 Luna conserve la fenêtre de contexte de 400K tokens, facturée au tarif d'entrée standard sur l'ensemble de la fenêtre. Il prend en charge le paramètre reasoning_effort, la mise en cache des prompts où l'entrée mise en cache est facturée au dixième du tarif d'entrée (0,10 $ / 1M) plus des frais d'écriture en cache (1,25 $ / 1M), et la surface de l'API Responses que le CLI codex utilise par défaut. L'utilisation d'outils, les sorties structurées et l'utilisation de l'ordinateur correspondent au reste de la famille GPT-5.6. Les entrées sont multimodales : Text, Vision, Code ; il n'y a pas de génération d'images native.

Spécifications en un coup d'œil

FamilleGénération GPT-5.6 (préversion)
ModalitésText, Vision, Code
LanguesAnglais d'abord, multilingue
Mise en cache des promptsSupported (OpenAI)
Fenêtre de contexte400K tokens
Sortie maximaleJusqu'à 128K tokens
Effort de raisonnementMinimal / Low / Medium / High
Tarif catalogue fournisseur$1 input / $6 output per 1M

Benchmarks de GPT 5.6 Luna

Chiffres de préversion issus des documents GPT-5.6 d'OpenAI, présentés face aux chiffres publics de GPT-5.4 Mini auquel Luna succède. Considérez tous les pourcentages comme indicatifs : la famille est en préversion et OpenAI a signalé une contamination de SWE-bench Verified pour l'ensemble des modèles de pointe.

SWE-bench Verifiedpréversion ; niveau économique
~70%
Terminal-Bench 2.0utilisation d'outils en préversion
~58%
AIME 2025 (no tools)mathématiques de compétition en préversion
~89%
GPQA Diamondscience de niveau doctoral en préversion
~80%
OSWorld (computer use)préversion
~62%
MMMU (multimodal)préversion
Entrée de gamme de la famille GPT-5.6
Speedeffort moyen, estimation préliminaire
~130 tokens/sec

Tarification de GPT 5.6 Luna

Prix catalogue fournisseur, par million de tokens.

Entrée$1.00
Sortie$6.00
Lecture cache$0.10
Écriture cache$1.25

Comment GPT 5.6 Luna se comporte en pratique

Comportement observé lors d'exécutions d'agents en production.

Vitesse

Le niveau le plus rapide de la famille GPT-5.6 — autour de 130 tokens/sec à effort moyen lors des premiers tests. C'est la raison de choisir Luna : les réponses interactives et les pipelines à haut débit restent réactifs.

Routage des outils

Fiable sur les appels d'outils simples et modérément structurés. Il perd du terrain face à Terra sur la sélection conditionnelle et face à Sol sur les appels d'outils déclenchés après un long raisonnement — gardez ces étapes sur les niveaux supérieurs.

Classification et extraction en masse

Le bon niveau pour exécuter le même prompt structuré sur des milliers d'éléments. L'entrée multimodale signifie qu'il gère l'extraction pilotée par captures d'écran et par documents, pas seulement par texte.

Profondeur de raisonnement

Plus léger que Terra et Sol sur le raisonnement difficile en plusieurs étapes et les longues boucles agentiques. Utilisez-le pour la largeur, pas la profondeur : de nombreux appels rapides et bon marché, avec les étapes difficiles promues vers le haut.

Profil de coût

1 $ / 6 $ par 1M et la tranche de crédit économique font de Luna le niveau GPT-5.6 le moins cher — le modèle que l'on fait tourner à la large base d'un pipeline où c'est le volume, et non le raisonnement de pointe, qui gonfle la facture.

Meilleures tâches d'agent pour GPT 5.6 Luna

Classification et étiquetage à fort volume

Exécutez Luna sur des milliers de tickets, e-mails ou documents pour étiqueter, aiguiller ou extraire des champs. À 1 $ / 6 $, le coût par élément reste bas, et l'entrée multimodale couvre les tâches pilotées par captures d'écran et par PDF.

Réponses de chat sensibles à la latence

Pour un assistant destiné aux utilisateurs où le temps de réponse se ressent directement, les ~130 tokens/sec de Luna maintiennent des réponses vives tout en gérant les appels d'outils et les sorties structurées.

La couche de base sous Terra et Sol

Dans un agent stratifié, Luna gère les nombreuses étapes rapides et bon marché — récupération, mise en forme, appels d'outils simples — tandis que Terra exécute la logique au quotidien et que Sol prend la planification la plus difficile. La stratification maintient l'ensemble du pipeline abordable.

Boucles brouillon-puis-affinage

Laissez Luna produire des premiers brouillons rapides — plans, code candidat, résumés — et ne promouvez vers Terra ou Sol que ceux qui nécessitent un peaufinage. Vous payez le tarif de pointe sur une fraction du volume.

Quand éviter GPT 5.6 Luna

Évitez Luna pour les refactorisations multifichiers les plus difficiles, les longues boucles d'orchestration et le raisonnement de niveau doctoral, où Terra et surtout Sol font nettement mieux. Lorsque la qualité des correctifs du premier coup ou le raisonnement approfondi est l'enjeu, le niveau économique est une fausse économie.

GPT 5.6 Luna vs autres modèles

GPT 5.6 Luna vs GPT 5.6 Terra

Terra est le choix par défaut équilibré au quotidien ; Luna est le niveau économique en dessous. Luna est plus rapide et coûte environ un tiers du tarif catalogue de Terra, mais renonce à la profondeur de raisonnement et au routage d'outils difficile. Faites tourner Luna pour le volume et la latence ; passez à Terra dès qu'une tâche nécessite un réel raisonnement.

GPT 5.6 Luna vs GPT-5.4 Mini

Luna est le successeur GPT-5.6 de GPT-5.4 Mini dans le créneau économique, avec le comportement d'utilisation d'outils et l'entrée multimodale de la nouvelle génération. Il est tarifé légèrement plus haut (1 $ / 6 $ contre 0,75 $ / 4,50 $) mais apporte les améliorations de GPT-5.6 au niveau bon marché et rapide.

GPT 5.6 Luna vs Claude Sonnet 4.6

Familles différentes, rôle chevauchant de l'économique à l'équilibré. Sonnet 4.6 apporte la fenêtre de contexte de 1M tokens et l'écosystème d'Anthropic ; Luna apporte le framework Codex, une génération plus rapide et un prix plus bas. Choisissez selon le framework, la longueur de contexte et l'importance que vous accordez à la vitesse par rapport à la profondeur de raisonnement.

En résumé : devriez-vous utiliser GPT 5.6 Luna ?

GPT 5.6 Luna est la base rapide et bon marché de la famille GPT-5.6 : faites-le tourner pour le travail à fort volume et sensible à la latence, et promouvez les étapes véritablement difficiles vers Terra et Sol.

Questions fréquentes

Quelle est la fenêtre de contexte de GPT 5.6 Luna ?

400 000 tokens, avec jusqu'à 128K tokens de sortie par réponse. L'ensemble de la fenêtre est facturé au tarif standard.

Quand faut-il utiliser Luna plutôt que Terra ?

Lorsque la vitesse et le coût comptent plus que la profondeur de raisonnement : classification et extraction à fort volume, chat sensible à la latence, et la couche de base bon marché d'un agent stratifié. Passez à Terra dès qu'une tâche nécessite un réel raisonnement en plusieurs étapes ou un routage d'outils difficile.

GPT-5.6 est-il disponible de façon générale sur VM0 ?

Il est en préversion. Les trois niveaux sont sélectionnables, mais GPT-5.5 reste le modèle OpenAI par défaut jusqu'à ce que la famille GPT-5.6 soit promue, et les chiffres de benchmarks en préversion sont préliminaires.

GPT 5.6 Luna prend-il en charge la mise en cache des prompts ?

Oui. L'entrée mise en cache est facturée à 0,10 $ par 1M de tokens avec des frais d'écriture en cache de 1,25 $ par 1M — la mise en cache la moins chère de la famille. Il vaut la peine de l'activer sur tout agent doté d'un préfixe stable.

Quel framework GPT 5.6 Luna utilise-t-il sur VM0 ?

Codex. VM0 achemine GPT-5.6 via la surface de l'API Responses du framework Codex. Les agents du framework Claude Code ne sont pas compatibles avec les modèles GPT-5 sur VM0.

Alternatives

Utiliser GPT 5.6 Luna sur VM0

Deux façons d'accéder à GPT 5.6 Luna sur VM0

VM0 prend en charge GPT 5.6 Luna comme modèle Built-in facturé en crédits VM0, et via le bring-your-own avec une OpenAI API key. La voie Built-in utilise le routage VM0 Managed et le multiplicateur de crédits expliqué ci-dessous ; la voie bring-your-own vous facture directement auprès du fournisseur en amont et contourne entièrement la conversion en crédits VM0.

La recommandation de VM0

VM0 positionne GPT 5.6 Luna comme une option économique plutôt qu'un modèle d'agent central. Utilisez-le pour optimiser le coût unitaire sur le travail non central, comme la classification en masse, les pré-filtres, les réponses courtes critiques en latence, ou les agents legacy figés, tout en gardant Claude Opus 4.7, Claude Opus 4.6 ou Claude Sonnet 4.6 sur les étapes qui décident de l'exécution.

Les crédits et le multiplicateur ×0.4

Chaque modèle Built-in sur VM0 est tarifé comme un multiple de Claude Sonnet 4.6, qui se situe à la référence de crédits ×1. GPT 5.6 Luna est facturé à ×0.4 crédits. Le multiplicateur est ce qui apparaît sur votre facture VM0 ; le prix catalogue du fournisseur dans le tableau de tarification ci-dessus est ce que le fournisseur en amont facture avant que VM0 ne le convertisse en crédits.

GPT 5.6 Luna est facturé à ×0.4, ce qui signifie qu'une étape ici ne coûte que 0.4× les crédits d'une étape équivalente sur Sonnet 4.6 (la référence ×1). Cela le place bien en dessous de la référence de crédits et en fait le choix naturel pour du travail de fond à fort volume où le coût par étape compte plus que la qualité de raisonnement maximale.

Disponible sur VM0 depuis le July 2026 (preview).