GPT 5.6 Luna en VM0. El nivel económico y rápido de GPT-5.6
El nivel económico de la familia preliminar GPT-5.6 de OpenAI. Rápido, barato y multimodal, creado para uso de herramientas de alto volumen, trabajo masivo y respuestas sensibles a la latencia.
400K tokens · Text / Vision / Code · Prompt cache
GPT 5.6 Luna es el nivel económico de la generación preliminar GPT-5.6 de OpenAI: el miembro rápido y barato de la familia, creado para uso de herramientas de alto volumen, clasificación y extracción masivas, y chat sensible a la latencia donde la velocidad y el coste importan más que la profundidad de razonamiento de frontera.
El precio de lista del proveedor es de $1 / $6 per 1M tokens, con entrada en caché a $0.10 / 1M, el más bajo de la familia GPT-5.6. Se sitúa en la banda de crédito económica de VM0, lo que lo convierte en el nivel al que recurrir para la amplia base del trabajo rutinario mientras GPT 5.6 Terra gestiona el agente del día a día y Sol se encarga solo de los pasos más difíciles. GPT-5.6 es actualmente una familia preliminar; GPT-5.5 sigue siendo el modelo de OpenAI predeterminado hasta que se gradúe.
¿Qué es GPT 5.6 Luna?
Versión preliminar de julio de 2026 (nivel económico de la familia GPT-5.6) · Nivel económico de la familia GPT-5.6, por debajo de Sol y Terra. La opción rápida y de bajo coste para trabajo de alto volumen y sensible a la latencia.
GPT-5.6 se lanzó en julio de 2026 como una familia de tres niveles —Sol, Terra y Luna. Luna es el nivel económico: OpenAI lo posiciona para la base de alto volumen y sensible a la latencia de la carga de trabajo de un agente, el papel que jugó GPT-5.4 Mini en la generación anterior. Conserva la ventana de contexto de 400K tokens y el parámetro reasoning_effort de la familia, así que se integra sin cambios en los agentes Codex existentes.
Luna cambia el razonamiento de gama alta por velocidad y coste. A $1 / $6 per 1M tokens es una fracción del precio de Sol y el nivel GPT-5.6 admitido más barato en VM0. En los materiales preliminares de OpenAI se defiende bien en uso de herramientas sencillo, clasificación y extracción, y solo se queda atrás de forma significativa en las tareas de razonamiento difícil y bucles largos que, de todos modos, corresponden a Terra o Sol.
Como con el resto de la familia preliminar, las cifras son tempranas y orientativas. Lo estable es el papel de Luna: es el nivel que ejecutas en la amplia base de una tubería —muchas llamadas baratas y rápidas— mientras asciendes la pequeña fracción de pasos genuinamente difíciles a Terra y Sol. Esa estratificación es lo que mantiene a un agente GPT-5.6 a la vez capaz y asequible.
Qué destaca de GPT 5.6 Luna
Características principales de arquitectura y capacidades.
GPT 5.6 Luna conserva la ventana de contexto de 400K tokens, facturada al precio de entrada estándar en toda la ventana. Admite el parámetro reasoning_effort, el almacenamiento en caché de prompts donde la entrada en caché se factura a una décima parte de la tarifa de entrada ($0.10 / 1M) más un cargo por escritura en caché ($1.25 / 1M), y la superficie de la Responses API que la codex CLI usa por defecto. El uso de herramientas, las salidas estructuradas y el uso de computadora coinciden con el resto de la familia GPT-5.6. Las entradas son multimodales entre texto, visión y código; no hay generación nativa de imágenes.
Especificaciones rápidas
Benchmarks de GPT 5.6 Luna
Cifras preliminares de los materiales de GPT-5.6 de OpenAI, mostradas frente a las cifras públicas de GPT-5.4 Mini a la que Luna sucede. Trata todos los porcentajes como orientativos: la familia está en versión preliminar y OpenAI ha señalado contaminación de SWE-bench Verified en los modelos de frontera.
Precios de GPT 5.6 Luna
Precio de lista del proveedor, por 1M de tokens.
Cómo se comporta GPT 5.6 Luna en la práctica
Comportamiento observado en ejecuciones de agentes en producción.
Velocidad
El nivel más rápido de la familia GPT-5.6: alrededor de 130 tokens/sec con esfuerzo medio en pruebas tempranas. Esta es la razón para elegir Luna: las respuestas interactivas y las tuberías de alto rendimiento se mantienen receptivas.
Enrutamiento de herramientas
Fiable en llamadas de herramientas sencillas y moderadamente estructuradas. Pierde terreno frente a Terra en la selección condicional y frente a Sol en las llamadas de herramientas emitidas tras un razonamiento largo: mantén esos pasos en los niveles superiores.
Clasificación y extracción masivas
El nivel adecuado para ejecutar el mismo prompt estructurado en miles de elementos. La entrada multimodal significa que gestiona la extracción basada en capturas de pantalla y documentos, no solo texto.
Profundidad de razonamiento
Más ligero que Terra y Sol en razonamiento difícil de varios pasos y bucles agénticos largos. Úsalo para la amplitud, no para la profundidad: muchas llamadas baratas y rápidas, con los pasos difíciles ascendidos hacia arriba.
Perfil de coste
$1 / $6 per 1M y la banda de crédito económica hacen de Luna el nivel GPT-5.6 más barato: el modelo que ejecutas en la amplia base de una tubería donde el volumen, no el razonamiento de frontera, impulsa la factura.
Mejores tareas para GPT 5.6 Luna
Clasificación y etiquetado de alto volumen
Ejecuta Luna en miles de tickets, correos o documentos para etiquetar, enrutar o extraer campos. A $1 / $6 el coste por elemento se mantiene bajo, y la entrada multimodal cubre trabajos basados en capturas de pantalla y PDF.
Respuestas de chat sensibles a la latencia
Para un asistente de cara al usuario donde el tiempo de respuesta se percibe directamente, los ~130 tokens/sec de Luna mantienen las respuestas ágiles a la vez que gestiona las llamadas de herramientas y las salidas estructuradas.
La capa base bajo Terra y Sol
En un agente estratificado, Luna gestiona los muchos pasos baratos y rápidos —obtención, formateo, llamadas de herramientas sencillas— mientras Terra ejecuta la lógica del día a día y Sol se encarga de la planificación más difícil. La estratificación mantiene asequible toda la tubería.
Bucles de borrador y refinamiento
Deja que Luna produzca borradores iniciales rápidos —esquemas, código candidato, resúmenes— y asciende solo los que necesitan pulido a Terra o Sol. Pagas la tarifa de frontera en una fracción del volumen.
Cuándo evitar GPT 5.6 Luna
Evita Luna en las refactorizaciones de varios archivos más difíciles, los bucles de orquestación largos y el razonamiento de nivel de posgrado, donde Terra y especialmente Sol lo hacen sustancialmente mejor. Cuando lo que cuenta es la calidad de parche al primer intento o el razonamiento profundo, el nivel económico es una economía falsa.
GPT 5.6 Luna vs otros modelos
GPT 5.6 Luna vs GPT 5.6 Terra
Terra es el predeterminado equilibrado del día a día; Luna es el nivel económico por debajo. Luna es más rápido y cuesta aproximadamente un tercio del precio de lista de Terra, pero cede profundidad de razonamiento y enrutamiento de herramientas difícil. Ejecuta Luna para volumen y latencia; sube a Terra en cuanto una tarea necesite razonamiento real.
GPT 5.6 Luna vs GPT-5.4 Mini
Luna es el sucesor GPT-5.6 de GPT-5.4 Mini en el segmento económico, con el comportamiento de uso de herramientas y la entrada multimodal de la generación más nueva. Tiene un precio de lista ligeramente superior ($1 / $6 vs $0.75 / $4.50) pero aporta las mejoras de GPT-5.6 al nivel barato y rápido.
GPT 5.6 Luna vs Claude Sonnet 4.6
Familias distintas, papel solapado de económico a equilibrado. Sonnet 4.6 aporta la ventana de contexto de 1M tokens y el ecosistema de Anthropic; Luna aporta el framework Codex, una generación más rápida y un precio más bajo. Elige según el framework, la longitud de contexto y cuánto valoras la velocidad sobre la profundidad de razonamiento.
Conclusión: ¿deberías usar GPT 5.6 Luna?
GPT 5.6 Luna es la base rápida y barata de la familia GPT-5.6: ejecútalo para trabajo de alto volumen y sensible a la latencia, y asciende los pasos genuinamente difíciles a Terra y Sol.
Preguntas frecuentes
¿Cuál es la ventana de contexto de GPT 5.6 Luna?
400.000 tokens, con hasta 128K tokens de salida por respuesta. La ventana completa se factura a tarifas estándar.
¿Cuándo debería usar Luna en lugar de Terra?
Cuando la velocidad y el coste importan más que la profundidad de razonamiento: clasificación y extracción de alto volumen, chat sensible a la latencia y la capa base barata de un agente estratificado. Sube a Terra en cuanto una tarea necesite razonamiento real de varios pasos o enrutamiento de herramientas difícil.
¿Está GPT-5.6 disponible de forma general en VM0?
Está en versión preliminar. Los tres niveles se pueden seleccionar, pero GPT-5.5 sigue siendo el modelo de OpenAI predeterminado hasta que la familia GPT-5.6 se gradúe, y las cifras de benchmarks preliminares son tempranas.
¿Admite GPT 5.6 Luna el almacenamiento en caché de prompts?
Sí. La entrada en caché se factura a $0.10 per 1M tokens con un cargo por escritura en caché de $1.25 per 1M, el almacenamiento en caché más barato de la familia. Vale la pena habilitarlo en cualquier agente con un prefijo estable.
¿Qué framework usa GPT 5.6 Luna en VM0?
Codex. VM0 enruta GPT-5.6 a través de la superficie de la Responses API del framework Codex. Los agentes del framework Claude Code no son compatibles con los modelos GPT-5 en VM0.
Alternativas
Usar GPT 5.6 Luna en VM0
Dos formas de acceder a GPT 5.6 Luna en VM0
VM0 admite GPT 5.6 Luna como modelo Built-in facturado en créditos VM0, y mediante bring-your-own con una OpenAI API key. La ruta Built-in usa enrutamiento gestionado de VM0 y el multiplicador de créditos explicado abajo; la ruta bring-your-own te factura directamente con el proveedor upstream y omite la conversión de créditos VM0.
Recomendación de VM0
VM0 posiciona GPT 5.6 Luna como una opción de ahorro en lugar de un modelo principal de agente. Úsalo para optimizar el coste unitario en trabajo no principal, como clasificación masiva, prefiltros, respuestas cortas con requisitos de latencia o agentes heredados fijos, manteniendo Claude Opus 4.7, Claude Opus 4.6 o Claude Sonnet 4.6 en los pasos que deciden la ejecución.
Créditos y el multiplicador ×0.4
Cada modelo Built-in en VM0 se valora como un múltiplo de Claude Sonnet 4.6, que establece la base de ×1 crédito. GPT 5.6 Luna factura a ×0.4 créditos. El multiplicador es lo que aparece en tu factura de VM0; el precio de lista del proveedor en la tabla de arriba es lo que cobra el proveedor upstream antes de que VM0 lo convierta en créditos.
GPT 5.6 Luna factura a ×0.4, lo que significa que un paso aquí cuesta solo 0.4× los créditos de un paso equivalente en Sonnet 4.6 (la base ×1). Esto lo sitúa muy por debajo de la base de créditos y lo convierte en la elección natural para trabajo en segundo plano de alto volumen donde el coste por paso importa más que la máxima calidad de razonamiento.
Disponible en VM0 desde July 2026 (preview).