GPT-5.6: OpenAI lanza Sol, Terra y Luna con beta multiagente y Programmatic Tool Calling

OpenAI renueva su línea de modelos con una nueva nomenclatura y capacidades agénticas
OpenAI lanzó GPT-5.6, su nueva familia de modelos con disponibilidad general en ChatGPT, Codex y la API. La familia se divide en tres tiers —Sol, Terra y Luna— con distintos niveles de capacidad, velocidad y costo. El lanzamiento incluye dos innovaciones mayores: Programmatic Tool Calling y una beta multiagente en la Responses API.
La nueva nomenclatura: Sol, Terra y Luna
GPT-5.6 introduce un sistema de nombres nuevo. El número identifica la generación del modelo, mientras que Sol, Terra y Luna son tiers de capacidad duraderos que pueden avanzar a su propio ritmo:
| Tier | Posicionamiento | Input / 1M tokens | Output / 1M tokens |
|---|---|---|---|
| Sol | Flagship — frontera de capacidad | $5,00 | $30,00 |
| Terra | Balance — competitivo con GPT-5.5 | $2,50 | $15,00 |
| Luna | Económico — alto volumen | $1,00 | $6,00 |
El alias gpt-5.6 enruta automáticamente a gpt-5.6-sol. Para usar Terra o Luna, especificá el slug completo.
Reducción de precios del 30 de julio
OpenAI redujo precios el 30 de julio de 2026:
- Luna: 80% más barato — ahora $1/$6 (antes $5/$30)
- Terra: 20% más barato — ahora $2,50/$15
Según OpenAI, Luna entrega rendimiento comparable a modelos que eran frontier-class hace un año, a aproximadamente 6 centavos por dólar por tarea, y a casi 9x la velocidad. En trabajo profesional medido por Agents Last Exam, Luna supera a Fable 5 con un costo estimado por tarea casi 99% menor.
Programmatic Tool Calling
La innovación más relevante para desarrolladores. GPT-5.6 puede escribir y ejecutar programas JavaScript en memoria que coordinan herramientas, procesan resultados intermedios, monitorean progreso y eligen la próxima acción mientras el trabajo se desarrolla.
Esto permite que las tareas con muchas herramientas avancen con menos tokens, menos round trips al modelo y menos guía. En lugar de requerir que los desarrolladores scripteen cada paso o pasar cada respuesta de herramienta de vuelta al modelo, Programmatic Tool Calling puede:
- Filtrar grandes cantidades de datos intermedios
- Retener solo lo que importa
- Adaptar el workflow sobre la marcha
- Hacer join, ranking, deduplicación y agregación
Programmatic Tool Calling es compatible con Zero Data Retention (ZDR), sin costos adicionales de contenedor.
Beta multiagente
La Responses API ahora incluye una beta multiagente que permite a una instancia de GPT-5.6 coordinar múltiples subagentes en paralelo y sintetizar sus resultados en una sola request.
Esto es similar al modo ultra en Codex, que coordina cuatro agentes en paralelo por defecto. Para tareas que recompensan mayor inversión de tiempo y cómputo, ultra canjea mayor uso de tokens por resultados más fuertes y menor tiempo total.
Los benchmarks muestran que agregar agentes paralelos desplaza la frontera score-latencia hacia arriba y a la izquierda: resultados más fuertes en menos tiempo.
Niveles de razonamiento
GPT-5.6 introduce nuevos niveles de esfuerzo de razonamiento:
| Nivel | Uso |
|---|---|
medium (default) | Balance estándar |
xhigh | Razonamiento profundo |
max | Aún más tiempo que xhigh — razonar, explorar alternativas, verificar |
ultra | Coordina 4 agentes en paralelo — máximo rendimiento |
Disponibilidad por plan
| Plataforma | Plan | Acceso |
|---|---|---|
| ChatGPT Work | Free / Go | Terra |
| ChatGPT Work | Plus / Pro / Business / Enterprise | Sol, Terra, Luna + elección de effort |
| ChatGPT Work | Pro / Enterprise | ultra disponible |
| Codex | Plus y superior | ultra disponible |
| API | Todos | Sol, Terra, Luna + PTC + multiagente beta |
Fast Mode en la API
OpenAI introdujo Fast mode en la API, que reemplaza el Priority Processing anterior. Para GPT-5.6 Sol, Fast mode entrega hasta 2,5x más velocidad que Standard al doble de precio, sin cambio en inteligencia. Es retrocompatible: requests taggeados como priority usarán Fast mode automáticamente.
Caching mejorado
GPT-5.6 introduce caching de prompt más predecible:
- Soporte para explicit cache breakpoints
- Vida mínima de cache de 30 minutos
- Cache writes facturados a 1,25x la tarifa de input sin cache
- Cache reads con 90% de descuento sobre input sin cache
Seguridad y ciberseguridad
OpenAI reporta salvaguardas entrenadas en el modelo, verificaciones en tiempo real, monitoreo y controles de acceso calibrados al riesgo. Para ciberseguridad, la documentación diferencia tareas defensivas —revisión de código, modelado de amenazas, validación de parches— de usos de mayor riesgo.
Programmatic Tool Calling en la Responses API es compatible con Zero Data Retention, pero OpenAI advierte que cada aplicación debe revisar sus propias políticas antes de enviar documentos o datos personales.
Por qué importa
GPT-5.6 representa un cambio estructural en cómo OpenAI posiciona sus modelos:
- Tiers duraderos: Sol, Terra y Luna no son versiones temporales sino líneas de producto que evolucionan independientemente
- Multiagente nativo: la capacidad de coordinar subagentes en paralelo deja de ser experimental y se integra en la API
- Programmatic Tool Calling: reduce drásticamente tokens y latencia en workflows con muchas herramientas
- Luna a precio ridículo: a $1/$6 con rendimiento cercano a frontier-class de hace un año, habilita casos de uso de alto volumen que antes eran inviables
Para desarrolladores latinoamericanos, Luna es la noticia más práctica: rendimiento comparable a modelos premium recientes a una fracción del costo, ideal para aplicaciones de alto volumen en producción.