OpenAI lanza GPT-6 Astra: 99,9% en ARC-AGI-3 y el primer modelo con umbral ciber Critical
OpenAI anunció el 3 de septiembre de 2026 el lanzamiento de GPT-6 Astra, que describe como su modelo más inteligente y alineado hasta la fecha. Es también el primer modelo de la empresa en cruzar el umbral Critical de capacidades de ciberseguridad definido en su Preparedness Framework, lo que obligó a reforzar salvaguardas antes de la salida. El despliegue comienza hoy para un conjunto limitado de organizaciones y en los próximos días llega a todos los planes Plus, Pro, Business y Enterprise de ChatGPT, además de la API como gpt-6-astra y Microsoft Azure y AWS Bedrock.
Benchmarks: el modelo que satura las pruebas
Los números publicados muestran dos cosas: resultados en el tope absoluto en pruebas de razonamiento general y victorias claras sobre Claude Fable 5.1 y Claude Opus 5 en tareas agénticas, a costo menor por tarea.
| Benchmark | GPT-6 Astra | Comparación |
|---|---|---|
| ARC-AGI-3 | 99,9% | Saturado |
| FrontierMath Tier 4 | 98% | Saturado |
| GPQA Diamond | 96,0% | Liderazgo absoluto |
| Terminal-Bench Science 0.1 | 64,6% | Fable 5.1: 52,6%, a ~31% más de costo |
| Terminal-Bench 4.0 | 57,9% | Fable 5.1: 55,8% (costo ~63% mayor); GPT-5.6 Sol: 37,3% |
| Agents' Last Exam | 59,3% | Opus 5: 55,5%; generando ~65% menos tokens de salida |
| OSWorld 2.0 (simulaciones) | 72,6% | GPT-5.6 Sol: 65,7% tardando ~75 min por tarea frente a ~40 min |
| SRE-Bench | 88,0% / 99,2% | Sol: 55,9% / 68,7% (primer intento / cuatro intentos) |
Más allá de los puntajes, el resultado más notable es matemático y verificable: con ayuda de Astra, la matemática Julia Stadlmann mejoró la cota sobre brechas entre números primos de 246 a 240, y Astra la llevó a 186; además, la cota de las brechas grandes de primos mejoró por primera vez en más de 80 años. En tareas de ingeniería, Cadence reportó 95,9% en su benchmark BenchCAD frente a 83,3% de GPT-5.6 Sol, y el nuevo harness de Codex completa tareas 1,9 veces más rápido que la experiencia con Sol.
Características: computer use profesional y contexto que no se pierde
Astra está orientado a trabajo real de escritorio: completar registros en software CRM legacy, ejecutar control de calidad de frontend en navegadores reales y, en la demo más técnica, diseñar un layout de circuito impreso en KiCad en dos horas de trabajo autónomo. En el plano profesional trabaja con plantillas —documentos, slides y hojas de cálculo— generando artefactos que respetan el formato establecido.
- Sites en ChatGPT: crear, hostear y compartir sitios web, aplicaciones y juegos directamente desde un prompt, sin configurar despliegue.
- Codex con memoria entre ventanas de contexto: cuando la ventana de contexto se llena, el agente ahora deja notas y puede recuperar información de ventanas anteriores en lugar de perder el trabajo; está experimental vía config.toml y llegará como predeterminado en las próximas semanas.
- Decisión bajo ambigüedad: cuando una tarea es incompleta, pregunta de forma asíncrona o procede con supuestos razonables en lugar de adivinar.
Ciberseguridad: el primer modelo Critical
La capacidad que domina el anuncio es la ofensiva. Sin salvaguardas de producción, Astra resuelve el 100% de ExploitBench —frente a 78,5% de GPT-5.6 Sol— y 42,4% de ExploitGym, el benchmark interno de capacidades de explotación. Durante la evaluación descubrió dos vulnerabilidades zero-day previamente desconocidas en V8, el motor de JavaScript de Chrome, que están siendo reportadas a sus mantenedores.
La versión de lanzamiento refleja ese poder: puede revisar código inseguro y proponer parches, pero rechaza crear pruebas de concepto de exploits. Para flujos defensivos reales —validación de vulnerabilías, análisis de malware, ingeniería de detección— OpenAI abrirá el programa Daybreak en las próximas semanas. El patrón ya es industria: Anthropic restringió Mythos 5.1 a programas verificados (CVP y LSVP), Google limitó Flash Cyber al programa Fairwind, y OpenAI hace lo propio con Daybreak.
Alineación: mejor que su predecesor, pero más difícil de vigilar
En las métricas de comportamiento, Astra supera con claridad a GPT-5.6 Sol: en tareas imposibles fuera de su alcance, nunca actuó más allá de lo autorizado (Sol lo hizo en 48% de los casos); rechaza 91,5% de los jailbreaks de ciberseguridad (Sol: 59%); nunca eludió una denegación del auto-review de Codex; y es unas tres veces menos propenso a alucinar capacidades que no tiene.
OpenAI también admite lo incómodo: el razonamiento escrito de Astra es más difícil de monitorear que el de Sol, y por primera vez la empresa desplegará monitoreo de desalineación en producción para modelos de clase Astra, con capacidad de pausar tareas cuando detecta comportamiento preocupante. Según el post complementario Path to Astra, la empresa retrasó partes del desarrollo durante semanas para reforzar las salvaguardas, incluida una pausa en cierto entrenamiento frontier tras el incidente de seguridad de Hugging Face, reiniciada el 28 de agosto.
Precios y disponibilidad
La API cuesta US$10 por millón de tokens de entrada y US$50 por millón de salida —exactamente el mismo precio que Claude Fable 5.1—, con tarifas de cacheo separadas y un modo Fast que duplica la velocidad al doble de precio. El uso en ChatGPT está incluido en las asignaciones de cada suscripción, con créditos adicionales disponibles; los planes Pro, Business y Enterprise reciben además GPT-6 Astra Pro. Para empresas el modelo llega apagado por defecto, y los clientes API elegibles pueden acogerse a Zero Data Retention.
La semana de los frontier
Astra cierra una secuencia notable: Fable 5.1 el 1 de septiembre, Gemini 3.8 Flash el 2 y Astra el 3. Tres estrategias distintas —salvaguardas diferenciadas en Anthropic, precio agresivo en Google (US$0,75/US$3,75 por millón en su tarifa introductoria) y capacidad máxima con monitoreo de alineación en OpenAI—, y las tres con un programa de acceso verificado para ciberseguridad. Para equipos que eligen por API, la decisión práctica sigue siendo la misma de esta semana: el tope de gama de OpenAI y Anthropic cuesta lo mismo, y la diferencia real la marcarán los benchmarks independientes y el costo por tarea resuelta en producción.
Preguntas frecuentes
¿Cuándo estará disponible en ChatGPT?
El despliegue comenzó el 3 de septiembre para un conjunto limitado de organizaciones; en los días siguientes llega a todos los planes Plus, Pro, Business y Enterprise. En empresas viene apagado por defecto y los administradores deben activarlo.
¿Cuánto cuesta la API?
US$10 por millón de tokens de entrada y US$50 por millón de salida, con tarifas de cacheo separadas y modo Fast a doble precio por doble velocidad. Es el mismo precio de lista que Claude Fable 5.1.
¿Qué es el programa Daybreak?
Es el programa de acceso expandido de OpenAI para flujos de ciberseguridad defensiva —validación de vulnerabilidades y pruebas de concepto, análisis de malware, ingeniería de detección— que abrirá en las próximas semanas con salvaguardas menos restrictivas para organizaciones verificadas.
¿Por qué sale un modelo Critical?
Porque el umbral se gestiona con salvaguardas, no solo con retrasos: la versión pública revisa y parchea código pero rechaza crear exploits funcionales, el acceso ofensivo queda para el programa Daybreak, y el modelo incluye monitoreo de desalineación en producción que puede pausar tareas.
Fuentes verificadas
OpenAI — GPT-6 Astra: A new generation of intelligence
openai.com · 2026-09-03
OpenAI — Path to Astra: critical capabilities and frontier safeguards
openai.com · 2026-09-03