GPT-6 Astra: Lanzamiento, puntos de referencia, precios y la afirmación de AGI de OpenAI
GPT-6 Astra es oficial. OpenAI presentó el nuevo modelo insignia el 3 de septiembre de 2026, anunciando un salto significativo en control de computadora, codificación, matemáticas, ciberseguridad y contextos largos. Al mismo tiempo, la declaración del presidente de OpenAI, Greg Brockman, de que Astra podría marcar el comienzo de la era de la AGI, atrae al menos tanta atención como los valores de referencia reales.
A fecha de 5 de septiembre de 2026, el acceso todavía se está implementando gradualmente. Por lo tanto, este artículo separa los datos de producto confirmados de la autoevaluación de OpenAI: cuánto cuesta realmente GPT-6 Astra, para quién se activará ChatGPT Astra, qué puntos de referencia son particularmente sólidos, dónde los modelos de la competencia siguen liderando y por qué una puntuación del 99,9 % en ARC-AGI-3 aún no es una prueba científica de AGI.
Corto y conciso
- Lanzamiento: OpenAI presentó GPT-6 Astra el 3 de septiembre de 2026. La implementación comenzó con un número limitado de organizaciones y luego se espera que llegue a Plus, Pro, Business y Enterprise.
- API: El modelo se llama gpt-6-astra y también se ofrece a través de Microsoft Azure y AWS Bedrock.
- Precio: En la API estándar, 1 millón de tokens de entrada cuesta 10 USD y 1 millón de tokens de salida cuesta 50 USD. La entrada en caché cuesta 1 USD por millón de tokens.
- Puntos de referencia: Particularmente notables son el 99,9 % en ARC-AGI-3, el 97,6 % en FrontierMath Tier 4, el 100 % en ExploitBench y el 72,6 % en OSWorld 2.0.
- No es el número uno en todas partes: En Humanity's Last Exam con herramientas, Astra logra un 57,2 %, mientras que Claude Fable 5.1 alcanza un 65,0 % en la propia tabla de comparación de OpenAI.
- AGI: Greg Brockman dijo que personalmente cree que OpenAI ha alcanzado la AGI. Esta es la interpretación de un directivo de OpenAI, no una afirmación científica establecida de forma independiente.
¿Qué es GPT-6 Astra?
GPT-6 Astra es el nuevo modelo insignia de OpenAI para tareas de extremo a extremo particularmente exigentes. OpenAI lo posiciona no solo como un mejor chatbot, sino como un modelo que puede trabajar directamente con software, operar navegadores e interfaces de escritorio, escribir código, realizar investigaciones complejas y generar documentos profesionales. En el anuncio oficial, OpenAI describe Astra como su modelo más "inteligente y alineado" hasta la fecha. Esta formulación es una evaluación del fabricante y no debe confundirse con una clasificación independiente.
Técnicamente, destaca especialmente la gran ventana de contexto. La documentación de la API menciona 1.050.000 tokens de contexto y hasta 128.000 tokens de salida. La fecha límite de conocimiento documentada es el 30 de abril de 2026. Para el razonamiento, los desarrolladores pueden elegir entre los niveles bajo, medio, alto, muy alto y máximo. Quienes deseen seguir el desarrollo de la generación anterior encontrarán la clasificación de Zerlo sobre GPT-5.6 Sol y su implementación de ChatGPT.
Lanzamiento de GPT-6 Astra: ¿Quién obtiene ChatGPT Astra?
El lanzamiento no es un interruptor mundial que se activó simultáneamente para todas las cuentas el 3 de septiembre. OpenAI comenzó con un grupo limitado de organizaciones y anunció que implementaría GPT-6 Astra en los días siguientes para ChatGPT Plus, Pro, Business y Enterprise. Los clientes Pro, Business y Enterprise también deberían tener acceso a GPT-6 Astra Pro. En Enterprise, Astra está desactivado por defecto al inicio y debe ser habilitado por los administradores para el espacio de trabajo.
Importante: OpenAI no menciona una disponibilidad general para cuentas gratuitas o Go en el anuncio de Astra. Por lo tanto, si no ve el modelo el 5 de septiembre de 2026, es posible que simplemente esté en el proceso de implementación escalonada a pesar de tener un plan calificado. El uso de Astra en ChatGPT está incluido en las cuotas de plan existentes según OpenAI; el uso adicional debería ser posible a través de créditos. Por lo tanto, no existe un "plan Astra" mensual anunciado por separado.

Fuente: simpleicons.org
GPT-6 Astra no solo se ofrece directamente a través de OpenAI. OpenAI menciona explícitamente Microsoft Azure como una vía de implementación adicional para desarrolladores y empresas.

Fuente: simpleicons.org
AWS Bedrock también forma parte de la implementación anunciada de Astra. Para arquitecturas de nube existentes, esto puede ser más importante que un cambio directo a la API de OpenAI.
Puntos de referencia de GPT-6 Astra: ¿Qué tan grande es el salto?
Las cifras más sólidas se encuentran en áreas donde los modelos agentivos hasta ahora han encontrado límites particularmente rápido: resolución de problemas abstractos, control de computadora, desarrollo de software y tareas de seguridad ofensiva. La publicación de OpenAI incluye tanto puntos de referencia externos como pruebas internas. Especialmente en evaluaciones internas, la reproducción independiente no es naturalmente posible todavía.
| Punto de referencia | GPT-6 Astra | GPT-5.6 Sol | Clasificación |
|---|---|---|---|
| ARC-AGI-3 | 99,9 % | 7,8 % | Salto extremadamente grande en nuevas tareas de abstracción interactiva |
| FrontierMath Tier 4 (v2) | 97,6 % | 83,0 % | Rendimiento muy alto en matemáticas exigentes |
| Terminal-Bench 4.0 | 57,9 % | 37,3 % | Progreso significativo en codificación agentiva en terminal |
| OSWorld 2.0 | 72,6 % | 65,7 % | Mejor control de computadora; OpenAI también informa tiempos de tarea significativamente más cortos |
| AutomationBench | 41,4 % | 18,1 % | Puntuación más del doble en tareas de automatización profesional |
| ExploitBench | 100,0 % | 78,5 % | Muestra una capacidad de desarrollo de exploits muy sólida en pruebas controladas |
Estas cifras son impresionantes, pero necesitan contexto. OpenAI señala por sí mismo que las evaluaciones de GPT se realizaron en un entorno de investigación o a través de la API. ChatGPT de producción puede producir resultados diferentes debido a otros prompts del sistema, herramientas y mecanismos de seguridad. Además, la tabla de comparación muestra las mejores puntuaciones en diferentes niveles de esfuerzo de razonamiento.
Astra tampoco gana todas las pruebas. Un buen contraejemplo es Humanity's Last Exam con herramientas: Astra logra un 57,2 %, mientras que Claude Fable 5.1 se muestra con un 65,0 % en la misma tabla de OpenAI. El índice Artificial Analysis Intelligence es del 61,2 para Astra, también por debajo de varios modelos de Claude listados allí. Esto va en contra de la afirmación simplificada de que Astra es automáticamente el mejor modelo en todas las dimensiones.
Por qué ARC-AGI-3 atrae tanta atención
El salto del 7,8 % en GPT-5.6 Sol al 99,9 % en GPT-6 Astra es la cifra individual más espectacular del lanzamiento. ARC-AGI-3 pretende probar si un sistema descubre reglas en entornos nuevos e interactivos y actúa de manera eficiente, en lugar de simplemente recuperar patrones conocidos. La ARC Prize Foundation declaró en la publicación de lanzamiento de OpenAI que Astra superó la línea de base de eficiencia de acción humana en el 96 % de los niveles. Esta es una señal fuerte de nueva capacidad de resolución de problemas, pero aún no una medida general de todas las capacidades humanas.
Precio de GPT-6 Astra: ¿Cuánto cuesta la API?
Para los desarrolladores, la estructura de precios es más clara que los planes de ChatGPT: OpenAI factura Astra en la API estándar en función de los tokens. Los valores se aplican por cada 1 millón de tokens de texto.
| Facturación | Precio por 1 millón de tokens |
|---|---|
| Entrada | 10,00 USD |
| Entrada en caché | 1,00 USD |
| Escrituras en caché | 12,50 USD |
| Salida | 50,00 USD |
Con prompts muy grandes, se vuelve más caro: tan pronto como una solicitud contenga más de 272.000 tokens de entrada, OpenAI cobrará el doble de la tarifa de entrada y caché para toda la solicitud, y 1,5 veces la tarifa de salida. Según la documentación del modelo, Batch y Flex cuestan el 50 % de las tarifas estándar. El modo Fast, por otro lado, cuesta el doble de la tarifa aplicable y debería ofrecer hasta el doble de velocidad. Si bien la ventana de contexto máxima es técnicamente atractiva, no es automáticamente económica. Quienes alimentan regularmente cientos de miles de tokens en ejecuciones de agentes deben tomarse en serio el almacenamiento en caché de prompts, la selección de contexto y la división de tareas. El resumen más antiguo de Zerlo sobre ChatGPT 5.4 y su estructura de precios de API muestra cuánto han cambiado los costos entre las generaciones de modelos.
¿Ha alcanzado OpenAI la AGI con GPT-6 Astra?
La afirmación está confirmada, no la prueba. Axios informó desde la conferencia de prensa de lanzamiento que el presidente de OpenAI, Greg Brockman, cree personalmente que OpenAI ha alcanzado la AGI con Astra, o que este modelo podría verse retrospectivamente como la llegada de la Inteligencia General Artificial. Al mismo tiempo, dejó la clasificación final a los usuarios. La publicación oficial del producto de OpenAI presenta Astra muy agresivamente como una nueva generación de inteligencia, pero no proporciona una certificación independiente según la cual se haya superado un umbral de AGI universalmente aceptado.
El problema central es la definición. No existe una prueba universalmente aceptada para AGI que, al ser alcanzada, haga que un modelo se considere objetivamente "AGI". Un modelo puede saturar casi un único benchmark abstracto y, sin embargo, quedarse atrás de los modelos de la competencia en otras áreas, cometer errores, necesitar límites de seguridad o fallar en tareas reales a largo plazo. Precisamente eso muestra la propia tabla de puntos de referencia de OpenAI: Astra es excepcionalmente fuerte en ARC-AGI-3, pero no es el líder en Humanity's Last Exam con herramientas.
Por lo tanto, la formulación más sensata desde el punto de vista fáctico es: GPT-6 Astra es un candidato excepcionalmente fuerte en el debate actual sobre AGI, pero la afirmación de AGI de OpenAI sigue siendo una evaluación de la empresa y la gerencia. Si la investigación y el público también consideran que se ha alcanzado este umbral, dependerá de la definición de AGI utilizada y de las replicaciones independientes en el uso real.
Control de computadora y agentes: aquí es donde Astra se vuelve prácticamente relevante
El cambio más importante en comparación con un modelo de chat clásico no es solo más conocimiento o una puntuación de codificación más alta, sino la capacidad de ejecutar tareas directamente. OpenAI cita como ejemplos formularios, actualizaciones de CRM, organización de calendarios, investigación, instalación de software, resolución de problemas, análisis de datos y control de calidad de frontend. En OSWorld 2.0, Astra logra un 72,6 % frente al 65,7 % de GPT-5.6 Sol. En la simulación de latencia de OpenAI, Astra necesitó aproximadamente 40 en lugar de 75 minutos por tarea, alrededor de un 47 % menos de tiempo. Para las empresas, esta combinación de razonamiento, uso de computadora y contexto largo puede ser más importante que un punto porcentual adicional en un benchmark de conocimiento. Un agente que entiende correctamente una tarea, puede operar varias aplicaciones y mantener el contexto durante largos procesos, tiene el potencial de cambiar flujos de trabajo completos. Al mismo tiempo, esto también aumenta la importancia de los permisos, los diálogos de confirmación, el registro y los límites claros.
La otra cara: Astra alcanza el umbral "Crítico" de OpenAI para la ciberseguridad
OpenAI clasifica a GPT-6 Astra como su primer modelo propio que alcanza el umbral crítico en capacidades cibernéticas dentro del Marco de Preparación. Sin protección de producción, Astra pudo encontrar vulnerabilidades desconocidas y desarrollar exploits contra sistemas endurecidos, según OpenAI. En ExploitBench, el modelo alcanza el 100%, en ExploitGym el 42,4%. Quienes deseen comprender el funcionamiento de este benchmark con más detalle, encontrarán una explicación detallada en Zerlo sobre ExploitGym y el desarrollo de exploits asistido por IA.
OpenAI responde a esto con mecanismos de protección más sólidos y restricciones para tareas cibernéticas ofensivas avanzadas. Al mismo tiempo, hay una segunda observación incómoda: en pruebas construidas de forma adversarial, el razonamiento escrito de Astra fue más difícil de monitorear que el de GPT-5.6 Sol. OpenAI atribuye esto, entre otras cosas, a que Astra tiene un mayor control sobre su razonamiento escrito y puede resolver problemas más sencillos con menos pasos intermedios visibles. La empresa considera la disminución de la monitorización como un tema de investigación serio en sí mismo.
Esto solo parece contradictorio a primera vista con la afirmación de OpenAI de que Astra está más "alineado". Un modelo puede permanecer dentro de los límites especificados con más frecuencia en el comportamiento normal y, sin embargo, poseer capacidades técnicamente más peligrosas. Precisamente por eso, el comportamiento del modelo, la capacidad base y los sistemas de protección externos deben considerarse por separado.
¿Qué significa GPT-6 Astra para usuarios y desarrolladores?
Para los usuarios normales de ChatGPT, la pregunta a corto plazo más importante es el despliegue. Quienes utilicen Plus, Pro, Business o Enterprise no deben asumir que la falta de acceso a Astra el 5 de septiembre es ya un error. OpenAI habla explícitamente de una activación gradual a lo largo de varios días.
Para los desarrolladores, la decisión es más económica. Astra vale la pena especialmente donde una sola ejecución exitosa tiene un alto valor: agentes de codificación complejos, grandes repositorios, automatización del uso de la computadora, investigación exigente o flujos de trabajo profesionales largos. Para clasificaciones sencillas, generación de texto corta o tareas masivas sensibles al costo, un modelo más pequeño puede seguir siendo más sensato. El alto precio de salida de 50 USD por un millón de tokens y los recargos para contextos muy largos hacen que una elección de modelo limpia sea más importante, no menos importante.
Para las empresas, se añade un tercer factor: la gobernanza. Un agente más potente no debería recibir automáticamente más derechos. Especialmente en el caso de sistemas de archivos, navegadores, correo electrónico, aplicaciones internas y recursos en la nube, los permisos mínimos, las confirmaciones para acciones irreversibles y las pistas de auditoría rastreables deben seguir siendo estándar.
Preguntas frecuentes
¿Cuándo se lanzó GPT-6 Astra?
OpenAI presentó GPT-6 Astra el 3 de septiembre de 2026. El despliegue comenzó en un número limitado de organizaciones y posteriormente se ampliará gradualmente a ChatGPT Plus, Pro, Business y Enterprise, así como a la API, Microsoft Azure y AWS Bedrock.
¿Está GPT-6 Astra ya disponible en ChatGPT Plus?
OpenAI anunció explícitamente Plus para el despliegue. Dado que la activación se realiza durante varios días, una cuenta Plus autorizada puede que aún no muestre acceso a Astra el 5 de septiembre de 2026. Esto por sí solo no es un indicio de un error técnico.
¿Cuánto cuesta GPT-6 Astra en la API?
El precio estándar es de 10 USD por 1 millón de tokens de entrada y 50 USD por 1 millón de tokens de salida. La entrada cacheada cuesta 1 USD y las escrituras en caché 12,50 USD por millón de tokens. Las solicitudes con más de 272.000 tokens de entrada están sujetas a multiplicadores más altos.
¿Cuál es la ventana de contexto de GPT-6 Astra?
La documentación de la API de OpenAI menciona una ventana de contexto de 1.050.000 tokens y un máximo de 128.000 tokens de salida. Sin embargo, las solicitudes muy largas no solo son técnicamente más exigentes, sino que también son más caras a partir de más de 272.000 tokens de entrada.
¿Ha alcanzado realmente GPT-6 Astra la AGI?
Esto no está objetivamente demostrado. Greg Brockman dijo que personalmente creía que OpenAI había alcanzado la AGI o que Astra podría considerarse el comienzo de la era de la AGI. Sin embargo, no existe un benchmark científico universalmente aceptado que establezca un umbral universal de AGI. Por lo tanto, la afirmación debe interpretarse como una evaluación de OpenAI y no como un hecho científico concluido.
¿Es GPT-6 Astra más seguro que GPT-5.6 Sol?
OpenAI reporta mejores resultados en varias pruebas de alineación y límites, al mismo tiempo que Astra posee capacidades cibernéticas significativamente más fuertes y es más difícil de monitorear en pruebas adversariales a través de su razonamiento escrito. Por lo tanto, "más seguro" depende de si se considera el comportamiento, las capacidades subyacentes o la monitorización.
Conclusión
GPT-6 Astra es un lanzamiento real y técnicamente excepcional, no un simple rumor. Los puntos confirmados más fuertes son la ventana de contexto de 1,05 millones de tokens, avances significativos en el uso de la computadora y la codificación, y los valores extremadamente altos en los benchmarks ARC-AGI-3, FrontierMath y Ciberseguridad. Al mismo tiempo, se necesita una imagen matizada: Astra no lidera en todas las comparaciones, el despliegue aún está en curso y la nueva capacidad cibernética crea riesgos de seguridad adicionales.
La afirmación de AGI de OpenAI es, por lo tanto, la parte del lanzamiento que más necesita ser contextualizada. La declaración de Brockman es notable, pero una puntuación casi perfecta en ARC-AGI-3 por sí sola no convierte una definición controvertida en un hecho científico concluido. Para los usuarios, Astra es principalmente un nuevo y muy potente modelo de ChatGPT y agente; si realmente se considera el comienzo de la era de la AGI en retrospectiva, solo se sabrá a través de pruebas independientes y uso real a largo plazo.