GPT-5.3-Codex: Una Nueva Era para el Desarrollo de Software

Avatar
Lisa Ernst · 15.02.2026 · Inteligencia Artificial · 7 min

El auge de GPT-5.3-Codex marca un momento crucial en la inteligencia artificial y el desarrollo de software. Como alguien que ha seguido la evolución de los modelos de IA desde conceptos teóricos hasta herramientas prácticas, puedo decir que este lanzamiento está destinado a transformar la forma en que se escribe, depura y despliega el código. El último modelo de programación agentic de OpenAI promete capacidades sin precedentes en velocidad y alcance.

GPT-5.3-Codex, presentado a principios de febrero de 2026, es el modelo de programación agentic más nuevo de OpenAI. Combina de manera única el poder de programación de GPT-5.2-Codex con las capacidades de razonamiento y conocimiento de GPT-5.2. Este modelo también es notable por ser el primero en contribuir significativamente a su propio desarrollo, asistiendo en la depuración y optimización de su proceso de entrenamiento, como se destaca en un artículo de Vibe Check. OpenAI diseñó GPT-5.3-Codex para gestionar tareas complejas y largas que implican investigación, uso de herramientas y ejecución intrincada.

Resumen Rápido: Puntos Destacados de GPT-5.3-Codex

Rendimiento y Velocidad: El Motor Detrás de GPT-5.3-Codex

El modelo demuestra una mejora significativa en la velocidad, operando un 25% más rápido que su predecesor, GPT-5.2-Codex, según el blog Vibe Check. Este rendimiento mejorado se debe a su co-diseño en sistemas NVIDIA GB200 NVL72, que permitió un rendimiento de entrenamiento cuatro veces mayor. GPT-5.3-Codex cuenta con una ventana de contexto sustancial de 400.000 tokens y un límite de salida de 128.000 tokens, lo que permite la generación de sistemas de software completos en una sola interacción.

Sus métricas de precisión representan un salto notable hacia adelante en capacidad. En SWE-Bench Pro, el modelo logra un 56,8% de precisión. Terminal-Bench 2.0 muestra un impresionante 77,3% de precisión, un aumento significativo respecto al 64,0% de GPT-5.2-Codex. Además, en OSWorld-Verified, alcanza un 64,7% de precisión, un salto sustancial respecto al 38,2% del modelo anterior. Estas cifras demuestran la capacidad mejorada del modelo para realizar tareas complejas. Las capacidades de razonamiento de GPT-5.3-Codex también se alinean con las de GPT-5.2 en GDPval, registrando un 70,9%. Este modelo incluso supera a Claude Opus 4.6 en Terminal-Bench 2.0 (75,1% frente a 69,9%).

Gráfico de comparación de rendimiento GPT-5.3-Codex vs GPT-5.2-Codex. 4|Esta imagen muestra dos barras...

Fuente: tech-now.io

Un gráfico de barras compara visualmente las métricas de precisión de GPT-5.3-Codex frente a su predecesor, GPT-5.2-Codex, destacando un claro salto en rendimiento.

Benchmark Precisión de GPT-5.2-Codex Precisión de GPT-5.3-Codex
SWE-Bench Pro N/A 56.8%
Terminal-Bench 2.0 64.0% 77.3%
OSWorld-Verified 38.2% 64.7%
GDPval (Reasoning) 70.9% (GPT-5.2) 70.9%

Medidas de Accesibilidad y Seguridad

GPT-5.3-Codex ya está ampliamente disponible para usuarios de GitHub Copilot, como se detalla en la documentación de Copilot y en la página de planes de GitHub Copilot. Extiende su alcance a suscriptores de Copilot Pro, Pro+, Business y Enterprise. Los administradores de Copilot Enterprise y Copilot Business deben activar la política GPT-5.3-Codex dentro de su configuración de Copilot para utilizar sus capacidades. Más allá de GitHub, los usuarios pueden acceder al modelo a través de la aplicación Codex para macOS, una interfaz de línea de comandos (CLI), extensiones IDE y la interfaz web para suscriptores de ChatGPT de pago, accesible a través de la página de precios de ChatGPT. Aunque el acceso a la API para GPT-5.3-Codex aún no está disponible, OpenAI anticipa su lanzamiento "pronto", y los costos de uso de la API aún se están finalizando.

Logo de GitHub Copilot. 1|Esta imagen muestra la silueta estilizada de una cabeza de robot en blanco y negro con…

Fuente: automateandtweak.com

El logo de GitHub Copilot, una cabeza de robot estilizada, introduce la accesibilidad ampliada de GPT-5.3-Codex a usuarios y suscriptores de Copilot.

OpenAI prioriza la seguridad, clasificando GPT-5.3-Codex como el primer modelo con "Alta Capacidad" para ciberseguridad bajo su Marco de Preparación. La compañía ha implementado extensas medidas de seguridad, incluido un programa de "Acceso Confiable para Ciberseguridad" y una subvención de 10 millones de dólares dedicada a la investigación de ciberseguridad. OpenAI también fomenta el ecosistema introduciendo el agente de seguridad Aardvark (Beta) y proporcionando 10 millones de dólares en créditos API para proyectos de código abierto.

Colaboración Interactiva y Aplicaciones Prácticas

GPT-5.3-Codex funciona como un "Programador Pareja" interactivo, ofreciendo resultados inmediatos. El flag `--steerable` permite a los desarrolladores monitorear y corregir el proceso de generación en tiempo real, fomentando una colaboración dinámica. Este modelo sobresale en prototipos rápidos y en el uso de herramientas CLI operativas, lo que lo convierte en una opción ideal para desarrolladores que buscan velocidad y agilidad. Su característica de colaboración interactiva garantiza que los usuarios puedan dirigir el modelo durante las tareas y ofrecer comentarios, mejorando la eficiencia.

steerable.sh
--steerable

La versatilidad del modelo se extiende a varias aplicaciones, desde la creación de presentaciones completas de PowerPoint hasta el desarrollo de juegos totalmente funcionales. Puede escribir consultas SQL, recuperar datos y generar informes PDF o presentaciones de diapositivas. Diseñado para realizar "trabajo de conocimiento" junto con "trabajo de programación" más allá del entorno de desarrollo integrado (IDE), GPT-5.3-Codex soporta todo el ciclo de vida del software, abarcando ingeniería, operaciones, planificación de productos, análisis y comunicación. Demuestra alta competencia en la depuración en escenarios DevOps y puede ser invaluable para la auto-reparación de infraestructura, migración de sistemas heredados y tareas de ciberseguridad.

Desafíos y el Futuro Híbrido

A pesar de sus notables capacidades, GPT-5.3-Codex presenta ciertos matices. Si bien sacrifica profundidad por velocidad, resulta menos adecuado para preguntas arquitectónicas complejas en comparación con modelos "más profundos" como Claude Opus. Una característica notable es su tendencia a la "Deriva de Contexto" con grandes conjuntos de datos, donde puede olvidar restricciones. El modelo también puede clasificar erróneamente scripts legítimos de pruebas de penetración como ataques maliciosos, lo que lleva a la denegación de ejecución. Las descripciones del modelo lo resaltan como "un interno hiperactivo, técnicamente brillante, con esteroides": rápido en la ejecución pero propenso a descuidos y problemas de concentración sin supervisión constante, como se detalla en una publicación del blog Vibe Check.

un interno hiperactivo, técnicamente brillante, con esteroides
Vibe Check
Vibe Check
blog de every.to
Logo de Claude Opus AI. 8|Esta imagen presenta la silueta estilizada de una cabeza blanca con un…

Fuente: anthropic.com

El logo de Claude Opus representa un modelo "más profundo" más adecuado para preguntas arquitectónicas complejas que el más rápido GPT-5.3-Codex.

El futuro del desarrollo de software probablemente adoptará un enfoque híbrido. Esta visión ve modelos como Claude Opus manejando la planificación arquitectónica y el "trabajo profundo", mientras que GPT-5.3-Codex actúa como el motor de ejecución principal dentro de la terminal. Esta combinación aprovecha las fortalezas de cada modelo, prometiendo un flujo de trabajo de desarrollo más eficiente y potente.

Preguntas Frecuentes sobre GPT-5.3-Codex

¿Cuándo se lanzó GPT-5.3-Codex?

GPT-5.3-Codex se lanzó a principios de febrero de 2026.

¿Cuáles son las principales mejoras en GPT-5.3-Codex en comparación con su predecesor?

Es un 25% más rápido que GPT-5.2-Codex, cuenta con una ventana de contexto de 400.000 tokens y muestra mejoras significativas de precisión en benchmarks como Terminal-Bench 2.0 y OSWorld-Verified. También integra capacidades de razonamiento de GPT-5.2.

¿Está GPT-5.3-Codex disponible para todos los usuarios?

Está generalmente disponible para usuarios de GitHub Copilot Pro, Pro+, Business y Enterprise. Los suscriptores de ChatGPT de pago también pueden acceder a él a través de la interfaz web, la aplicación para macOS, la CLI y las extensiones IDE. Se espera el acceso a la API "pronto".

¿Cuáles son los posibles inconvenientes de usar GPT-5.3-Codex?

Aunque rápido, puede carecer de profundidad para preguntas arquitectónicas complejas en comparación con otros modelos. También puede experimentar "Deriva de Contexto" con grandes conjuntos de datos y podría clasificar incorrectamente el código legítimo como malicioso.

Conclusión

GPT-5.3-Codex representa un gran avance en la programación agentic, ofreciendo a los desarrolladores una herramienta sin precedentes para el desarrollo y la ejecución rápidos. Su integración en GitHub Copilot y su accesibilidad a través de varias plataformas subrayan su impacto inmediato. Si bien persisten los desafíos en la gestión de su naturaleza "hiperactiva" y en garantizar la precisión contextual, la velocidad, la eficiencia y las capacidades interactivas del modelo anuncian una nueva era en la que los desarrolladores humanos y los agentes de IA colaboran sin problemas para construir el software del mañana.

Fuente: YouTube

Fuente: YouTube

¡Comparte nuestra publicación!
Fuentes