Chatea con GPT-5.3-Codex ahora.
GPT-5.3-Codex: Modelo Agente de Primera Categoría para Ingeniería de Software
GPT-5.3-Codex se lanzó en febrero de 2026 como sucesor de GPT-5.2 y GPT-5.2-Codex.
Como miembro de la familia Codex, es el último modelo de codificación agente de OpenAI que combina una capacidad de ingeniería de software de primera categoría con una sólida capacidad de razonamiento general y habilidades de trabajo de conocimiento profesional. GPT-5.3-Codex está diseñado como un agente de trabajo general que fusiona codificación, razonamiento y uso de computadoras en un solo modelo en lugar de separar un "modelo de codificación" y un "modelo de chat".
Capacidades Clave y Aspectos Destacados del Rendimiento de GPT-5.3-Codex
GPT-5.3-Codex destaca en el manejo de tareas complejas de razonamiento y codificación. Se distingue por las siguientes capacidades:
- Rendimiento de vanguardia en puntos de referencia de codificación e ingeniería de software como SWE-Bench Pro y sólidos resultados en Terminal-Bench y OSWorld, que prueban el uso de terminales y la interacción completa con la computadora.
- Maneja tareas del ciclo de vida del software de extremo a extremo: generar y refactorizar código, depurar, escribir pruebas, actualizar documentación e interactuar con herramientas como terminales, navegadores e interfaces gráficas de usuario.
- Fuerte en el "trabajo de conocimiento" general: redacción de documentos, presentaciones, hojas de cálculo, análisis y otras salidas profesionales medidas por el punto de referencia GDPval.
- Aproximadamente un 25 % más rápido que el modelo Codex anterior y utiliza menos tokens para muchas tareas, lo que hace que los flujos de trabajo largos y de varios pasos sean más eficientes.
Comparación de GPT-5.3-Codex y Otros Modelos Líderes
| Característica | GPT-5.3-Codex | GPT-5.2 (Pro/Pensamiento) | Claude Opus 4.6 | Gemini 3.1 Pro |
| Fortaleza Principal | Ejecución Agente | Lógica/Razonamiento Profundo | Refactorización a Gran Escala | Contexto Largo / Multimodal |
| Terminal-Bench 2.0 | 77.3% | 64.9% | 74.7% | 74.8% |
| SWE-Bench Pro | 57% | 54.2% | 64.6% | 77.1% |
| Ventana de Contexto | 400K tokens | 400K tokens | 1M tokens | 1M tokens |
| Velocidad de Salida | ~100 tokens/seg | ~85 tokens/seg | ~65 tokens/seg | ~120 tokens/seg |
| Mejor Para... | Ejecutar y Probar Código | Diseño de Estrategia y Lógica | Arquitectura Limpia y Elegante | Análisis de Datos de Vídeo/Audio |



