OpenAI lanzó GPT-5.4 hoy. Está disponible en ChatGPT, la API y Codex. Si estás ejecutando cargas de trabajo empresariales en modelos de OpenAI — o evaluando si deberías hacerlo — este es un lanzamiento significativo que merece tu atención.
Esto es lo que se lanzó, lo que significa para tu organización y lo que deberías hacer a continuación.
Qué se Lanzó Realmente
GPT-5.4 es el nuevo modelo insignia de OpenAI, unificando sus mejores capacidades en razonamiento, codificación, flujos de trabajo de agentes y uso de computadora en un solo modelo. También hay una variante GPT-5.4 Pro para máximo rendimiento en tareas complejas.
Las capacidades principales:
- Uso nativo de computadora: GPT-5.4 es el primer modelo de propósito general de OpenAI que puede operar computadoras directamente — navegando escritorios, haciendo clic en aplicaciones y ejecutando flujos de trabajo de múltiples pasos a través de sistemas de software. Obtiene un 75% en OSWorld-Verified, superando el rendimiento humano (72.4%).
- Ventana de contexto de 1M de tokens: Hasta un millón de tokens de contexto en la API, permitiendo a los agentes planificar, ejecutar y verificar tareas a lo largo de flujos de trabajo de larga duración.
- Búsqueda de herramientas: En lugar de incluir cada definición de herramienta en el prompt, GPT-5.4 puede buscar dinámicamente las herramientas cuando las necesita. Esto redujo el uso de tokens en un 47% en las pruebas mientras mantenía la precisión.
- Percepción visual mejorada: Nuevo nivel de detalle de imagen “original” que soporta imágenes de hasta 10.24M píxeles con fidelidad completa. Mejor análisis de documentos, mejor precisión de clics, mejor comprensión de imágenes.
- Significativamente más eficiente en tokens: Utiliza menos tokens de razonamiento que GPT-5.2 para resolver los mismos problemas, traduciéndose directamente en costos más bajos y respuestas más rápidas.
Qué Hay de Nuevo vs. GPT-5.2
Si tu organización se estandarizó en GPT-5.2 (lanzado a finales del año pasado), esto es lo que obtienes con la actualización:
La calidad del trabajo profesional mejoró drásticamente. En GDPval — que prueba el rendimiento de IA en 44 ocupaciones con productos de trabajo reales como presentaciones, hojas de cálculo y horarios — GPT-5.4 iguala o supera a los profesionales humanos el 83% del tiempo, frente al 70.9% de GPT-5.2. Eso no es una mejora incremental. Es una clase diferente de capacidad.
Las hojas de cálculo y presentaciones recibieron un enfoque específico. En tareas de modelado de hojas de cálculo de tipo banca de inversión, GPT-5.4 obtiene un 87.3% frente al 68.4% de GPT-5.2. Los evaluadores humanos prefirieron las presentaciones de GPT-5.4 el 68% de las veces sobre el resultado de GPT-5.2. Si tus equipos usan IA para generación de documentos, esto importa.
Las alucinaciones disminuyeron significativamente. Las afirmaciones individuales tienen un 33% menos de probabilidad de ser falsas, y las respuestas completas tienen un 18% menos de probabilidad de contener errores en comparación con GPT-5.2. Para casos de uso empresarial donde la precisión es innegociable — legal, financiero, cumplimiento normativo — esta es la métrica que más importa.
El uso de computadora pasó de experimental a listo para producción. GPT-5.2 obtuvo un 47.3% en tareas de navegación de escritorio OSWorld. GPT-5.4 obtiene un 75%. Eso no es un paso incremental — es la diferencia entre una demostración y una capacidad desplegable.
La búsqueda web con agentes mejoró significativamente. Las puntuaciones de BrowseComp subieron de 65.8% (GPT-5.2) a 82.7% (GPT-5.4). Los agentes ahora pueden buscar de manera más persistente a través de múltiples rondas para encontrar información difícil de localizar.
Precios Empresariales: Lo que Pagarás
La estructura de precios de OpenAI para la familia GPT-5 sigue siendo competitiva. Basado en las tarifas publicadas actuales:
| Modelo | Entrada (por 1M tokens) | Entrada en Caché | Salida (por 1M tokens) |
|---|---|---|---|
| GPT-5.2 | $1.75 | $0.175 | $14.00 |
| GPT-5.2 Pro | $21.00 | — | $168.00 |
| GPT-5 / 5.1 | $1.25 | $0.125 | $10.00 |
| GPT-5 Mini | $0.25 | $0.025 | $2.00 |
| GPT-5 Nano | $0.05 | $0.005 | $0.40 |
El precio de GPT-5.4 no se ha desglosado por separado todavía, pero se espera que se sitúe en o cerca de las tarifas de GPT-5.2. La historia clave de eficiencia aquí es que GPT-5.4 utiliza menos tokens de razonamiento para llegar a las mismas respuestas, por lo que tu costo efectivo por tarea debería disminuir incluso si las tarifas por token se mantienen estables.
Para suscripciones de ChatGPT: Plus sigue siendo $20/mes, Team es $25-30/usuario/mes, y Enterprise tiene precios personalizados con uso ilimitado de GPT-5, cumplimiento SOC 2, SSO, retención de datos cero y ventanas de contexto de hasta 128K tokens por sesión.
La Batch API continúa ofreciendo un 50% de ahorro para cargas de trabajo asíncronas, y la nueva opción de procesamiento prioritario te proporciona rendimiento de alta velocidad confiable sobre una base de pago por uso.
Disponibilidad en Azure OpenAI
Aquí es donde se vuelve importante para las empresas reguladas. Azure OpenAI ya lista GPT-5.2 y GPT-5.2 Codex en despliegues Global y Data Zone. Toda la familia GPT-5 (incluyendo GPT-5, 5.1, mini, nano y variantes Pro) está disponible en Azure con precios de token equivalentes a los directos de OpenAI.
Los despliegues Data Zone son el diferenciador clave para empresas con requisitos de residencia de datos. Azure te permite fijar tu despliegue de modelo a regiones geográficas específicas — algo que no puedes hacer con la API de OpenAI directamente.
Si ya estás en Azure OpenAI, espera que la disponibilidad de GPT-5.4 siga el mismo patrón que lanzamientos anteriores: despliegue Global primero, Data Zone poco después. Consulta las páginas de disponibilidad y depreciación de modelos de Azure OpenAI para fechas exactas.
Para organizaciones que aún no están en Azure OpenAI: los controles empresariales (RBAC, redes privadas, filtrado de contenido, monitoreo de abuso) siguen siendo la razón principal para pagar la prima de Azure en lugar de ir directamente a OpenAI.
El Elefante en la Habitación: Uso de Computadora
Hablemos de lo que más importa en este lanzamiento: el uso nativo de computadora.
GPT-5.4 puede operar entornos de escritorio, navegar navegadores, hacer clic en aplicaciones y ejecutar flujos de trabajo de múltiples pasos — todo a través de capturas de pantalla y comandos de teclado/ratón. También puede escribir código Playwright para automatizar interacciones con el navegador de forma programática.
Para TI empresarial, esto crea tanto una enorme oportunidad como un riesgo significativo:
La oportunidad: Automatizar flujos de trabajo complejos que abarcan múltiples aplicaciones — el tipo de tareas con las que las herramientas RPA han tenido dificultades porque son frágiles y se rompen cuando las interfaces de usuario cambian. Un modelo de IA que puede ver la pantalla y adaptarse es fundamentalmente diferente de la automatización con scripts.
El riesgo: Un agente de IA con la capacidad de hacer clic en tus aplicaciones tiene el mismo acceso que la cuenta de usuario bajo la que se ejecuta. Piensa cuidadosamente sobre:
- Qué credenciales y permisos tendrán estos agentes
- Cómo auditarás lo que hacen
- Qué políticas de confirmación aplicarás (OpenAI ahora soporta políticas de confirmación personalizadas en la API)
- Si tus herramientas DLP y de seguridad pueden ver y controlar las interacciones de computadora impulsadas por IA
OpenAI diseñó explícitamente el comportamiento de uso de computadora de GPT-5.4 para ser dirigible mediante mensajes del desarrollador, con políticas de seguridad configurables. Úsalas. No despliegues agentes de uso de computadora con permisos amplios y sin barreras de protección.
La Búsqueda de Herramientas Cambia la Conversación sobre MCP
Si tu organización ha estado construyendo o evaluando integraciones de servidores MCP (Model Context Protocol), la capacidad de búsqueda de herramientas de GPT-5.4 es directamente relevante.
Anteriormente, cada definición de herramienta tenía que incluirse en el contexto del modelo por adelantado. Con docenas de servidores MCP, eso podía significar decenas de miles de tokens por solicitud — costoso, lento y contaminante del contexto.
La búsqueda de herramientas permite al modelo descubrir y cargar dinámicamente definiciones de herramientas solo cuando es necesario. En las pruebas de OpenAI con 36 servidores MCP, esto redujo el uso total de tokens en un 47% sin pérdida de precisión.
Lo que esto significa para tu arquitectura: Ahora puedes exponer ecosistemas de herramientas mucho más grandes a tus agentes de IA sin preocuparte por la inflación de la ventana de contexto. El límite práctico sobre cuántas integraciones puede acceder un agente acaba de expandirse significativamente.
Qué Deberían Hacer los Equipos de TI Ahora
Esta es tu lista de acciones:
1. Evalúa GPT-5.4 Contra Tus Cargas de Trabajo Actuales
Si estás en GPT-5.2, ejecuta tus prompts y flujos de trabajo existentes contra GPT-5.4. Concéntrate en las mejoras de precisión y la eficiencia de tokens. Solo la reducción de alucinaciones puede justificar el cambio para casos de uso de alto riesgo.
2. Evalúa la Preparación para Uso de Computadora
Si tienes flujos de trabajo que implican navegar múltiples aplicaciones — ingreso de datos, generación de informes, conciliación entre sistemas — las capacidades de uso de computadora de GPT-5.4 podrían ser transformadoras. Pero comienza con una revisión de seguridad, no con un POC. Define tu modelo de permisos y requisitos de auditoría primero.
3. Revisa Tu Arquitectura de Integración de Herramientas
Si has sido conservador sobre cuántas herramientas expones a los agentes de IA debido a los costos de la ventana de contexto, la búsqueda de herramientas cambia ese cálculo. Reevalúa tu estrategia de servidores MCP teniendo en cuenta la reducción del 47% en tokens.
4. Actualiza Tu Plan de Ciclo de Vida de Modelos
OpenAI está lanzando nuevas versiones de modelos aproximadamente trimestralmente ahora. Si no tienes un proceso de evaluación y migración de modelos, construye uno. Fija versiones específicas de modelos en producción, prueba nuevas versiones en staging y planifica los ciclos de depreciación.
5. Revisa las Opciones de Despliegue de Azure OpenAI
Si estás usando la API de OpenAI directamente y tienes requisitos de residencia de datos, cumplimiento normativo o seguridad de red, este es un buen momento para evaluar Azure OpenAI. La brecha de disponibilidad de modelos se ha reducido significativamente, y los controles empresariales valen la pena por la sobrecarga operativa.
6. Presupuesta para el Cambio
GPT-5.4 es más eficiente por tarea, pero las capacidades que desbloquea — uso de computadora, ecosistemas masivos de herramientas, contexto de un millón de tokens — impulsarán más uso. Planifica tus presupuestos de tokens en consecuencia. La Batch API y los descuentos de entrada en caché son tus mejores aliados para la gestión de costos.
Conclusión
GPT-5.4 no es solo otro lanzamiento puntual. La combinación de uso nativo de computadora, búsqueda de herramientas, contexto de 1M de tokens y calidad de trabajo profesional dramáticamente mejorada convierte esto en un punto de inflexión de capacidad.
Los modelos ahora son lo suficientemente buenos para hacer trabajo profesional real a través de aplicaciones reales con precisión real. La pregunta para TI empresarial ya no es “¿puede la IA hacer esto?” — es “¿tenemos el gobierno, la seguridad y la arquitectura para permitirlo?”
Empieza por ahí. La tecnología está lista. Asegúrate de que tu organización también lo esté.