Esta fue la semana en que OpenAI dejó de ser una empresa que solo vende acceso a modelos y empezó a ser una empresa que vende resultados empresariales a escala de consultoría. GPT-5.1-Codex-Max se convirtió en el modelo predeterminado en todas las superficies de Codex — el primer modelo entrenado de forma nativa para compactar su propio contexto a través de múltiples ventanas en tareas de varias horas. IBM lanzó una práctica dedicada de OpenAI con miles de consultores certificados, y los ingresos empresariales de OpenAI superaron oficialmente a los de consumo. Mientras tanto, la historia de ciberseguridad se intensificó: GPT-5.6-Cyber se envió a investigadores aprobados a través del programa ampliado Daybreak, y el modelo no publicado Astra se convirtió en el primer modelo de OpenAI en acercarse al umbral «Crítico» de su Marco de Preparación (Preparedness Framework).

Y el reloj de las descontinuaciones sigue avanzando. gpt-5.2-chat-latest y gpt-5.3-chat-latest fueron eliminados de la API el 10 de agosto. La API de Assistants se apaga el 26 de agosto — dentro de doce días. o3 deja ChatGPT el mismo día, y DALL·E GPT le sigue el 30 de agosto.

Este es nuestro desglose semanal: el CLI de Codex, la capa de modelos, el impulso empresarial y el panorama de seguridad.

1. GPT-5.1-Codex-Max — el nuevo predeterminado, diseñado para trabajo de horizonte largo

El 11 de agosto, OpenAI anunció que GPT-5.1-Codex-Max había reemplazado a GPT-5.1-Codex como modelo predeterminado en las superficies de Codex: CLI, extensión de IDE, nube y revisión de código.

La innovación arquitectónica central es la compactación. GPT-5.1-Codex-Max es el primer modelo entrenado de forma nativa para operar a través de múltiples ventanas de contexto. Cuando se acerca al límite de contexto, poda automáticamente el historial menos importante mientras conserva las decisiones clave, los archivos modificados, los errores, los comandos, los resultados de las pruebas y la dirección de la implementación — y luego continúa en una ventana nueva. Esto se repite hasta completar la tarea, lo que permite refactorizaciones a escala de proyecto, sesiones profundas de depuración y trabajo coherente a lo largo de millones de tokens en una sola tarea.

EspecificaciónValor
ID del modelogpt-5.1-codex-max
Ventana de contexto400.000 tokens
Salida máxima128.000 tokens
Entradas / SalidasTexto + imagen / texto
APISolo Responses API
Precio$1,25/M de entrada, $0,125/M en caché, $10,00/M de salida

Las mejoras en los benchmarks son significativas:

BenchmarkGPT-5.1-Codex (high)GPT-5.1-Codex-Max (xhigh)
SWE-bench Verified (n=500)73,7 %77,9 %
SWE-Lancer IC SWE66,3 %79,9 %
Terminal-Bench 2.052,8 %58,1 %

Un nuevo nivel de razonamiento Extra Alto (xhigh) está dirigido a tareas que no son sensibles a la latencia, y con esfuerzo medio el modelo Max supera al predeterminado anterior usando un 30 % menos de tokens de razonamiento. GPT-5.1-Codex-Max es también el primer modelo de OpenAI entrenado de forma nativa para operar en entornos Windows — directamente relevante para cualquier empresa con una base de desarrolladores de sistemas operativos mixtos.

Una advertencia importante: este modelo se recomienda solo para codificación agéntica en Codex o en entornos similares a Codex, no para chat de propósito general. Fue entrenado con trabajo real de ingeniería de software — creación de PR, revisión de código, desarrollo frontend, preguntas y respuestas — y está diseñado específicamente para colaborar dentro del CLI de Codex.

2. Codex CLI v0.148.0-alpha.5 — exportar, bifurcar, archivar

El CLI continúa su ritmo vertiginoso: ~2,2 días entre versiones, 14 versiones en el último mes, 73 registradas en 2026. El 8 de agosto, la v0.148.0-alpha.5 llegó con tres adiciones al flujo de trabajo:

  • /export — escribe la conversación completa como Markdown estructurado en el portapapeles o en un archivo. Compartir sesiones de forma auditable sin pegar transcripciones crudas.
  • codex exec fork <SESSION_ID> [PROMPT] — crea un nuevo hilo a partir de una sesión existente, lo que permite ramificar una sesión larga de depuración en exploraciones paralelas.
  • Archivado de sesiones — las sesiones de larga duración pueden archivarse en lugar de eliminarse, manteniendo el historial navegable sin saturar la lista de activas.

Estas se suman a la versión estable v0.147.0 del 7 de agosto (Agent Plugins portátiles, --approve-for-me, soporte de MCP 2026-07-28, redacción de secretos) y a la v0.146.0 del 29 de julio (Agent Plugins 1.0, sesiones con nombre, bifurcación de hilos, modo Code remoto sobre WebSocket). El patrón es claro: Codex se está afinando para el trabajo agéntico de largo horizonte y de múltiples sesiones — compactación en el lado del modelo, gestión de sesiones en el lado del cliente.

También es destacable en el ámbito de la plataforma: el 11 de agosto, OpenAI lanzó una vista previa pública de la aplicación de escritorio de ChatGPT para Linux (Ubuntu 24.04/26.04 LTS, Debian 13, Fedora 43/44; x64 y ARM64; .deb/.rpm nativos). Incluye ChatGPT, ChatGPT Work y Codex en una sola aplicación nativa — cerrando la última gran brecha de sistema operativo aproximadamente un mes después de la aplicación de escritorio de Claude para Linux de Anthropic. La función de importación incorpora proyectos, chats, skills y plugins de otras herramientas de IA.

3. GPT-5.6-Cyber, Daybreak Blue/Red y el umbral de Astra

GPT-5.6-Cyber (10 de agosto). OpenAI presentó un modelo especializado en ciberseguridad construido sobre GPT-5.6 Sol para la investigación autorizada de vulnerabilidades, la validación de exploits y las pruebas de seguridad:

  • Tasa de finalización del 95,0 % en tareas cibernéticas avanzadas — frente al 1,5 % del Sol estándar y al 57,3 % del GPT-5.5-Cyber anterior
  • Ya ha encontrado vulnerabilidades de día cero reales, incluida la CVE-2026-15903 (lectura/escritura fuera de límites en Chrome V8, parcheada en Chrome 150.0.7871.128) y una cadena de escalada de privilegios en un sistema operativo móvil
  • Clasificado como «Alto» según el Marco de Preparación (Preparedness Framework) de OpenAI — por debajo de «Crítico»
  • No está en la API pública — acceso restringido y solo por solicitud a través del programa Daybreak Red

Daybreak se amplió a dos niveles. Daybreak Blue ofrece a los equipos defensivos GPT-5.6 Sol con salvaguardas adaptadas para el descubrimiento de vulnerabilidades, la revisión segura de código, el análisis de malware, la respuesta a incidentes y la validación de parches. Daybreak Red otorga a los investigadores aprobados GPT-5.6-Cyber para la validación de exploits y el red teaming. Los socios de confianza incluyen Accenture, Akamai, Cisco, Cloudflare, CrowdStrike, Fortinet, IBM, Palo Alto Networks, PwC y Sophos — varios de los cuales están incorporando ahora los modelos cibernéticos de OpenAI en sus productos de seguridad. La gobernanza es estricta: verificación de identidad, monitoreo, restricciones de uso aprobado, declaraciones legales — y las claves de seguridad de hardware se vuelven obligatorias para todas las cuentas individuales de Daybreak el 1 de septiembre.

Astra se acerca a la línea «Crítica». En una divulgación publicada entre el 7 y el 10 de agosto, OpenAI dijo que «no puede descartar» que su modelo no publicado Astra haya alcanzado el nivel Crítico de su Marco de Preparación — un hito sin precedentes para cualquier modelo de OpenAI. Crítico significa que un modelo puede identificar y desarrollar de forma autónoma exploits de día cero funcionales en sistemas reales endurecidos, o idear y ejecutar estrategias de ataque cibernético novedosas de extremo a extremo a partir únicamente de un objetivo de alto nivel. La respuesta de OpenAI: pausó las actividades internas de Astra que no cumplen con los requisitos de seguridad reforzados, aisló los entornos de prueba, mejoró la protección y el cifrado de los pesos, implementó monitoreo universal de la cadena de razonamiento (chain-of-thought) en aplicaciones agénticas, un sistema de respuesta automatizado que puede interrumpir actividad de alto riesgo a mitad de ejecución, pruebas externas con agencias gubernamentales y el Instituto de Seguridad de la IA del Reino Unido — y la primera revisión de ciberseguridad previa al lanzamiento de cualquier modelo por parte del gobierno de EE. UU., de acuerdo con la orden ejecutiva de junio de 2026. No hay fecha de lanzamiento; el lenguaje sugiere un retraso de meses, no de semanas.

4. IBM, el cruce empresarial y la cuenta regresiva hacia la salida a bolsa

Alianza estratégica con IBM (13 de agosto). IBM está integrando los modelos de frontera de OpenAI (GPT-5.6), Codex y ChatGPT Work en IBM Consulting Advantage, y está estableciendo una práctica dedicada de OpenAI con miles de consultores certificados a través de la Red de Socios de OpenAI. IBM se une al nivel de socios Elite de OpenAI, con tres pilares: transformar los procesos de negocio heredados en flujos de trabajo listos para IA, desarrollar soluciones de IA específicas por industria y ampliar la colaboración en ciberseguridad mediante Daybreak e IBM Autonomous Security. Este es el acuerdo de canal de consultoría más profundo hasta la fecha: inserta a OpenAI directamente en la plataforma de prestación de servicios de IBM en lugar de un acuerdo de referidos. Se apoya en Frontier Alliances (Accenture, BCG, Capgemini, McKinsey, Infosys, TCS) y en el Programa de Socios Cibernéticos Daybreak de IBM y OpenAI de junio.

Los ingresos empresariales superaron a los de consumo. La directora financiera, Sarah Friar, dijo a los accionistas el 14 de agosto que los ingresos empresariales ya superan a los ingresos de consumo de ChatGPT — un cruce que antes se había pronosticado para finales de 2026 y que se alcanzó con meses de anticipación. La tasa de ingresos anualizada ha subido a ~40.000 millones de dólares (julio de 2026), un 20 % más mes a mes, con un aumento del 32 % en clientes de negocio. Para contexto: 13.100 millones de dólares de ingresos oficiales en 2025, y aproximadamente 2.000 millones o más al mes en marzo de 2026. Otros movimientos de negocio esta semana: una oferta pública de adquisición (OPA) de 7.000 millones de dólares completada con una valoración de 852.000 millones (10 de agosto), la adquisición de NextSlide para tecnología de presentaciones (10 de agosto), el nivel Premium de asientos de ChatGPT Business (11 de agosto) y una alianza con Yelp que permite a los usuarios de ChatGPT hacer reservas (14 de agosto).

La S-1 pública es inminente. Se espera para mediados o finales de agosto — al 13 de agosto aún no estaba en el SEC EDGAR. Bancos colocadores: Goldman Sachs, Morgan Stanley, JPMorgan. Salida a bolsa prevista para septiembre de 2026 con una valoración de 852.000 millones a 1 billón de dólares, aunque los informes aún contemplan un deslizamiento a 2027. La S-1 revelará los estados financieros auditados, el desglose de ingresos entre consumo/empresa/API, los términos precisos del reparto de ingresos con Microsoft (Microsoft posee ~26,79 % en términos totalmente diluidos), los factores de riesgo, incluidos la pausa de Astra y la demanda de Apple, y el rango de la oferta. También aterrizará en medio de la mayor temporada de IPO potencial en la historia de la tecnología — la S-1 confidencial de Anthropic se presentó el 1 de junio con un objetivo para octubre a una valoración de 2 billones de dólares, y xAI ya salió a bolsa tras la fusión con SpaceX a una valoración de 1,25 billones de dólares.

5. La carrera de obstáculos de las descontinuaciones de agosto

La pila de plazos ahora es densa, y varios elementos ya han causado problemas:

  • gpt-5.2-chat-latest y gpt-5.3-chat-latest fueron eliminados de la API el 10 de agosto (anunciado el 8 de mayo). Las solicitudes fijadas a instantáneas retiradas fallan — OpenAI no enruta automáticamente. Reemplazo recomendado: gpt-5.6-sol ($5/$30 por 1M de tokens, contexto de 1.050.000 tokens).
  • La API de Assistants se apaga el 26 de agosto — dentro de 12 días — tanto en OpenAI como en Azure. Sin migración automatizada, sin período de gracia, 410 Gone tras la jubilación, y el historial de conversaciones no migra. Reemplazo: Responses API + Conversations API (OpenAI) o Foundry Agent Service (Microsoft).
  • o3 deja ChatGPT el 26 de agosto (las instantáneas de o3 en la API sobreviven hasta el 11 de diciembre).
  • DALL·E GPT se retira el 30 de agosto — los usuarios deberían descargar ahora las imágenes guardadas. Reemplazo: GPT Image 2.
  • Los modelos heredados (gpt-3.5-turbo, gpt-4) se retiran de la API el 23 de octubre.
  • GPT-5.4 y GPT-5.4 mini salen de Codex para las sesiones autenticadas con ChatGPT el 31 de agosto — siguen disponibles mediante clave de API. Revisen los valores predeterminados del espacio de trabajo y las configuraciones gestionadas.

Nota de precios para la planificación: GPT-5.6 Luna a $0,20/$1,20 por 1M de tokens (reducción del 80 %, efectiva desde el 30 de julio) sigue siendo una de las opciones de nivel frontera más económicas — viable para trabajo por lotes de alto volumen, clasificación y tareas ligeras. El precio introductorio de Claude Sonnet 5 expira el 31 de agosto, pasando a $3,00/$15,00.

Reflexiones finales

Tres cosas en las que los líderes de ingeniería deberían actuar esta semana.

Primero, evalúen GPT-5.1-Codex-Max para la automatización de largo horizonte. La arquitectura de compactación cambia lo que una sola ejecución de agente puede hacer — las refactorizaciones a escala de proyecto y los bucles de varias horas ahora son prácticos, y el contexto de 400K con salida de 128K cubre monorepos grandes. Si estandarizaron en el predeterminado anterior de Codex, vuelvan a comparar sus cargas de trabajo con Max en xhigh; el salto en SWE-Lancer (66,3 % → 79,9 %) es el tipo de cifra que paga una migración.

Segundo, traten el cierre de la API de Assistants del 26 de agosto como un plazo inamovible. Doce días. Inventaricen los asistentes, respalden las configuraciones, migren a Responses API + Conversations API o a Foundry Agent Service, y verifiquen con una prueba antes del corte. Si algún código de producción todavía hace referencia a gpt-5.2-chat-latest o gpt-5.3-chat-latest, ya está roto — arréglenlo primero.

Tercero, presten atención a la divulgación de Astra como señal de gobernanza. Un modelo que se acerca al umbral cibernético «Crítico» cambia la conversación regulatoria — el proceso de revisión previa al lanzamiento del gobierno de EE. UU. es ahora un hecho cotidiano para los laboratorios de frontera. Para las empresas, la implicación práctica no cambia, pero es más aguda: los despliegues de agentes necesitan el patrón de defensa en capas — separación entre andamiaje (harness) y cómputo, salvaguardas en la ruta crítica, compuertas de aprobación para acciones irreversibles y credenciales mantenidas fuera de los entornos de ejecución generados por modelos.

Los próximos 90 días estarán definidos por la S-1 pública, la ventana de salida a bolsa de septiembre, la puesta en marcha de la práctica de OpenAI en IBM y si el proceso de revisión de Astra sienta un precedente nuevo para los lanzamientos de modelos de frontera. La plataforma está madurando; lo que está en juego aumenta.

Sigue la conversación en X.