Esta fue la semana en que cambió la narrativa. Anthropic reportó $11.6 mil millones en ingresos del segundo trimestre — más del doble de los $6.7 mil millones de OpenAI — y superó a OpenAI por primera vez en adopción empresarial, valoración y tasa de crecimiento. OpenAI disolvió su tercer equipo de seguridad en dos años, vio partir a más de doce ejecutivos senior solo en 2026 y confirmó que su IPO se retrasa a 2027. Mientras tanto, la Assistants API muere en cinco días, GPT-5.4 abandona Codex el 31 de agosto y el retiro masivo del 23 de octubre de gpt-4, gpt-4o, o1 y o3-mini está a ocho semanas de distancia.
Pero la historia del producto es genuinamente sólida. Codex CLI lanzó cinco versiones en cinco semanas (v0.145 a v0.149), completando su transformación de chatbot de terminal a sistema operativo de agentes multi-sesión con plugins portátiles, hooks asíncronos, seguimiento de costos y un panel interactivo. GPT-5.6 Luna bajó a $0.20/$1.20 por millón de tokens — un recorte del 80% que lo hace competitivo con los modelos de código abierto. Y el modo Ultrafast, impulsado por los motores wafer-scale de Cerebras, lleva a GPT-5.6 Sol a 750 tokens por segundo en vista previa limitada.
Aquí está nuestro desglose semanal del Codex CLI, la capa de modelos y API, el panorama empresarial y competitivo, y el cuadro de seguridad y gobernanza.
1. Codex CLI: de chatbot a sistema operativo de agentes
Cinco versiones estables en cinco semanas. La trayectoria es inconfundible — cada versión añade puntos de extensión explícitos que permiten que paquetes, proveedores, ejecutores y políticas de red evolucionen de forma independiente, mientras el host sigue siendo responsable de la confianza.
v0.147.0 (7 de agosto, estable) incluyó Agent Plugins portátiles en catálogos local, personal, de workspace y remoto, --approve-for-me para aprobaciones de bajo riesgo revisadas automáticamente (reemplazando a --full-auto), soporte del protocolo MCP 2026-07-28 con descubrimiento de herramientas paginado, carga incremental de transcripciones y seguridad reforzada — secretos redactados de los comandos mostrados, confianza explícita requerida para proyectos desconocidos y acceso de red de plugins denegado cuando fallan las actualizaciones de política.
v0.148.0 (18 de agosto) añadió /export a Markdown para compartir sesiones de forma auditable, codex exec fork para bifurcar sesiones, estimaciones de costo por hilo en /status y hooks asíncronos que pueden ejecutar comandos e invocar herramientas MCP en segundo plano — lo que habilita bucles como “Codex modifica el código → ejecución de pruebas en segundo plano → actualización del sistema de tareas MCP → notificación → el agente principal continúa”.
v0.149.0 (20 de agosto) introdujo un panel interactivo codex agents para buscar, iniciar, renombrar y detener tareas dentro de la TUI, además de codex queue para enviar mensajes a sesiones inactivas. Los comandos de directorio de trabajo (/cd, /pwd, /cwd) y un codex doctor ampliado que diagnostica fallos de protección de endpoints y de proxy completan la versión.
El patrón: Codex ya no es una ventana de chat que escribe código. Es un sistema de trabajo de desarrollo capaz de exportar, bifurcar, archivar, restaurar, auto-ejecutar, rastrear costos y gestionar múltiples sesiones de agente concurrentes.
2. Modelos y API: Ultrafast, Luna más barata y el muro de deprecaciones
El modo Ultrafast (13 de agosto) es el anuncio de API más significativo estratégicamente de este trimestre. GPT-5.6 Sol ejecutándose en Cerebras Wafer-Scale Engines entrega hasta 750 tokens por segundo — una aceleración de 14× sobre el rendimiento estándar — sin sacrificar calidad. Una generación de 10,000 tokens que tarda tres minutos en infraestructura estándar se completa en 13 segundos. Es una vista previa limitada, solo por invitación y solo API (todavía no está en ChatGPT ni en Codex), sin precios publicados. Pero la señal es clara: OpenAI se está diversificando para dejar de depender de la inferencia exclusiva de Nvidia, y los flujos de trabajo agénticos en tiempo real son el objetivo.
GPT-5.6 Luna a $0.20/$1.20 por millón de tokens (recorte del 80%) es un cambio de juego para las cargas de trabajo sensibles al costo. A ese precio, Luna compite con los modelos de código abierto en clasificación, procesamiento por lotes y tareas ligeras. Reevalúa cualquier cosa que hoy esté en gpt-4o-mini o gpt-4.1-nano.
El calendario de deprecaciones ahora es urgente:
- 26 de agosto — La Assistants API se apaga. Sin período de gracia, sin migración automatizada: 410 Gone después del retiro. Migra Assistants a Responses API + Agents SDK ahora.
- 31 de agosto — GPT-5.4 y GPT-5.4-mini abandonan Codex para las sesiones autenticadas con ChatGPT. Reemplázalos por GPT-5.6 Terra y Luna respectivamente. Las sesiones con clave API no se ven afectadas.
- 23 de octubre — gpt-4, gpt-4-turbo, gpt-4o, o1, o3-mini, o4-mini y gpt-4.1-nano se retiran todos de la API. Audita cada integración de cliente construida entre 2023 y 2024.
- 11 de diciembre — gpt-5, gpt-5-mini, gpt-5-nano, gpt-5-pro, o3 y o3-pro se retiran.
OpenAI se compromete a seis meses de aviso para los modelos GA, tres meses para las variantes especializadas y dos semanas para los modelos en vista previa. Planifica en consecuencia.
3. Empresa y competencia: Anthropic toma la delantera
Anthropic superó a OpenAI en todas las métricas relevantes este trimestre. Los ingresos del segundo trimestre, de $11.6 mil millones, más que duplicaron los $6.7 mil millones de OpenAI. La tasa anualizada (run rate) alcanzó los $65 mil millones+ frente a los $40 mil millones de OpenAI. La adopción empresarial llegó al 34.4% frente al 32.3%. La valoración la superó: $965 mil millones frente a $852 mil millones. Y Anthropic reportó una pequeña ganancia ajustada frente a la pérdida operativa trimestral de $12.3 mil millones de OpenAI. Se espera que la IPO de Anthropic llegue tan pronto como octubre de 2026, con una valoración objetivo de $2 billones, por delante del calendario de 2027 de OpenAI.
El cruce empresarial de OpenAI es el punto brillante. Los ingresos empresariales superaron por primera vez a los de consumo, con un crecimiento del 32% mes a mes en julio. La alianza con IBM — que integra GPT-5.6, Codex y ChatGPT Work en IBM Consulting Advantage con miles de consultores certificados — es el acuerdo de canal de consultoría más profundo hasta la fecha. Synchrony se sumó para el comercio agéntico. Azure OpenAI ahora ofrece Claude, Gemini y Llama junto a los modelos de OpenAI: una oportunidad de consolidación para entornos multi-vendedor.
La rotación de liderazgo es un problema de divulgación para la IPO. Más de doce ejecutivos senior se marcharon en 2026: la ejecutiva número dos (Fidji Simo), el COO (Brad Lightcap), la CRO (Denise Dresser, tras ocho meses), el CMO, el CPO, el responsable de Sistemas de Seguridad, el responsable de Ética y el Futurista Jefe. Tres equipos de seguridad dedicados han sido disueltos en dos años. La valoración privada de $852 mil millones quedó plana en agosto: la primera oferta de acciones (tender) sin subida. El objetivo de IPO de $1 billón es ahora una historia de 2027 según la CFO Sarah Friar, aunque Altman presiona para el Q4 2026.
4. Seguridad y gobernanza: Astra en pausa, equipos de seguridad disueltos
OpenAI pausó el entrenamiento de aprendizaje por refuerzo de Astra — su próximo modelo frontera — después de que las evaluaciones preliminares sugirieran que podría cruzar el umbral de capacidad de ciberseguridad “Critical” establecido en el Preparedness Framework. “Critical” significa que un modelo puede identificar y desarrollar de forma autónoma exploits de día cero funcionales contra sistemas reales endurecidos. Es la primera vez que un modelo de OpenAI alcanza ese umbral. La mayor ejecución de RL frontera planificada sigue en pausa, sin fecha de reinicio confirmada.
La respuesta incluye sandboxes aislados, protecciones más sólidas de los pesos, un pipeline de monitoreo de múltiples etapas orientado a ventanas de alerta de 30 minutos y ~20% del cómputo de inferencia ahora dedicado al monitoreo. Pero el equipo Preparedness fue disuelto como unidad independiente en julio: el tercer equipo de seguridad desmantelado en dos años, después de Superalignment (2024) y Mission Alignment (febrero de 2026). El responsable de Sistemas de Seguridad y el responsable de Ética se marcharon ambos en julio, sin sucesor nombrado para el segundo.
GPT-5.6-Cyber se lanzó el 10 de agosto: un modelo de ciberseguridad entrenado específicamente que completa el 95% de las tareas ofensivas avanzadas, frente al 1.5% de Sol estándar. Encontró dos vulnerabilidades de día cero reales en Chrome V8 antes del lanzamiento. El programa Daybreak se dividió en Blue (defensivo, Sol con salvaguardas relajadas) y Red (ofensivo, GPT-5.6-Cyber para investigación autorizada). Las claves de hardware FIDO2 se vuelven obligatorias para todas las cuentas individuales de Daybreak el 1 de septiembre.
La aplicación de la Ley de IA de la UE ya está vigente. El contenido generado por IA debe estar etiquetado. Multa máxima: 7% de los ingresos globales. Cualquier cliente que opere en mercados de la UE necesita una revisión de cumplimiento.
Reflexiones finales
Tres acciones para los líderes de ingeniería esta semana.
Primero, migra fuera de la Assistants API antes del 26 de agosto. Cinco días. Sin período de gracia y sin herramienta automatizada. Haz inventario de los asistentes, respalda las configuraciones, migra a Responses API + Agents SDK y verifica con una ejecución en paralelo. Si algún código de producción referencia gpt-5.2-chat-latest o gpt-5.3-chat-latest, ya está roto.
Segundo, audita todo lo construido sobre gpt-4, gpt-4o, o1 u o3-mini. El 23 de octubre está a ocho semanas. La familia GPT-5.6 es estable, la escalera de precios de la API es clara ($0.20 a $5.00 de entrada por millón de tokens) y la Responses API es el estándar de facto. Empieza el plan de migración ahora: no esperes a la fecha límite.
Tercero, evalúa Codex CLI v0.149 como plataforma de desarrollo, no solo como herramienta. Agent Plugins 1.0, los hooks asíncronos, la bifurcación de sesiones, el seguimiento de costos y el panel interactivo de agentes lo convierten en una base viable para flujos de automatización internos. La bandera --approve-for-me y los diagnósticos de codex doctor abordan las brechas de aprobación y de red empresarial que antes bloqueaban la adopción. Si estás en AWS, el proveedor Bedrock ahora es de primera clase con enrutamiento de GPT-5.6.
La plataforma está madurando rápidamente. El panorama competitivo ha cambiado. Y el reloj de las deprecaciones no espera a nadie.
Sigue la conversación en X.