El panorama de las plataformas de IA se desplazó en múltiples frentes esta semana. Bloomberg confirmó lo que Microsoft ha estado señalando desde Build 2026: la compañía ahora está enrutando decenas de miles de prompts de IA de Excel y Outlook desde modelos de OpenAI y Anthropic a sus propios modelos MAI de primera parte. Anthropic lanzó Claude Sonnet 5 como el nuevo predeterminado para los planes Free y Pro. VS Code 1.128 introdujo sesiones de agente multi-chat. Intune implementó detección de IA fantasma dirigida a agentes de IA locales. Y las nuevas regulaciones chinas de IA antropomórfica obligaron a ByteDance y Alibaba a cerrar por completo las funciones de agentes personalizados.

Para los líderes de TI, el tema de esta semana es la divergencia de plataformas — las principales plataformas de IA ahora están divergiendo claramente en estrategia de modelos, filosofía de gobernanza y postura regulatoria. Comprender estas divergencias es esencial para tomar decisiones de arquitectura que no tengan que deshacerse en seis meses.

1. Los Modelos MAI de Microsoft Entran en Producción — La Era Post-OpenAI Ya Está Aquí

Bloomberg informó el 7 de julio que Microsoft ha comenzado a reemplazar modelos de OpenAI y Anthropic en aplicaciones de Office con su propia familia de modelos MAI de primera parte. Esto no es una hoja de ruta futura — está sucediendo ahora, y representa el cambio más significativo en la estrategia de IA de Microsoft desde la asociación original con OpenAI.

La familia MAI, presentada en Build 2026, incluye siete modelos desarrollados enteramente por el Equipo de Superinteligencia de IA de Mustafa Suleyman utilizando el pipeline interno de entrenamiento “Hill-Climbing Machine”. Cada modelo fue entrenado desde cero con datos con licencia comercial, sin destilación de OpenAI ni de ningún tercero. Los modelos destacados para escenarios empresariales:

  • MAI-Thinking-1: Un modelo sparse Mixture-of-Experts con ~35B parámetros activos de ~1T totales, ventana de contexto de 256K y puntuaciones de referencia que igualan a Claude Opus 4.6 en SWE-Bench Pro (~53%). Microsoft afirma aproximadamente 10× de eficiencia de tokens frente a GPT-5.5.
  • MAI-Code-1-Flash: Un modelo de codificación de 5B parámetros activos (137B totales mediante sparse MoE) que supera a Claude Haiku 4.5 en SWE-Bench Pro (51.2% vs 35.2%) con hasta un 60% menos de tokens. Disponible de forma general en GitHub Copilot desde el 26 de junio y posicionado como más económico que Claude Haiku.
  • MAI-Transcribe-1.5: 43 idiomas, 4.86% WER en el benchmark FLEURS (el más bajo de cualquier competidor), 5× más rápido que los modelos competidores. Se está integrando en Copilot, Teams y Dynamics 365 Contact Centre.

Project Polaris (el nombre en clave de lo que ahora es MAI-Code-1-Flash) está en camino de reemplazar a GPT-4 Turbo como modelo predeterminado para todos los suscriptores de GitHub Copilot en agosto de 2026, ejecutándose en los aceleradores de IA Maia 200 personalizados de Microsoft (3nm, 140B transistores, 216GB HBM3e). Una ventana de retroceso de tres meses a GPT-4 Turbo estará vigente hasta noviembre de 2026.

Lo que esto significa para los líderes de TI: Microsoft está construyendo independencia total de IA en toda la pila — silicio, modelos y aplicaciones. Si bien Copilot sigue siendo multi-modelo por diseño (enrutando entre MAI, OpenAI, Anthropic y Google), la economía favorece cada vez más a los modelos propios de Microsoft. Las organizaciones que se estandarizan en Copilot deben esperar que el enrutamiento predeterminado del modelo se desplace hacia los modelos MAI en los próximos trimestres, con mejoras en costo y latencia como resultado. La pregunta abierta es si los modelos MAI igualarán la calidad de las mejores opciones de terceros en tareas de razonamiento complejas — los benchmarks iniciales sugieren que son competitivos pero no definitivamente superiores.

2. Claude Sonnet 5 y Fable 5: El Agresivo Verano de Anthropic

Anthropic tuvo una semana explosiva en lanzamientos de modelos, expansión de plataforma y funciones empresariales.

Claude Sonnet 5 (30 de junio) es ahora el modelo predeterminado para los planes Free y Pro, posicionado como el Sonnet más agéntico hasta la fecha. El rendimiento se acerca a Opus 4.8 en benchmarks de búsqueda agéntica y uso de computación a un costo significativamente menor. Las mejoras clave sobre Sonnet 4.6 incluyen razonamiento más fuerte, menores tasas de alucinación y sicofancia, mejor resistencia a inyección de prompts, una ventana de contexto nativa de 1M de tokens y pensamiento adaptativo siempre activo. Los precios introductorios son $2/M de entrada y $10/M de salida hasta el 31 de agosto, luego cambian a $3/$15.

Claude Fable 5 regresó globalmente el 1 de julio después de una suspensión de 19 días por controles de exportación. El Departamento de Comercio de EE. UU. impuso controles el 12 de junio después de que investigadores de Amazon reportaran una técnica de jailbreak. La resolución incluye un nuevo clasificador de seguridad que bloquea el jailbreak reportado en más del 99% de los casos y un marco consensuado de severidad de jailbreak desarrollado con Amazon, Microsoft y Google. Fable 5 obtiene 80.3% en SWE-Bench Pro — muy por encima de Opus 4.8 (69.2%) y GPT-5.5 (58.6%). El precio es de $10/M de entrada, $50/M de salida.

En el ámbito empresarial, Anthropic lanzó controles significativos de administración y costos: alertas de gasto al 75% y 90% de los límites a nivel de organización, derechos a nivel de modelo para restringir qué modelos pueden acceder los usuarios, una API de análisis más rica que se integra con Datadog y CloudZero, y una API de administración para la gestión programática de límites de gasto. Los análisis de uso individual se activan de forma predeterminada a partir del 11 de julio — los administradores que quieran mantenerlo desactivado deben actuar antes de esa fecha.

Claude Cowork se expandió a web y móvil el 7 de julio, con sesiones remotas que continúan ejecutándose cuando el portátil del usuario está cerrado, herramientas de escritura para Microsoft 365 (correo electrónico, calendario, OneDrive, SharePoint) y aprobaciones móviles. Claude for Government entró en beta pública con autorización FedRAMP High, presentando facturación de incremento fijo con límites máximos estrictos vinculados a fondos apropiados.

Lo que esto significa para los líderes de TI: Sonnet 5 como predeterminado eleva significativamente el piso de calidad para todos los usuarios de Claude. Los controles de costos empresariales ahora son lo suficientemente maduros para un despliegue serio — alertas de gasto, derechos de modelo y gobernanza impulsada por API llevan a Claude Enterprise al nivel de gobernanza que Microsoft ofrece a través de Agent 365. El episodio de control de exportaciones de Fable 5 es un recordatorio de que los modelos frontera conllevan un riesgo regulatorio que puede sacarlos de línea sin previo aviso — un fuerte argumento para arquitecturas multi-modelo.

3. VS Code 1.128: Agentes Multi-Chat y Copilot Vision GA

VS Code 1.128 (8 de julio) trajo la actualización más significativa de la experiencia de agente en meses.

Las sesiones de agente multi-chat permiten ejecutar varios chats relacionados dentro de una sola sesión de agente Claude. Cada chat mantiene su propio historial, título y selección de modelo. Los desarrolladores pueden comparar enfoques, bifurcar desde turnos anteriores y ejecutar trabajo en paralelo — todo dentro de una sesión principal que se restaura tras recargas. Este es un paso significativo hacia la orquestación de agentes directamente en el IDE.

Copilot Vision alcanzó la disponibilidad general. Los usuarios ahora pueden adjuntar imágenes y PDFs al chat mediante pegado, arrastre o selección, y los agentes pueden leer imágenes mediante llamadas a herramientas. Esto trae capacidades multimodales a la experiencia central de chat de Copilot sin configuración.

Modelos BYOK en sesiones de agent host (experimental) permiten a las organizaciones usar modelos Bring Your Own Key al ejecutar sesiones en un agent host. Combinado con parámetros de muestreo configurables (temperatura, top_p) por modelo, esto da a las empresas control directo sobre la selección y el comportamiento del modelo dentro de la infraestructura de agente de VS Code.

Gestión de telemetría empresarial de Copilot mediante OpenTelemetry permite a las organizaciones determinar a dónde envía Copilot los datos de OTel a través de configuración gestionada, controlando endpoints OTLP, protocolo, nombre del servicio, atributos de recursos y configuración de captura de contenido. Los valores gestionados siempre anulan las variables de entorno y la configuración del usuario.

Lo que esto significa para los líderes de TI: VS Code se está convirtiendo en un entorno de orquestación de agentes de primera clase, no solo en un editor de código. La función multi-chat cambia fundamentalmente la forma en que los desarrolladores trabajan con IA — comparar salidas de modelos lado a lado dentro de una sola sesión es una mejora de flujo de trabajo de la que los equipos dependerán rápidamente. Los controles BYOK y de telemetría son esenciales para industrias reguladas. Las organizaciones deben actualizar sus políticas de gobernanza de Copilot para tener en cuenta estas nuevas capacidades.

4. Intune Apunta a la IA Fantasma — La Detección de Agentes Locales se Activa

El lanzamiento de servicio de junio de Microsoft Intune introdujo una vista previa pública que aborda directamente una de las mayores preocupaciones para los líderes de TI: detectar y bloquear la IA fantasma en dispositivos gestionados.

Las nuevas capacidades se dirigen específicamente a agentes de IA locales, incluido OpenClaw, utilizando el catálogo de propiedades de Intune, Device Query y una nueva línea base de seguridad de Agentes de IA Locales. Los administradores ahora pueden identificar dispositivos que ejecutan agentes de IA locales no aprobados y aplicar políticas de bloqueo mediante perfiles de configuración.

Este lanzamiento también incluyó el Agente de Corrección de Vulnerabilidades usando identidad agéntica de Microsoft Entra (vista previa pública), reemplazando la identidad de usuario humano con identidad basada en agente para flujos de trabajo automatizados de corrección de vulnerabilidades. Los agentes existentes con identidad humana deben hacer la transición dentro de 90 días.

Además, la actualización de Intune incluyó la aplicación de Aprobación Multi-Administrador en llamadas Graph API desde automatización — cerrando una brecha significativa donde los service principals, scripts de automatización y pipelines DevOps podían eludir los controles MAA. Los scripts sin los encabezados de aprobación requeridos ahora devuelven HTTP 403.

Lo que esto significa para los líderes de TI: La detección de IA fantasma ahora es una capacidad nativa de Intune en lugar de un complemento de terceros. Las organizaciones deben implementar las políticas de detección, inventariar el uso actual de agentes de IA locales y establecer políticas de gobernanza antes de una aplicación más amplia. La aplicación de MAA en la automatización es un cambio disruptivo para cualquier pipeline CI/CD o script que use Graph API — inventaria tu automatización y actualiza los runbooks inmediatamente.

5. Las Regulaciones Chinas de IA Antropomórfica Reconfiguran el Mercado Global

Las Medidas Provisionales de China para Servicios de Interacción Humano-Similar con IA entraron en vigor el 15 de julio de 2026, copublicadas por cinco autoridades gubernamentales centrales. Las regulaciones establecen un régimen de cumplimiento para servicios de IA con capacidades antropomórficas e interactivas emocionalmente, incluyendo el registro de algoritmos ante la CAC, evaluaciones de seguridad, divulgación obligatoria de contenido generado por IA y medidas contra la adicción.

El impacto fue inmediato: ByteDance cerró las funciones de agentes personalizados de Doubao el 15 de julio, y Alibaba con Qwen hizo lo mismo el 10 de julio. Ambas compañías optaron por cerrar las funciones en lugar de adaptarlas para el cumplimiento — una señal clara de que las regulaciones tienen dientes reales.

En el frente tecnológico, el GLM-5.2 de Zhipu AI logró un empate estadístico en calidad de codificación con Claude Opus 4.8 a aproximadamente una sexta parte del costo, convirtiéndose en el modelo de adopción más rápida en la plataforma de Vercel en 2026. Zhipu AI lanzó ZCode, un arnés de codificación diseñado para competir con Claude Code y OpenAI Codex. El Kimi K2.7 Code de Moonshot AI se lanzó en vista previa pública en Microsoft Foundry el 1 de julio, reduciendo el uso de tokens de razonamiento en aproximadamente un 30% frente a K2.6.

Los modelos chinos ahora representan más del 30% del consumo de tokens de OpenRouter (alcanzando un pico del 46%), frente al 4.5% en el H1 de 2025. Ocho de los diez principales modelos open-source grandes en Hugging Face son de China. Qwen superó a Llama de Meta como la familia de modelos open-source más descargada del mundo con más de mil millones de descargas acumuladas.

Lo que esto significa para los líderes de TI: La divergencia regulatoria entre China y Occidente ahora es estructural. Las organizaciones que operan en China necesitan auditar sus despliegues de agentes de IA contra las nuevas regulaciones de inmediato. La calidad y rentabilidad de los modelos open-source chinos significa que continuarán capturando la atención de los desarrolladores globales — pero los controles de exportación (tanto de EE. UU. como potencialmente de China) añaden una capa de riesgo que requiere planificación de contingencia. Para la mayoría de las empresas occidentales, el impacto práctico recae en la selección de modelos: los modelos chinos son cada vez más viables para cargas de trabajo sensibles al costo, pero los equipos de gobernanza y cumplimiento deben evaluar la exposición regulatoria.

6. Entra Agent ID: Gobernando Identidades de Agentes de IA

Microsoft anunció el 7 de julio que Entra Agent ID está disponible para gobernar identidades y accesos de agentes de IA a escala. Esto se basa en el marco de gobernanza Agent 365 y trata a los agentes de IA como identidades de primera clase en Entra ID — con asignación de identidad responsable, control de acceso y gestión automatizada del ciclo de vida del patrocinador.

Combinado con los anuncios del 1 de julio de extensiones personalizadas de PIM (integrando lógica de negocio en flujos de activación de roles privilegiados) y la integración Purview-Entra para protección de datos en movimiento (evitando que datos sensibles salgan a través de plataformas SaaS y de IA), Microsoft está construyendo una pila de gobernanza integral para la economía de los agentes.

Lo que esto significa para los líderes de TI: La gobernanza de identidad de agentes ya no es opcional. Cada agente de IA — ya sea Copilot Cowork, Claude Code o un agente personalizado — debe tener una identidad gestionada en Entra ID con permisos acotados y gestión del ciclo de vida. La integración de Purview para la protección de datos en movimiento es particularmente relevante para organizaciones preocupadas de que las plataformas de IA se conviertan en vectores de exfiltración de datos.

Próximos Pasos Estratégicos

  1. Auditar el enrutamiento de modelos — con Microsoft desplazando los prompts de Office a modelos MAI, inventaria qué modelos están usando realmente tus tenants de Copilot y compara la diferencia de calidad
  2. Implementar la detección de IA fantasma de Intune — la vista previa pública ya está disponible; identifica agentes de IA locales no aprobados antes de que la aplicación se convierta en un mandato de políticas
  3. Actualizar la automatización de Graph API para MAA — los scripts sin encabezados de aprobación fallarán; este es un cambio disruptivo que requiere atención inmediata
  4. Evaluar Claude Sonnet 5 para cargas de trabajo empresariales — el salto de calidad del modelo predeterminado es significativo, y los nuevos controles de gasto hacen que el despliegue empresarial sea gobernable
  5. Establecer la gobernanza de Entra Agent ID — registra todos los agentes de IA de producción como identidades gestionadas con permisos acotados y políticas de ciclo de vida
  6. Revisar las regulaciones chinas de IA — si operas en China, audita los despliegues de agentes contra las medidas provisionales del 15 de julio y prepara la documentación de cumplimiento

Las plataformas están divergiendo. Microsoft está construyendo independencia de pila completa. Anthropic está empujando la frontera agéntica. China está regulando el límite de la interacción humano-IA. El hilo común: la madurez de la gobernanza debe igualar la velocidad de despliegue. Las organizaciones que implementen agentes sin gestión de identidad, controles de costos y marcos de cumplimiento regulatorio se verán forzadas a costosas remediaciones. Aquellas que construyan gobernanza primero escalarán más rápido.