La semana pasada seguimos la llegada de Claude Opus 5 a Microsoft 365 Copilot y la transformación de MCP a un protocolo sin estado. Esta semana, la historia mira hacia dentro: Microsoft está sustituyendo GPT-4 Turbo de OpenAI como modelo predeterminado de GitHub Copilot por su propio MAI-Code-1-Flash, completando un cambio de modelo que Bloomberg confirmó por primera vez en producción el pasado julio. En el plano de la gestión, Intune ha publicado una directiva que permite a los administradores deshabilitar MCP (Model Context Protocol) para GitHub Copilot en Visual Studio — la primera vez que Microsoft ofrece a los administradores de TI un interruptor de seguridad directo para las integraciones de agentes de IA en las herramientas de desarrollo. Entra ID continúa su agresiva modernización de identidad con la sincronización de dispositivos de Cloud Sync, controles de anidamiento de grupos de seguridad y una exclusión temporal para la migración de SMS/voz de septiembre. Y VS Code 1.131 ofrece a los desarrolladores algo que llevaban tiempo pidiendo: visibilidad real de lo que hacen los subagentes.

Para los líderes de TI, esta es la semana en la que la estrategia de IA de primera parte de Microsoft deja de ser una hoja de ruta y empieza a ser su realidad de producción. El modelo que impulsa Copilot está cambiando. Los controles que gobiernan las herramientas de IA están llegando. Y la infraestructura de identidad que lo sustenta todo está recibiendo una mejora significativa.

1. MAI-Code-1-Flash se convierte en el modelo predeterminado de GitHub Copilot

El giro que Microsoft anunció en Build 2026 ya es una realidad. MAI-Code-1-Flash — el modelo de código propio de Microsoft construido sobre una arquitectura dispersa de Mezcla de Expertos con aproximadamente 5 mil millones de parámetros activos de un total de 137 mil millones — se convierte en el modelo predeterminado para todos los niveles de GitHub Copilot en agosto de 2026. Esto incluye los planes Free, Pro, Pro+ y Max en VS Code, Copilot CLI, Copilot Chat en GitHub, Visual Studio, JetBrains, Eclipse, Xcode y GitHub Mobile.

Los números lo cuentan todo. MAI-Code-1-Flash obtuvo un 51,2% en SWE-Bench Pro, una ventaja de 16 puntos sobre Claude Haiku 4.5, que obtuvo un 35,2%. Usa hasta un 60% menos de tokens que modelos comparables en SWE-Bench Verified. Con 0,75 $ por millón de tokens de entrada y 4,50 $ por millón de tokens de salida, es aproximadamente 3× más barato que GPT-4o a escala. Y se ejecuta en los propios aceleradores de IA Maia 200 de Microsoft — silicio personalizado de 3 nm con 140 mil millones de transistores y 216 GB de memoria HBM3e.

Hay una ventana de respaldo de GPT-4 Turbo de tres meses que se extiende hasta noviembre de 2026, lo que da a las organizaciones tiempo para validar las diferencias de comportamiento. Pero la dirección es clara: Microsoft está trasladando la inferencia de Copilot a sus propios modelos en su propio silicio. Esto no es una vista previa ni un piloto. El tráfico de producción ya se está desplazando.

El contexto más amplio es la familia MAI. Microsoft ya tiene siete modelos de primera parte entrenados desde cero con cero destilación de OpenAI o de cualquier tercero, utilizando el pipeline interno de entrenamiento “Hill-Climbing Machine”. MAI-Thinking-1 — el modelo de razonamiento insignia con 1 billón de parámetros totales y 35 mil millones activos — está en vista previa privada en Azure Foundry, con benchmarks auto-reportados que muestran un 97% en AIME 2025 y un 52,8% en SWE-Bench Pro, igualando a Claude Opus 4.6. Bloomberg confirmó en julio que decenas de miles de prompts de Excel y Outlook ya son gestionados por modelos MAI en lugar de APIs de terceros. La capa de orquestación de Copilot enruta las tareas comunes (redacción de correos, resúmenes, fórmulas de hojas de cálculo, generación de imágenes, transcripción) a los modelos MAI y reserva los modelos frontera como GPT-5.6 y Claude para el razonamiento complejo y la generación creativa.

Qué significa esto para los líderes de TI: El modelo que hay detrás de Copilot está cambiando tanto si lo configuras como si no. Microsoft está migrando activamente las cargas de trabajo a modelos de primera parte para mejorar la economía unitaria y reducir la dependencia externa. En el caso específico de GitHub Copilot, valida los flujos de trabajo de tus desarrolladores con MAI-Code-1-Flash antes de que expire el respaldo de GPT-4 Turbo en noviembre. Para Microsoft 365 Copilot, espera un enrutamiento creciente hacia los modelos MAI para las tareas rutinarias — supervisa la calidad y proporciona comentarios a través de los canales estándar. La era de “¿qué modelo está usando Copilot?” como una decisión de enrutamiento oculta está terminando; se está convirtiendo en una estrategia deliberada de optimización de costes de Microsoft.

2. Intune añade la directiva Disable MCP para GitHub Copilot en Visual Studio

Enterrada en el service release 2607 de Intune para la semana del 27 de julio está, posiblemente, el control de gobernanza de IA más importante que Microsoft ha publicado este año. Las plantillas administrativas de Visual Studio (actualizadas a la versión 1.0.184.40051) ahora incluyen una directiva DisableMCP que permite a los administradores bloquear de forma centralizada el Model Context Protocol para GitHub Copilot en Visual Studio.

MCP es el mecanismo que conecta los agentes de IA con herramientas externas, fuentes de datos y APIs. Es potente — y es arriesgado. Una integración MCP puede conectar Copilot directamente a APIs internas, sistemas de tickets, almacenes de secretos o bases de datos de producción. Una integración mal configurada podría exponer código fuente, detalles de arquitectura o credenciales a una herramienta de IA que opera fuera de tu proceso normal de revisión de seguridad.

La directiva DisableMCP da a los administradores un control binario: permitir la funcionalidad básica de Copilot (sugerencias de código basadas en el contexto del editor) mientras se bloquean las conexiones automatizadas a sistemas externos. Esto permite un modelo de adopción de IA por fases — Fase 1: Copilot con MCP deshabilitado en toda la organización; Fase 2: habilitar MCP de forma selectiva para equipos y herramientas verificados mediante un proceso de gobernanza.

Esto importa más allá de Visual Studio. A medida que la adopción de MCP supera los 10.000 servidores en el ecosistema y el protocolo se vuelve sin estado con la especificación 2026-07-28, la superficie de exposición de las integraciones de agentes de IA se está expandiendo rápidamente. Tener un interruptor de seguridad administrativo a nivel de Intune significa que TI puede hacer cumplir los límites de las herramientas de IA sin depender de la cooperación individual de cada desarrollador.

Qué significa esto para los líderes de TI: Si estás desplegando GitHub Copilot en Visual Studio en entornos regulados — salud, defensa, finanzas o cualquier base de código que maneje propiedad intelectual regulada — activa la directiva DisableMCP ahora. Es la forma más limpia de permitir la productividad de la IA para codificación mientras se controla el riesgo de exfiltración de datos. Para las organizaciones más avanzadas en la adopción de IA, úsala como línea de base y crea políticas de excepción para integraciones MCP verificadas. No se trata de bloquear la IA; se trata de controlar el radio de impacto cuando la IA se conecta a tus sistemas.

3. Entra ID: sincronización de dispositivos de Cloud Sync, controles de anidamiento de grupos y exclusión de SMS/voz

Tres actualizaciones de Entra ID llegaron esta semana que importan para los equipos de infraestructura de identidad.

Sincronización de dispositivos de Cloud Sync (vista previa pública). Entra Cloud Sync ahora admite la sincronización de objetos de equipo de Active Directory local en Entra ID mediante un job dedicado AD2AADDeviceSync. Esto elimina uno de los últimos grandes obstáculos para las organizaciones que migran de Entra Connect Sync a Cloud Sync. Anteriormente, si necesitabas dispositivos Windows con unión híbrida — y la mayoría de las organizaciones los necesitan — tenías que quedarte en Connect Sync. Ahora, con el agente de aprovisionamiento v1.1.1107 o posterior, puedes sincronizar dispositivos a través de Cloud Sync y habilitar la unión híbrida mediante GPO o Autopilot/Intune. Esto se alinea con la dirección estratégica de Microsoft hacia el Cloud Sync basado en agentes y con el calendario de retirada de 12 meses de las versiones antiguas de Connect Sync (la versión mínima debe mantenerse hasta el 30 de septiembre de 2026).

Controles de anidamiento de grupos de seguridad. Microsoft ha añadido una propiedad disableNesting para los grupos de seguridad de Entra ID a través de la API Graph v1.0. Cuando se establece en true en el momento de la creación del grupo, Entra bloquea la adición de otros grupos como miembros. El anidamiento se bloquea si el grupo destino o el grupo miembro potencial tiene disableNesting establecido en true. Esto todavía no está en la interfaz del centro de administración de Entra y Get-MgGroup no devuelve la propiedad por defecto — necesitas seleccionarla explícitamente con $select. Un nuevo permiso granular, Group-NestingSupport.ReadWrite.All, gobierna esta capacidad. Los casos de uso son claros: grupos de acceso privilegiado, acceso a aplicaciones sensibles, recursos regulados y grupos sujetos a revisiones de acceso donde la membresía anidada crea complejidad de auditoría.

API de exclusión temporal de SMS/voz. Con los métodos de autenticación por SMS y voz retirándose el 1 de febrero de 2027 y la habilitación automática de passkeys a partir del 1 de septiembre de 2026, Microsoft ha añadido una API Graph beta de exclusión voluntaria para los inquilinos que necesitan más tiempo. Establecer optOutSettings.passkeyDynamicMigration en true a través de la API beta excluye temporalmente al inquilino de la migración automática de passkeys y del comportamiento predeterminado de Registration Campaign. La ventana de exclusión va del 1 de septiembre de 2026 al 1 de febrero de 2027 — después de eso, SMS/voz desaparece sin excepciones. Microsoft publicó el script de PowerShell entra-sms-voice-usage-analyzer en GitHub para ayudar a inventariar a los usuarios que todavía dependen de SMS/voz. Los usuarios invitados B2B están incluidos, con soporte de passkeys para invitados previsto para finales de 2026.

Qué significa esto para los líderes de TI: La vista previa de sincronización de dispositivos de Cloud Sync es la luz verde para los planes de migración de Connect Sync que estaban estancados por el soporte de dispositivos. Pruébala ahora en una OU piloto y construye tu hoja de ruta de migración. Para los grupos de seguridad, adopta disableNesting para los nuevos grupos de acceso privilegiado — es una forma limpia de prevenir la complejidad de auditoría. Y si todavía tienes usuarios con autenticación por SMS/voz, la API de exclusión te compra cinco meses, no cinco años. Ejecuta el script de inventario esta semana y construye un plan de migración a passkeys antes de febrero.

4. VS Code 1.131: visibilidad de subagentes y dictado integrado

VS Code 1.131, publicado el 29 de julio, trae dos funciones que los desarrolladores llevan pidiendo desde que llegaron los subagentes.

Visibilidad de subagentes en la ventana Agents. Cuando un subagente está en ejecución, la conversación principal ahora muestra el modelo que se está usando, el tiempo transcurrido y la llamada de herramienta activa — todo sin abrir la conversación del subagente. Seleccionar un subagente en ejecución abre su conversación en un chat separado para su revisión. Esto es una ganancia de productividad significativa para los desarrolladores que trabajan con flujos multiagente en Copilot, Claude o Codex. Anteriormente, la actividad de los subagentes era una caja negra; enviabas una tarea y esperabas. Ahora puedes supervisar el progreso, identificar agentes atascados e intervenir cuando una llamada de herramienta se desvía.

Dictado integrado (experimental). VS Code ahora admite dictado sin conexión en las entradas de chat, los editores de texto y la terminal integrada. Impulsado por un modelo Nemotron en el dispositivo, el audio permanece local — sin dependencia de la nube. Un paso opcional de limpieza con LLM refina la transcripción con formato y eliminación de palabras de relleno. Disponible en Windows x64/Arm64, macOS con chip Apple y Linux x64/Arm64 (glibc 2.34+). No es una función de novedad; para los desarrolladores con necesidades de accesibilidad o para aquellos que simplemente piensan más rápido de lo que escriben, el dictado en el editor y en la terminal es una mejora genuina del flujo de trabajo.

El despliegue del agent host continúa. El agent host de VS Code — un proceso dedicado para sesiones de agentes basado en el Agent Host Protocol — continúa su despliegue. Las sesiones de agentes ahora se pueden conectar desde múltiples ventanas de VS Code, lo que significa que puedes iniciar una tarea en una ventana y supervisarla desde otra. Se habilita mediante chat.agentHost.enabled.

5. Anthropic presenta su solicitud de salida a bolsa y expande su canal empresarial

Anthropic presentó de forma confidencial un borrador de S-1 ante la SEC el 1 de junio de 2026, con el objetivo de cotizar en Nasdaq en octubre, en una salida a bolsa que se espera recaude 60.000 millones de dólares o más. Los bookrunners principales son Goldman Sachs y JPMorgan, con Morgan Stanley como co-líder. La valoración implícita de la OPV oscila entre 900.000 millones y 1,2 billones de dólares, y las reuniones con inversores previas al roadshow ya están en marcha. La tasa de ingresos anualizada de Anthropic es de aproximadamente 47.000 millones de dólares a mediados de 2026, frente a unos 10.000 millones de dólares un año antes.

Para los partners de Microsoft, la historia del canal empresarial es igualmente significativa. Cognizant se convirtió en Global Premier Partner de la Claude Partner Network el 27 de julio, con más de 30.000 empleados ya formados en Claude de una fuerza laboral global de 350.000. Cognizant está integrando Claude en sus plataformas Flowsource, Neuro AI Engineering y Neuro IT Ops, con un pipeline de 40.000 Frontier Certified Engineers y Business Operators acreditados. Este es el modelo de cómo Anthropic escala la entrega empresarial a través de grandes consultoras — y es paralelo a cómo funciona el propio ecosistema de partners de Microsoft.

Anthropic también publicó HIPAA self-serve para organizaciones Enterprise y API (sin necesidad de ticket de ventas), entitlements a nivel de modelo que dan a los administradores control sobre qué modelos de Claude pueden usar los usuarios, alertas de umbral de gasto al 75% y 90% de los límites, y una API de Analytics para acceso programático a los datos de uso. Claude for Government Desktop entró en beta pública el 7 de julio a través de un entorno autorizado FedRAMP High a un precio promocional de 1 $ por agencia hasta agosto.

Qué significa esto para los líderes de TI: Anthropic ya no es una startup — es una plataforma de IA empresarial que se prepara para los mercados públicos con gobernanza, cumplimiento y canal de partners a la altura. Si tu organización usa Claude junto a Microsoft Copilot (y, cada vez más, muchas lo hacen), las funciones de administración empresarial ya existen para gestionarlo correctamente. Revisa los entitlements a nivel de modelo, configura las alertas de gasto y, si estás en el sector salud, la configuración HIPAA self-serve elimina un cuello de botella de aprovisionamiento.

6. De Phi Silica a Aion: el calendario de la transición al dispositivo

La estrategia de modelos de IA en el dispositivo de Microsoft está atravesando una transición gestionada. Phi Silica, el modelo optimizado para NPU que se envía con los PC Windows Copilot+, será sustituido por Aion Instruct como motor detrás de las APIs de IA de Windows. El calendario es firme:

  • 1 de octubre de 2026: comienza el paquete de pruebas independiente de Aion Instruct
  • 23 de octubre de 2026: despliegue de Aion Instruct para Windows Insiders
  • 24 de noviembre de 2026: disponibilidad general — Phi Silica se retira y Aion Instruct se convierte en el modelo de producción

Aion 1.0 Instruct se ejecuta en CPU, GPU o NPU sin requerir una GPU dedicada, maneja tareas de resumen, reescritura, clasificación de intenciones y accesibilidad, y alimenta el reconocimiento de voz en el dispositivo a través de la API WebSpeech en Edge 150+. Se esperan pesos abiertos en Hugging Face.

Para trabajo más pesado en el dispositivo, Aion 1.0 Plan se envía con 14 mil millones de parámetros y una ventana de contexto de 32K, diseñado para flujos de trabajo agénticos en el dispositivo: razonamiento, llamada de herramientas, gestión de archivos y orquestación de subagentes. No es un chatbot — es un runtime de agentes que se envía como parte del Windows Agent Framework, de código abierto en Build 2026.

Qué significa esto para los líderes de TI: Si tu organización desarrolla aplicaciones que usan las APIs de IA de Windows, planifica la transición a Aion este otoño. Prueba con el paquete independiente en octubre. Para los despliegues de PC Copilot+, la transición es automática a través de Windows Update — no se requiere acción del administrador. Pero si tienes aplicaciones que dependen del comportamiento específico de Phi Silica, valídalas contra Aion antes del 24 de noviembre.

Próximos Pasos Estratégicos

  1. Valida MAI-Code-1-Flash — prueba los flujos de trabajo de Copilot de tus desarrolladores contra el nuevo modelo predeterminado antes de que expire el respaldo de GPT-4 Turbo en noviembre. Documenta cualquier regresión de calidad e infórmala a través de los canales de comentarios de Microsoft
  2. Activa DisableMCP en Intune — para entornos regulados, bloquea MCP para GitHub Copilot en Visual Studio ahora. Crea un proceso de excepción para los equipos que necesiten integraciones con herramientas externas
  3. Planifica la migración de Connect Sync — con la sincronización de dispositivos de Cloud Sync en vista previa, construye tu hoja de ruta de migración. Haz un piloto con una OU de prueba y valida el comportamiento de la unión híbrida
  4. Ejecuta el inventario de SMS/voz — usa el script entra-sms-voice-usage-analyzer para identificar a los usuarios que todavía usan SMS/voz. Construye un plan de migración a passkeys antes del corte definitivo de febrero de 2027
  5. Adopta disableNesting para los grupos privilegiados — empieza a aplicar la propiedad a los nuevos grupos de seguridad para acceso privilegiado, aplicaciones sensibles y recursos sujetos a cumplimiento
  6. Prepárate para la transición a Aion — si construyes sobre las APIs de IA de Windows, programa las pruebas para octubre. Para las flotas de PC Copilot+, la transición es automática, pero vale la pena comunicarla a los usuarios
  7. Revisa los controles empresariales de Claude — si usas Claude junto a Copilot, configura los entitlements a nivel de modelo, las alertas de gasto y los ajustes HIPAA si corresponde

La historia de esta semana trata sobre el control que se desplaza hacia TI. Los modelos de primera parte de Microsoft ya son los predeterminados de producción, no vistas previas. La gobernanza de MCP ha llegado a Intune. Entra ID sigue publicando funciones que dan a los administradores un control más estricto sobre la identidad, los grupos y la autenticación. Y la transición del modelo en el dispositivo de Phi Silica a Aion tiene un calendario claro y gestionado. Para los líderes de TI, el mensaje es consistente: la IA ya no está llegando — está aquí, y las herramientas de gestión se están poniendo al día. Las organizaciones que prosperen serán las que traten la infraestructura de IA como cualquier otra plataforma empresarial: gobernada, supervisada y configurada deliberadamente.

Sigue el análisis diario de Copilot y de la IA de Microsoft en https://x.com/kkaminsk.