Si gestiona Azure Virtual Desktop, ha lidiado con problemas de FSLogix. Contenedores de perfil que no se adjuntan. Menús Inicio que se bloquean al iniciar sesión. Pantallas negras que dejan a los usuarios mirando a la nada mientras la cola de ayuda se llena. Bloqueos al cerrar sesión que bloquean VHDs y se propagan a la sesión del siguiente usuario.
Todo administrador de AVD ha estado allí. El problema no es la falta de documentación — los documentos de FSLogix de Microsoft son exhaustivos. El problema es que cuando un P1 ocurre a las 8:47 AM y 200 usuarios no pueden trabajar, necesita un proceso estructurado, no un centro de documentación.
Por eso construimos y publicamos como código abierto la Plantilla de Runbook de Solución de Problemas de FSLogix.
¿Por Qué una Plantilla de Runbook?
La mayoría de las organizaciones solucionan problemas de FSLogix de la misma manera: alguien con conocimiento tribal lo arregla y nadie escribe lo que hizo. Cuando esa persona está de vacaciones, el siguiente incidente toma tres veces más tiempo.
Un runbook cambia eso. Le da a cada nivel de soporte — L1 a L3 — un flujo de trabajo repetible y basado en evidencia. Estandariza la recolección de registros, el diagnóstico y la remediación para que la solución no dependa de quién está de guardia.
Construimos el nuestro durante meses de interacciones reales con AVD, y luego decidimos abrirlo al código fuente para que otros equipos puedan usarlo como punto de partida para sus propios procesos.
Qué Hay Dentro del Runbook
La plantilla es un único archivo markdown completo (~2,300 líneas) con diagramas Mermaid en línea que se renderizan directamente en GitHub. Está diseñado para ser bifurcado, personalizado para su entorno y utilizado como un documento operativo vivo.
Triaje de Incidentes y Matriz de Decisiones
Una tabla de referencia rápida mapea síntomas a acciones. Para cada síntoma (bloqueo del menú Inicio, pantalla negra, bucle de explorer, interrupción masiva), proporciona tres acciones en orden de prioridad y un desencadenante de escalamiento claro. Los técnicos L1/L2 pueden comenzar a resolver sin leer el documento completo.
Flujo de Trabajo de Diagnóstico
Un diagrama de flujo visual (Mermaid) recorre el árbol de decisiones:
- Alcance — ¿usuario único o en todo el grupo?
- Estado de adjunto de FSLogix — ¿se montó el contenedor?
- Rama — si el adjunto falló, diagnostique la infraestructura (almacenamiento, permisos, AV, autenticación). Si el adjunto tuvo éxito, diagnostique la capa de perfil/AppX/shell.
- Remediar → Verificar → Documentar
Playbooks de Remediación
Cada playbook se dirige a una causa raíz específica con comandos exactos:
- VHD bloqueado — encontrar y cerrar manejadores SMB (
Get-SmbOpenFilelocal yClose-AzStorageFileHandlede Azure Files), habilitarCleanupInvalidSessions, ajustar configuraciones de reintento. - Permisos — ACLs
icaclsrecomendadas por Microsoft, asignaciones de RBAC de Azure, advertencias deAccessNetworkAsComputerObject. - Fallos de Kerberos de Azure AD — validación con
klist, configuración de autenticación de cuenta de almacenamiento, diagnóstico de interferencia de Acceso Condicional, uso deDebug-AzStorageAccountAuth. - Contenedor lleno — expansión de
SizeInMBs, análisis de consumo de espacio, validación de compactación. - Interferencia de AV/EDR — lista completa de exclusiones (procesos, controladores, rutas, extensiones), comandos de PowerShell de Defender, guía de implementación de Intune.
- Fallos de menú Inicio / AppX — correlación de eventos de bloqueo, re-registro de paquetes, validación de
InstallAppxPackages, verificaciones de AppLocker. - Bloqueos al cerrar sesión — identificación de manejadores, remediación específica por proceso (SearchHost, OneDrive, Defender),
CleanupInvalidSessions. - Fallos de Cloud Cache — diagnósticos de servicio, dimensionamiento de disco local, validación de sincronización de proveedores, recuperación de split-brain.
- Corrupción de perfil — árbol de decisiones (reparar vs. recrear vs. restaurar), chkdsk, reparación de registro del hive, patrones de respaldo.
- Conflictos de MSIX App Attach, coexistencia con Citrix, regresiones de Windows Update, migración de perfiles entre backends de almacenamiento.
Scripts Automatizados
- Recolector de paquetes de caso — un script de PowerShell que recopila registros de FSLogix, registros de eventos, exportaciones de registro, diagnósticos de red, estado de Kerberos y estado de perfil en un archivo zip para escalamiento.
- Script de verificación de salud — implemente mediante Intune Proactive Remediations o tarea programada para validar continuamente el estado del servicio FSLogix, exclusiones de AV, conectividad de almacenamiento y tasas de error.
- Consultas de triaje específicas — one-liners rápidos de PowerShell para encontrar bloqueos de shell, errores del servicio de perfiles y perfiles huérfanos.
Consultas KQL para Azure Monitor
Consultas preconstruidas para Log Analytics:
- Conteo de fallos de adjunto de FSLogix por host
- Tendencias de tiempo de carga de perfiles (promedio, máximo, P95 por hora)
- Eventos de creación de perfiles temporales
- Correlación de bloqueos de menú Inicio / shell
Además de una tabla de configuración de alertas recomendada (capacidad de almacenamiento, latencia, limitación de IOPS, errores de FSLogix, perfiles temporales).
Marco Operativo
Más allá de la solución de problemas, el runbook incluye:
- Matriz de clasificación de severidad con objetivos de SLA
- Línea base conocida buena — valores de referencia para tiempos de carga, tamaños de contenedor, latencia de almacenamiento y tasas de error
- Planificación de capacidad — tablas de estimación de IOPS, fórmula de dimensionamiento de disco de Cloud Cache, proyecciones de crecimiento de almacenamiento
- Guía de Redirections.xml — exclusiones seguras anotadas y una tabla de “exclusiones peligrosas” de rutas que nunca debe excluir
- Lista de verificación de implementación — validación de 16 puntos previa al lanzamiento
- Procedimientos de DR — eliminación temporal de Azure Files, recuperación de snapshots, conmutación por error de ANF, matriz de decisiones de recuperación
- Rutas de escalamiento — cuándo escalar, a quién y con qué artefactos
- Plantillas de comunicación con el usuario — notificación de interrupción y guía de autoayuda
- Registro de ejercicios de playbook — rastree qué playbooks se han probado y cuándo
Quién Debería Usar Esto
- Administradores de AVD que quieren un proceso estructurado de solución de problemas en lugar de correcciones ad-hoc
- Equipos de soporte (L1–L3) que necesitan flujos de trabajo consistentes y repetibles en todos los niveles de habilidad
- Arquitectos de AVD que diseñan nuevas implementaciones y quieren un marco operativo preconstruido
- MSPs y consultores que gestionan AVD para múltiples clientes y necesitan una plantilla reutilizable
El runbook está intencionalmente escrito como una plantilla. Bifúrquelo, reemplace los valores de marcador de posición con las especificaciones de su entorno (rutas de almacenamiento, nombres de grupos, objetivos de SLA) y personalice los playbooks para sus herramientas.
Cómo Lo Construimos
Este runbook se desarrolló mediante una combinación de compromisos reales con AVD y flujos de trabajo de ingeniería asistidos por AI. Utilizamos agentes de codificación AI para acelerar la investigación, hacer referencias cruzadas con la documentación de Microsoft, generar scripts de PowerShell y construir consultas KQL — luego validamos todo en entornos de producción.
El resultado es un documento que habría tomado semanas compilar manualmente, entregado en días. Es el tipo de multiplicación de fuerza que los equipos pequeños necesitan para superar su peso en TI empresarial.
Obtenga el Runbook
El runbook completo es gratuito y de código abierto en GitHub:
→ Big-Hat-Group-Inc/FSLogixRunbookTemplate
Bifúrquelo. Personalícelo. Úselo como base para sus procesos de soporte de AVD. Si encuentra problemas o quiere contribuir con mejoras, las pull requests son bienvenidas.
Si su equipo necesita ayuda para desarrollar procesos operativos de AVD, optimizar el rendimiento de FSLogix o diseñar almacenamiento de perfiles resiliente — póngase en contacto. Esto es lo que hacemos.
Big Hat Group ayuda a empresas a diseñar, implementar y operar infraestructura cloud de Microsoft — incluyendo Azure Virtual Desktop, Windows 365 y las herramientas impulsadas por AI que hacen más efectivos a los equipos de TI. Conozca más sobre nuestros servicios.