Esta semana marca un punto de inflexión para la plataforma Claude. Anthropic publicó cuatro capacidades importantes de Managed Agents, finalizó la mayor revisión de la especificación MCP en la historia del protocolo y superó en silencio un hito comercial que la sitúa en camino hacia una OPI en octubre con una valoración cercana al billón de dólares. Mientras tanto, el modo automático de Claude Code se convierte hoy en el predeterminado — con una tasa de detección de comandos peligrosos del 89 % que replantea el debate sobre la seguridad de la codificación con IA.
Para los líderes de ingeniería, los impactos prácticos son inmediatos: los topes de presupuesto por sesión cambian la forma de gobernar el gasto de los agentes, el protocolo MCP stateless cambia la forma de diseñar los servidores de herramientas, y el aumento de precio de Sonnet 5 el 31 de agosto cambia tus proyecciones de costos. Desglosemos lo que importa.
Managed Agents: presupuestos de sesión, asesores y anclaje geográfico
La actualización principal de la API son cuatro nuevas capacidades de Managed Agents publicadas el 7 de agosto. En conjunto, abordan las tres mayores preocupaciones empresariales sobre las cargas de trabajo con agentes: previsibilidad de costos, flexibilidad de modelos y residencia de datos.
Presupuestos de sesión (Session Budgets) son la novedad más significativa desde el punto de vista operativo. Estableces un límite de gasto fijo por sesión — a precio de lista público en céntimos de dólar completos — y cuando la sesión alcanza su presupuesto, se pausa con un motivo de detención budget_reached en lugar de lanzar nuevas peticiones al modelo. La comprobación se produce entre peticiones al modelo, por lo que la petición en curso termina de ejecutarse. El exceso queda acotado a una petición de modelo por hilo. Puedes aumentar o eliminar un presupuesto para reanudar, pero la eliminación es unidireccional: no puedes volver a añadir un tope a una sesión existente. Los despliegues pueden aplicar un presupuesto a cada sesión que inicien.
Esta es la herramienta de gobernanza de costos que las empresas llevan pidiendo desde el lanzamiento de Managed Agents. Se acabaron los bucles de agentes descontrolados que generan facturas de tokens inesperadas. Establece el presupuesto al crear la sesión y la plataforma lo aplicará.
Modelo asesor (Advisor Model) añade un nuevo rol al plantel de agentes. A mitad de tarea, una sesión puede consultar a un modelo independiente para obtener una segunda opinión sobre los pasos más difíciles — sin entregar toda la tarea a un modelo más potente. El asesor debe ser al menos tan capaz como el propio agente. La configuración es una única entrada en el plantel. Esto permite un enfoque por niveles: un modelo rentable se encarga de la mayor parte del trabajo y consulta a un modelo más potente solo cuando se encuentra con un paso realmente difícil.
Anclaje geográfico de inferencia (Inference Geo-Pinning) (inference_geo) controla dónde se ejecuta físicamente la inferencia del modelo. Se configura dentro del objeto model al crear el agente o se puede sobrescribir por sesión, con los valores us (solo EE. UU., facturado a 1,1x para los modelos publicados después del 1 de febrero de 2026) o global (precio estándar, se ejecuta donde haya capacidad disponible). Esto aborda directamente los requisitos de residencia de datos — un bloqueo para muchas industrias reguladas.
Carga automática de GitHub Skills completa el conjunto. Las sesiones de Managed Agents ahora pueden cargar skills directamente desde un repositorio de GitHub montado. Cualquier skill que se encuentre en el directorio raíz .claude/skills se detecta automáticamente al iniciar la sesión. Sin copias manuales en el entorno del agente.
MCP 2026-07-28: la revisión del protocolo stateless
La especificación MCP finalizada el 28 de julio es la mayor revisión arquitectónica desde el lanzamiento del protocolo. El cambio central: MCP es ahora un protocolo totalmente stateless.
El handshake initialize/initialized ha desaparecido. La cabecera Mcp-Session-Id ha desaparecido. Cada petición es autodescriptiva — lleva la versión del protocolo, la identidad del cliente y las capacidades del cliente en un campo _meta en línea. La RPC opcional server/discover sustituye al handshake previo para los clientes que necesitan conocer las capacidades antes de realizar una llamada.
Por qué importa: cualquier petición puede llegar ahora a cualquier instancia de servidor detrás de un simple balanceador de carga round-robin. No se requieren sticky sessions ni flujos abiertos. Los servidores MCP pueden desplegarse en infraestructura serverless y edge como cargas de trabajo HTTP de primera clase.
Enrutamiento por cabeceras amplifica este efecto. Mcp-Method y Mcp-Name viajan en cabeceras HTTP en las peticiones Streamable HTTP, de modo que las pasarelas, los limitadores de tasa y los WAF pueden enrutar y autorizar sin analizar cuerpos JSON. La infraestructura HTTP estándar puede procesar ahora tráfico MCP de forma nativa.
Multi-Round-Trip Requests (MRTR) gestionan flujos de trabajo de herramientas interactivos — confirmaciones, desambiguaciones — sin flujos persistentes. Una herramienta puede pausarse a mitad de llamada, devolver input_required, y el cliente reintenta con la entrada necesaria. Esto sustituye a los mecanismos de solicitud de información que dependían de flujos persistentes.
Resultados de listado almacenables en caché añaden ttlMs y cacheScope a las respuestas de tools/list, prompts/list, resources/list y resources/read. Los clientes pueden almacenar en caché los catálogos de herramientas, lo que reduce las llamadas de ida y vuelta redundantes en aproximadamente un 85 % y permite reconexiones más rápidas con cachés de prompts estables.
En el apartado de autenticación, la especificación añade la validación de emisor RFC 9207, pasa de Dynamic Client Registration a Client ID Metadata Documents (CIMD) e introduce una extensión Enterprise Managed Authorization para la gestión centralizada del proveedor de identidad. DCR queda formalmente obsoleto, con eliminación prevista después del verano de 2027.
Una política de obsolescencia formal introduce una ventana mínima de transición de 12 meses. Tres funciones quedan obsoletas en esta versión: Roots (sustituido por parámetros de herramienta explícitos), Sampling (sustituido por llamadas directas a las APIs de los proveedores de LLM) y Logging (sustituido por stderr para stdio y OpenTelemetry para la nube). El transporte heredado HTTP+SSE también queda obsoleto.
La preparación de los SDK varía. El SDK de C# v2.0 se publicó como versión estable el 28 de julio — compatible con versiones anteriores y stateless por defecto. Ruby alcanzó la v1.0 estable en el Nivel 2 con un 100 % de conformidad. TypeScript, Python, Go y Rust están en beta. Cloudflare publicó soporte desde el primer día con createMcpHandler en Agents SDK v0.20.0, que sirve herramientas MCP de forma stateless sin Durable Objects.
El cambio disruptivo es real y no es compatible con versiones anteriores. La ventana de obsolescencia de 12 meses da margen de maniobra, pero las nuevas implementaciones deberían apuntar al protocolo stateless desde el primer día.
Claude Code: el modo automático se convierte en el predeterminado
A partir de hoy, 14 de agosto, el modo automático se convierte en el modo de permisos predeterminado para las nuevas sesiones de Claude Code en los planes Pro, Max y Team. El modo automático utiliza un clasificador para filtrar las llamadas a herramientas en lugar de solicitar la aprobación manual. Anthropic reporta una tasa de detección de comandos peligrosos del 89 % frente al 13,6 % de la aprobación manual — un resultado contraintuitivo que sugiere que los revisores humanos son el eslabón débil de la cadena de seguridad.
El costo del clasificador ya no se factura en los planes Pro, Max y Team. Enterprise, API, Bedrock, Google Cloud y Microsoft Foundry siguen siendo opt-in por ahora.
En la ventana del 6 al 8 de agosto se publicaron cuatro versiones (de la v2.1.223 a la v2.1.226). Entre las novedades destacan SendMessage entre sesiones: las sesiones ahora pueden enviarse mensajes entre máquinas con la detección de ListAgents. Se eliminaron los topes de creación de subagentes. El origen de plugins archive admite plugins basados en zip a través de HTTPS con verificación opcional de SHA-256. El enmascaramiento de credenciales del sandbox ahora es compatible con JWT, con re-firma AWS SigV4.
Un desarrollo aparte que merece la pena mencionar: Anthropic redujo el system prompt de Claude Code para los modelos Claude 5 en más de un 80 % sin pérdidas medibles en las evaluaciones internas de codificación. Seis cambios en la construcción del contexto sustituyen las reglas rígidas por orientación basada en el criterio, divulgación progresiva a través de skills y memoria automática que reemplaza a los archivos CLAUDE.md mantenidos manualmente. Un nuevo comando claude doctor audita y simplifica los archivos CLAUDE.md.
Inference Hooks: DLP empresarial a nivel de prompt
Anthropic lanzó Inference Hooks como beta de Claude Enterprise el 5 de agosto — el primer punto de control en línea nativo sobre lo que las organizaciones envían al modelo.
Cuando un empleado envía un prompt en una superficie gobernada (claude.ai, Claude Code, Claude Cowork), Anthropic hace una pausa, envía por POST la transcripción de la conversación al servidor de seguridad configurado por la organización a través de HTTPS firmado y espera un veredicto de permitir/denegar antes de que se ejecute la inferencia. Las peticiones denegadas nunca llegan a Claude. Una única configuración a nivel de organización cubre chat, Claude Code y Claude Cowork en web, escritorio y CLI. Las respuestas de las llamadas a herramientas de MCP, skills y plugins también se inspeccionan antes de que Claude las vea.
Las limitaciones son significativas: solo veredictos binarios (sin reescritura ni sanitización de contenido), solo en el lado del prompt en el lanzamiento (la aplicación en el lado de la respuesta está planificada), las imágenes y archivos sin procesar no se envían para su revisión (solo texto) y un tiempo de espera predeterminado de 5 segundos. Entre las integraciones con nombre figuran Netskope, Palo Alto Networks, Proofpoint y Zscaler. También se admiten servidores personalizados.
Los controles de despliegue incluyen modo shadow (permitir siempre pero registrar las decisiones), exclusiones basadas en roles y despliegues por porcentaje. La función está incluida en el plan Enterprise a $20 por asiento al mes más el consumo — sin cargo adicional.
Esta es la historia de DLP empresarial que hay que seguir. Ningún otro gran proveedor de IA ofrece inspección nativa en línea de prompts. Pero las limitaciones actuales significan que es una base, no un producto terminado.
Breaking changes y plazos
| Fecha | Qué ocurre | Acción requerida |
|---|---|---|
| 5 de agosto (pasado) | Opus 4.1 retirado permanentemente de la API | Migra a claude-opus-4-8; los valores no predeterminados de temperature, top_p, top_k devuelven HTTP 400 |
| 17 de agosto | Fin del acceso al Workbench heredado | Exporta los prompts, variables y evals guardados desde la Console |
| 31 de agosto | Fin del precio de lanzamiento de Sonnet 5: $2/$10 → $3/$15 por MTok | Recalcula el gasto previsto; el nuevo tokenizador añade ~10-35 % más tokens por texto equivalente |
| 29 de septiembre | Retirada prevista de Sonnet 4.5 | Migra a un modelo compatible |
| 15 de octubre | Retirada prevista de Haiku 4.5 | Migra a un modelo compatible |
| 24 de noviembre | Retirada prevista de Opus 4.5 | Migra a un modelo compatible |
El aumento de precio de Sonnet 5 merece especial atención. El incremento del 50 %, de $2/$10 a $3/$15 por millón de tokens, se ve agravado por un cambio de tokenizador que produce aproximadamente un 10-35 % más de tokens para un texto equivalente. El efecto combinado para los consumidores de API de alto volumen es sustancial. Adelanta los trabajos por lotes antes del 31 de agosto y activa el almacenamiento en caché de prompts donde corresponda.
Actualizaciones de SDK: continúa la cadencia semanal
El SDK de Python de Anthropic publicó la v0.121.0 el 7 de agosto con las cuatro capacidades de Managed Agents, el beta de cambios de herramientas a mitad de conversación y la eliminación de los modelos Opus 4.1 retirados. La v0.122.0 llegó alrededor del 12 de agosto con output_behavior para Dreams y correcciones de errores para el streaming de Bedrock y la firma async de AWS SigV4. El SDK de TypeScript sigue una trayectoria similar con la v0.116.0 el 7 de agosto.
El Claude Agent SDK en TypeScript (v0.3.214) y Python (v0.2.126) se publicaron ambos entre el 18 y el 22 de julio con model_usage tipado, terminal_reason en los mensajes de resultado y soporte de niveles de esfuerzo mediante 'max'.
Los ocho SDK oficiales de MCP envían ahora la cabecera beta agent-memory-2026-07-22 en todas las llamadas de almacenamiento de memoria, en sustitución de la antigua cabecera managed-agents-2026-04-01. Cambios de comportamiento clave: orden estable definido por el servidor, depth restringido a 0/1/omitir y path_prefix debe terminar con /. Los cursores de página de la cabecera antigua no son válidos con la nueva — debes reiniciar desde la primera página.
La cadencia de actualización es aproximadamente semanal. Fija las versiones en producción y actualiza de forma deliberada.
La trayectoria de la OPI de Anthropic y la expansión de cómputo
El contexto comercial detrás de estos cambios de plataforma merece la pena entenderlo. La Serie H de Anthropic recaudó 65 000 millones de dólares en mayo con una valoración post-money de 965 000 millones — superando los 852 000 millones de OpenAI. El run rate de ingresos pasó de 14 000 millones de ARR en febrero a más de 47 000 millones en mayo, casi quintuplicándose en tres meses.
Se presentó un S-1 confidencial ante la SEC el 1 de junio. La cotización en Nasdaq está prevista para octubre de 2026, con Goldman Sachs, JPMorgan y Morgan Stanley como aseguradores. Algunos inversores esperan una valoración de OPI de más de 2 billones de dólares, basándose en unos ingresos anualizados proyectados de entre 100 000 y 120 000 millones de dólares a finales de 2026.
La expansión de cómputo que respalda este crecimiento no tiene precedentes en cuanto a escala. Anthropic ha cerrado acuerdos con AMD (hasta 5 000 millones de dólares por 2 GW de GPUs MI450), SpaceX (1 250 millones de dólares al mes por Colossus 1 en Memphis hasta mayo de 2029), Amazon (varios miles de millones), Google junto con Broadcom (multi-gigavatio), Volta Infra Holdings (10 000 millones de dólares, acuerdo a 6 años en Noruega), Riot Platforms (9 000 millones de dólares) y una empresa conjunta de Macquarie y GIC llamada Theseus Infrastructure, con Anthropic como inquilino ancla. Google proporcionó además un préstamo de 35 000 millones de dólares para arrendar chips en cinco centros de datos. Anthropic comprometió 50 000 millones de dólares en centros de datos propios en EE. UU. y está creando un equipo interno de silicio.
Acciones recomendadas
- Establece presupuestos de sesión en todos los despliegues de Managed Agents — es la función de gobernanza de costos más impactante publicada este trimestre. Aplícala a nivel de despliegue para limitar todas las sesiones.
- Empieza ya la planificación de la migración a MCP 2026-07-28 — el protocolo stateless es un cambio disruptivo. La ventana de 12 meses es generosa, pero los nuevos servidores deberían apuntar a él desde el primer día. Evalúa cuáles de tus servidores MCP usan Roots, Sampling o el transporte HTTP+SSE: los tres están obsoletos.
- Adelanta los trabajos por lotes de Sonnet 5 antes del 31 de agosto — el aumento de precio del 50 % más el cambio de tokenizador se acumulan. Activa el almacenamiento en caché de prompts.
- Exporta los recursos de Workbench antes del 17 de agosto — los prompts y evals guardados se eliminarán de forma permanente.
- Evalúa Inference Hooks para el DLP empresarial — si estás en Claude Enterprise, el beta ya está disponible. Empieza con el modo shadow para entender qué bloquearía tu servidor de seguridad.
- Fija las versiones de los SDK en producción — la cadencia semanal hace que las dependencias sin fijar se desvíen. Apunta a Python v0.121.0+ o TypeScript v0.116.0+ para el conjunto de funciones de Managed Agents.
- Ejecuta
claude doctoren tus archivos CLAUDE.md — la estrategia de reducción del 80 % del system prompt también aplica a tu contexto de proyecto. Simplifica y deja que la orientación basada en el criterio sustituya a las reglas rígidas.
La plataforma se está convirtiendo en infraestructura a un ritmo que exige atención. Los presupuestos de sesión, el MCP stateless y el modo automático por defecto no son mejoras incrementales — son cambios arquitectónicos que transforman la forma de construir sobre Claude. La OPI de octubre traerá más escrutinio y más velocidad. La pregunta para los líderes de ingeniería es si tu arquitectura está preparada para ambas cosas.
Sígueme en x.com/kkaminsk para un análisis semanal del ecosistema Claude.