La semana del 8 al 13 de junio vio al ecosistema de IA chino consolidarse en torno a varios temas emergentes: la eficiencia de parámetros como arma competitiva, la carrera de plataformas de agentes calentándose, y el desacoplamiento de chips entre EE. UU. y China tomando su giro más pronunciado hasta la fecha. Lo que una vez se sintió como una narrativa lejana de recuperación es ahora un ecosistema paralelo que se desarrolla a su propio ritmo, con sus propias reglas. Aquí está el informe completo.

¿Tiene prisa? Cinco historias para seguir: (1) La familia DeepSeek V4 está completamente disponible — MoE de un billón de parámetros a precios de commodity; (2) ERNIE 5.1 de Baidu alcanza el #4 global en LMArena Search usando el 6% del cómputo; (3) Alibaba abre Tongyi Qianwen a agentes de terceros, piloto con Luckin Coffee y Eastern Airlines; (4) EE. UU. cierra el vacío de filiales en exportaciones de chips de IA; (5) El Consejo de Estado de China acelera la legislación integral de IA.


DeepSeek V4: La Implementación en Todo el Ecosistema ha Llegado

La Familia V4 está Activa

La familia DeepSeek V4 — V4 (completo), V4 Flash y V4 Pro — ya está completamente disponible a través de OpenRouter y los principales proveedores de nube chinos. Las especificaciones de arquitectura ya están bien establecidas: un diseño Mixture-of-Experts con aproximadamente 1 billón de parámetros totales y aproximadamente 37 mil millones activos por token, ofreciendo rendimiento de clase frontera mientras mantiene los costos de inferencia manejables.

Aspectos arquitectónicos clave:

  • Razonamiento híbrido + no razonamiento en un solo modelo, retirando el paradigma separado V3/R1
  • Ventana de contexto de 1M+ tokens mediante DeepSeek Sparse Attention (DSA)
  • Memoria condicional Engram para recuperación de contexto casi infinito
  • Manifold-Constrained Hyper-Connections (mHC) que permiten entrenamiento estable de un billón de parámetros

Quizás lo más importante, V4 es el primer modelo frontera optimizado para silicio chino — la inferencia se ejecuta en Huawei Ascend 950PR a través del marco CANN Next compatible con CUDA. El CEO de Nvidia, Jensen Huang, llamó a esto “un resultado horrible para los Estados Unidos” en abril. Cada semana desde entonces ha confirmado que su preocupación estaba bien fundada.

Los Precios se Han Desplomado

Las dinámicas de precios cuentan una historia clara. DeepSeek V4 Flash cuesta $0.14/$0.28 por millón de tokens — más barato que Claude Haiku 4.5, Gemini 3.1 Flash y GPT-5.4 Nano. En Tencent Cloud con aciertos de caché, V4-Pro baja al equivalente de $0.0035 por millón de tokens. En comparación, Fable 5 de Anthropic (lanzado la misma semana) cuesta $10/M en tokens de entrada.

Para los equipos empresariales que evalúan infraestructura de IA, la pregunta ya no es “¿podemos pagar esto?” sino “¿qué hacemos cuando la inferencia es esencialmente gratuita?”

Razonamiento Actualizado: R1-0528

DeepSeek también actualizó su línea de modelos de razonamiento con R1-0528, publicando sólidas puntuaciones de benchmark: AIME 2024 pass@1 de 72.6%, MATH-500 en 97.3% y GPQA Diamond en 81.0%. Los pesos son abiertos bajo una licencia permisiva — un desafío directo a los modelos de razonamiento cerrados de los laboratorios estadounidenses.


ERNIE 5.1 de Baidu: Menos es Más

Baidu lanzó ERNIE 5.1 el 8 de mayo, y el rendimiento del modelo esta semana consolidó su estatus como uno de los lanzamientos más importantes del segundo trimestre de 2026. El titular: ERNIE 5.1 alcanzó el #4 global en LMArena Search Arena con una puntuación de 1223 — el único modelo chino en el top 10 global para rendimiento de búsqueda. Qwen3.7-Max de Alibaba reclamaría más tarde la posición china más alta en el Artificial Analysis Intelligence Index.

Pero la verdadera historia es cómo se construyó ERNIE 5.1.

En lugar de escalar hacia arriba, Baidu fue en la dirección opuesta. ERNIE 5.1 comprime los parámetros totales a aproximadamente un tercio de ERNIE 5.0 (un modelo de 2.4 billones de parámetros), reduce a la mitad los parámetros activos, y usa solo aproximadamente el 6% del cómputo de pre-entrenamiento gastado en modelos frontera comparables. Fue extraído como la subred óptima de la matriz de submodelos elásticos de ERNIE 5.0 — esencialmente, Baidu entrenó un modelo masivo una vez y luego encontró la mejor porción más pequeña.

Este es un pivote estratégico que vale la pena observar. Mientras la norma de la industria ha sido “más grande es mejor,” Baidu apuesta a que la eficiencia de parámetros y el costo de inferencia serán los factores decisivos en la adopción empresarial. Si el rendimiento de benchmark de ERNIE 5.1 se mantiene en implementaciones del mundo real, valida el argumento de que la era de las leyes de escalado está dando paso a una era de eficiencia.

ERNIE 5.1 está disponible a través de ERNIE Bot y la plataforma Qianfan de Baidu AI Cloud.


Alibaba: Qwen Abre su Ecosistema

Tongyi Qianwen se Convierte en Plataforma de Agentes

El movimiento estratégico más grande de esta semana vino de Alibaba. El 3 de junio, Tongyi Qianwen anunció la apertura total a Agentes y Skills de terceros, permitiendo a cualquier empresa operar su propio Agente con marca dentro del ecosistema Tongyi.

Este es un cambio de plataforma fundamental. En lugar de ser solo una API de LLM, Tongyi Qianwen se posiciona como un asistente personal “super Agente” — una interfaz de lenguaje natural que reemplaza el paradigma de cambiar entre aplicaciones. Los usuarios no necesitan abrir aplicaciones separadas para café, vuelos o compras; simplemente le dicen al Agente lo que quieren.

El primer lote de empresas piloto es revelador: Luckin Coffee (recordatorios inteligentes de cola), KFC (pedidos), Mikkasa y China Eastern Airlines (planificación de viajes y servicios integrales de viaje). Todos estos son puntos de contacto de consumo de alta frecuencia que ponen a prueba el paradigma de agente frente a los ecosistemas existentes de mini-programas.

Para las empresas, las implicaciones son significativas. Tongyi Qianwen está creando efectivamente un nuevo canal de operaciones de IA — análogo a cómo los mini-programas remodelaron WeChat. Las marcas que dominen el diseño de agentes tempranamente pueden capturar el mismo tipo de ventaja de primer movimiento que crearon las primeras cuentas oficiales de WeChat.

Qwen-VLA: Entrando en la IA Incorporada

El equipo Qwen de Alibaba también lanzó Qwen-VLA, su primer modelo vision-language-action para IA incorporada. Esto señala la entrada de Alibaba en la carrera de IA del mundo físico, uniéndose a un campo concurrido que incluye a Huawei, Tencent y una gran cantidad de startups de robótica. El modelo permite a los robots percibir, razonar sobre y actuar en entornos físicos — un paso de capacidad crítico para cualquier empresa seria sobre robótica humanoide o industrial.

Qwen3 como Estrategia de Código Abierto

La familia Qwen3 más amplia (lanzada en abril de 2026 bajo Apache 2.0) continúa ganando tracción internacional entre desarrolladores. El buque insignia de 235B obtiene MMLU 87.1, mientras que la variante MoE 30B-A3B se ejecuta a un costo de inferencia de 3B mientras iguala benchmarks de clase GPT-4o. La estrategia de Alibaba es clara: usar licencias de código abierto generosas para impulsar la adopción global de desarrolladores, construyendo bloqueo de ecosistema a través del uso en lugar de contratos de API.


Tencent: La IA Entra en la “Fase de Realización”

Las ganancias del primer trimestre de 2026 de Tencent, publicadas en este período, revelaron una empresa que ha pasado del modo de I+D de IA a la implementación comercial. Los ingresos alcanzaron RMB 196.46 mil millones, y la gerencia describió la IA como entrando en una “fase de realización.”

El modelo de vista previa Hunyuan Hy3 ahora está desplegado en los negocios de nube, publicidad y juegos de Tencent. La gerencia destacó que el modelo es fuerte en razonamiento y capacidades de agente a pesar de ser más pequeño y eficiente en costos — consistente con el tema chino más amplio de construir para la eficiencia en lugar de la escala bruta.

La familia Hunyuan abarca desde 0.5B hasta A13B parámetros y está desplegada en más de 50 productos de Tencent. De particular interés: las capacidades de generación de video de Hunyuan (Hunyuan Video Avatar, Image-to-Video) están encontrando tracción comercial en los negocios de juegos y contenido de Tencent, donde los activos generados por IA están reduciendo los costos de producción.


Regulación: Pekín Acelera la Legislación Integral de IA

Nuevas Directrices Regulatorias Entran en Vigor

Las nuevas y amplias directrices regulatorias de IA de China entraron en vigor este período, marcando el marco de gobernanza de IA más completo del mundo. Las disposiciones clave incluyen:

  • Registro de algoritmos: Todos los modelos de IA que operen en China deben registrarse ante la Administración del Ciberespacio de China (CAC), divulgando las fuentes de datos de entrenamiento y las arquitecturas de los modelos
  • Auditorías trimestrales obligatorias que cubren equidad, sesgo y vulnerabilidades de seguridad
  • Localización de datos: Los datos personales utilizados para el entrenamiento de IA deben permanecer dentro de las fronteras chinas
  • Requisitos de explicabilidad: Las empresas deben demostrar cómo se toman las decisiones de IA de alto impacto

Ley Integral de IA en Desarrollo

El plan de trabajo del Consejo de Estado ahora pide “acelerar la legislación integral” sobre IA — la primera vez que se utiliza un lenguaje tan específico. La ley planificada cubre protección de datos, regulación de algoritmos, acceso a potencia de cómputo, propiedad intelectual para contenido generado por IA, ciberseguridad y gestión de la cadena de suministro.

A febrero de 2026, un acumulado de 796 servicios de IA generativa han completado el registro, y 481 aplicaciones o funciones han finalizado el registro. La infraestructura regulatoria ya está madura; esta nueva ley formalizará y unificará el mosaico existente.

Para las multinacionales que operan en China, el mensaje es claro: el cumplimiento no es negociable, y el costo de equivocarse está aumentando.


Desacoplamiento de Chips entre EE. UU. y China: El Giro Más Pronunciado Hasta la Fecha

El Vacío de las Filiales está Cerrado

El 1 de junio, el Departamento de Comercio de EE. UU. emitió nuevas directrices aclarando que los requisitos de licencia de exportación para chips de IA avanzados se aplican a cualquier entidad con sede en China, independientemente de dónde opere su filial. Esto cierra la solución alternativa más utilizada desde 2022 — empresas chinas canalizando compras de chips a través de filiales en Malasia y otros terceros países.

El efecto práctico: los envíos de Blackwell a empresas con sede en China son efectivamente ilegales, incluso a través de filiales no chinas. Las directrices existentes también prohíben que cualquier persona (estadounidense o no) use, venda o dé servicio a los chips de la serie Huawei Ascend 910 sin autorización separada de BIS.

Nueve Chips Domésticos Certificados para Contratación Estatal

En un movimiento paralelo, China aprobó formalmente nueve procesadores de IA domésticos para todos los proyectos de centros de datos financiados por el estado. Los proveedores certificados: Huawei (Ascend 310, 910), Alibaba T-Head (M530, M890), Biren, Hygon, Iluvatar CoreX, MetaX y Moore Threads — todos fabricados en el nodo equivalente a 7nm de SMIC.

Los proyectos con menos del 30% de finalización deben eliminar el silicio extranjero instalado — un desplazamiento forzado inmediato del hardware de Nvidia de proyectos financiados por el gobierno por valor de decenas de miles de millones anuales. El cuello de botella único de SMIC sigue siendo la restricción clave en los plazos de implementación.

El Mercado de Chips de IA en China

Se proyecta que el mercado crecerá de ¥143B ($20B) en 2024 a ¥1.34T ($196B) para 2029 — una tasa de crecimiento anual compuesta del 54%. El impulsor estructural son los controles de exportación: las empresas chinas simplemente no pueden comprar los chips más avanzados de Nvidia, por lo que están construyendo los suyos propios.

DeepSeek V4 convirtiéndose en el primer modelo frontera optimizado para silicio chino es un hito. La narrativa de “China alcanzará en chips” ha cambiado a “China ya está ejecutando cargas de trabajo de producción en silicio doméstico.”


Qué Observar la Próxima Semana

  1. Adopción empresarial de Baidu ERNIE 5.1 — ¿la eficiencia de parámetros se traduce en velocidad de implementación real?
  2. Desarrollo del ecosistema de agentes de Alibaba — ¿qué tan rápido se incorporan agentes de terceros después de Luckin y Eastern Airlines?
  3. Detalles de asignación de capacidad de SMIC — los nueve proveedores de chips certificados comparten la misma fundición; la asignación es el factor limitante para toda la rampa de chips domésticos
  4. Métricas de uso de DeepSeek V4 — con inferencia a fracciones de un centavo, ¿explota el tráfico de API?
  5. Acciones de aplicación de la CAC bajo las nuevas directrices — el marco regulatorio está en su lugar; esté atento a la primera aplicación de alto perfil para establecer precedente

Este es China AI Weekly, un informe de Big Hat Group para líderes de ingeniería y ejecutivos técnicos que navegan el panorama global de IA. Seguimos los desarrollos en DeepSeek, Baidu, Alibaba, Tencent, la política de IA china y el ecosistema más amplio para que usted no tenga que hacerlo. ¿Tiene una historia que deberíamos cubrir o comentarios sobre nuestro análisis? Póngase en contacto.