El ecosistema de IA en China dejó de ser predecible esta semana. InclusionAI de Ant Group publicó como código abierto un modelo de razonamiento de un billón de parámetros bajo la Licencia MIT — un movimiento sin precedentes de un equipo de infraestructura de pagos. DeepSeek presentó planes para su primer modelo multimodal con soporte de cadena de herramientas empresariales, y los Presidentes Trump y Xi alcanzaron un acuerdo revirtiendo las restricciones de chips de la era Biden, permitiendo el envío de Nvidia H200 de vuelta a China con un arancel del 25%. Aquí está el China AI Weekly de esta semana.
Ring-2.6-1T: El Bombazo de un Billón de Parámetros de Ant Group
La historia más grande vino de una fuente inesperada. InclusionAI, el brazo tecnológico de Ant Group (matriz de Alipay), lanzó Ring-2.6-1T — un modelo de razonamiento Mixture-of-Experts de un billón de parámetros bajo la Licencia MIT. Este es el lanzamiento de pesos abiertos más permisivo a esta escala en la historia de la industria.
Especificaciones clave:
- ~1 billón de parámetros totales, ~63 mil millones activos por token, manteniendo los costos de inferencia prácticos a pesar del conteo de parámetros
- Contexto nativo de 128K (256K mediante extensión YaRN)
- Modos adaptativos de esfuerzo de razonamiento: “High” y “xHigh” para asignación dinámica de cómputo
- Publicado en Hugging Face bajo
inclusionAI/Ring-2.6-1Tsin restricciones de uso
Los benchmarks reportados por el proveedor muestran a Ring-2.6-1T competitivo con DeepSeek-V4-Pro Max, Kimi K2.6 Thinking y GPT-5.4 en AIME 2026, con puntuaciones notablemente más fuertes en ARC-AGI-2 y SWE-bench. (Fuente: Gigazine) (Fuente: Codersera)
Por Qué es Importante
Un modelo de un billón de parámetros con licencia MIT de un equipo que la mayor parte de la industria no había notado cambia fundamentalmente el cálculo de pesos abiertos. La Licencia MIT significa que las empresas pueden implementar y ajustar el modelo sin restricciones de uso — una ventaja significativa para industrias reguladas como servicios financieros y salud. El ADN de infraestructura financiera de Ant Group (miles de millones de transacciones de Alipay anualmente) también aporta experiencia en fiabilidad de grado de producción al desarrollo del modelo. Para un contexto más amplio sobre cómo la IA china está remodelando la estrategia empresarial, consulte nuestra visión general del ecosistema de IA en China.
Ring-2.6-1T añade una cuarta opción creíble a la conversación sobre la frontera de pesos abiertos junto a DeepSeek, Qwen y Kimi — y llegó de un equipo que nadie estaba observando. La advertencia obvia: estos son benchmarks reportados por el proveedor. La verificación independiente de LMSys Chatbot Arena determinará si las puntuaciones se mantienen bajo pruebas estandarizadas.
DeepSeek V4.1: Multimodal y MCP en Junio
DeepSeek confirmó que lanzará V4.1 en junio, añadiendo procesamiento nativo de imágenes y audio — una primicia para la línea DeepSeek y una evolución significativa respecto a los modelos V3 y R1 solo de texto. La actualización también trae soporte para Model Context Protocol (MCP) y una cadena de herramientas empresariales expandida, marcando el cambio de DeepSeek de demostración de investigación a producto comercial. Para los equipos empresariales que evalúan DeepSeek frente a alternativas occidentales, consulte nuestro marco de decisión para CIOs sobre DeepSeek V4. El ritmo acelerado sigue a una brecha de 140 días durante la cual los competidores lanzaron aproximadamente 50 modelos nuevos. (Fuente: aibase.com)
Extensión de precios. DeepSeek extendió su descuento del 75% en V4-Pro hasta el 31 de mayo de 2026. El precio de cache-hit bajó a 1/10 de las tarifas de lanzamiento ($0.0028/1M tokens). Las tarifas actuales son $0.435/1M de entrada y $0.87/1M de salida de tokens — aproximadamente un 70% por debajo de los modelos occidentales comparables. (Fuente: Documentación de API de DeepSeek)
Panorama de financiación. El fundador Liang Wenfeng invirtió personalmente 20 mil millones de yuanes ($2.8B) en la empresa. Se informa que DeepSeek busca 50 mil millones de yuanes ($7B) en su próxima ronda — la recaudación individual más grande de una startup china de IA — con el Fondo Nacional de Inversión de la Industria de Circuitos Integrados, Tencent y Alibaba en conversaciones. La participación del Big Fund vincula la trayectoria de DeepSeek con las ambiciones de semiconductores domésticos de Pekín, particularmente desde que V4 fue entrenado en hardware Huawei Ascend.
Para los equipos empresariales, V4.1 es el primer posicionamiento de DeepSeek como producto empresarial. Si cumple con la calidad multimodal y la integración MCP, se convierte en un competidor directo de GPT y Claude para equipos que priorizan el consumo de API sobre la implementación autogestionada. La agresiva trayectoria de precios también sugiere que los costos de inferencia seguirán cayendo.
Acuerdo de Chips Trump-Xi: Las Exportaciones H200 se Reanudan con un Arancel
En una reunión en Pekín el 14 de mayo, los Presidentes Trump y Xi acordaron permitir que Nvidia exporte chips H200 a “clientes aprobados en China” con un arancel del 25% pagado a EE. UU. — la reversión más significativa de la política de chips entre EE. UU. y China desde las restricciones de la era Biden. Los demócratas en el Congreso criticaron la medida como un riesgo de seguridad nacional, preparando posibles desafíos legislativos. (Fuente: Economic Times)
Tres implicaciones:
Alivio inmediato de capacidad. El acceso a H200 complementa la producción doméstica mientras Huawei acelera hacia 600,000 unidades Ascend 910C en 2026 y SMIC opera a plena capacidad en nodos maduros. La demanda de laboratorios como DeepSeek, Moonshot e InclusionAI aún supera la oferta doméstica, y los H200 llenan un vacío que las fábricas domésticas aún no pueden cerrar.
El arancel del 25% es un experimento político. Crea ingresos directos para el Tesoro de EE. UU. en exportaciones de chips avanzados — un mecanismo sin precedentes que podría ajustarse, expandirse o revocarse. Los detalles de implementación (quién califica como “aprobado,” cómo se recaudan los aranceles) permanecen sin especificar.
Riesgo de volatilidad geopolítica. La reversión de la prohibición total al acceso basado en aranceles complica la planificación de capacidad a largo plazo. La oposición del Congreso significa que el acuerdo podría enfrentar desafíos legislativos en cuestión de meses. Para los equipos que construyen sobre infraestructura de IA china, mantener la compatibilidad con chips domésticos sigue siendo una cobertura prudente.
Las dinámicas subyacentes de la cadena de suministro refuerzan esto: Huawei planea duplicar la producción de chips de gama alta de 2025, con la producción total de la línea Ascend alcanzando hasta 1.6 millones de matrices en 2026. La compatibilidad Day 0 de DeepSeek V4 en ocho fabricantes de chips chinos demuestra que las alternativas domésticas son viables, aunque con restricciones de oferta.
Código Abierto y Comunidad
- Ring-2.6-1T es el lanzamiento destacado de pesos abiertos de la semana — un modelo de un billón de parámetros con licencia MIT desde fuera de los laboratorios frontera habituales. La verificación de terceros determinará si mantiene clasificaciones de primer nivel, pero el lanzamiento por sí solo reajusta las expectativas sobre lo que los modelos de pesos abiertos pueden lograr.
- Los modelos DeepSeek ahora superan los 75 millones de descargas en Hugging Face, manteniendo el primer puesto para las familias de IA chinas en la plataforma. La capacidad del modelo R2 32B para ejecutarse en GPUs de consumo de 24GB lo mantiene como una opción preferida para cargas de trabajo de razonamiento sensibles al costo.
- Los laboratorios chinos desafían colectivamente la tesis de que “frontera significa cerrado.” Entre DeepSeek R2 y V4, Qwen3.6, Kimi K2.5 y ahora Ring-2.6-1T, el volumen y la capacidad de los modelos abiertos chinos continúa acelerándose. Cada lanzamiento eleva el techo de pesos abiertos, haciendo más difícil para los proveedores occidentales de código cerrado justificar la prima sin ventajas de capacidad proporcionales.
Qué Observar
- Entrega de DeepSeek V4.1 (junio). Si las funciones multimodales y MCP llegan bien, este es el primer modelo posicionado para empresas de DeepSeek. Esté atento a los benchmarks de terceros en tareas de visión y audio.
- Benchmarks independientes de Ring-2.6-1T. Los resultados de LMSys Chatbot Arena y Artificial Analysis determinarán si las puntuaciones reportadas por el proveedor frente a GPT-5.4 se mantienen.
- Implementación del acuerdo de chips. El marco de “cliente aprobado” y el arancel del 25% necesitan detalles publicados. Esté atento a las directrices del Departamento de Comercio y las audiencias del Congreso.
- Producción de Huawei Ascend. Con 600,000 unidades 910C planificadas y pedidos de hyperscalers realizados, la segunda mitad de 2026 probará si la oferta doméstica puede cerrar significativamente la brecha con el acceso reanudado a Nvidia.
Eso es el China AI Weekly de esta semana — un equipo fintech lanzó un modelo de un billón de parámetros con licencia MIT, DeepSeek confirmó su hoja de ruta multimodal, y el panorama de chips entre EE. UU. y China se volteó por completo. El hilo común es el ritmo acelerado: los límites de la IA de pesos abiertos siguen expandiéndose, y la carrera de infraestructura — chips, modelos y vías de implementación — no muestra señales de desaceleración.
¿Evaluando modelos chinos de IA para su pila empresarial? Big Hat Group ofrece consultoría de IA empresarial con orquestación neutral al proveedor, implementaciones nativas de Azure y gobernanza documentada. Ya sea que esté comparando Ring-2.6-1T, integrando DeepSeek V4.1 o construyendo una estrategia multimodelo que navegue el cambiante panorama de políticas de chips, reserve una llamada de descubrimiento. Treinta minutos. Sin presentación. Solo su caso de uso y nuestro equipo.
Fuentes: gigazine.net, codersera.com (Ring-2.6-1T), aibase.com (DeepSeek V4.1), deepseek.com/api-docs (precios), Economic Times (acuerdo de chips Trump-Xi), Bloomberg (Huawei Ascend), SCMP (SMIC), Hugging Face (estadísticas de modelos)