Alibaba presenta el chip Zhenwu V900 y confirma que Qwen 4 ya se entrena
Alibaba abrió su conferencia Apsara en Hangzhou el 22 de septiembre presentando las tres capas a la vez: un chip nuevo, una hoja de ruta de modelos que apunta a billones de parámetros, y una plataforma de agentes. Es la apuesta más explícita hasta ahora de una compañía china por tener todo el stack de inteligencia artificial en casa.
El chip Zhenwu V900 de Alibaba
La pieza de hardware es un acelerador con 216 GB de memoria GPU y 1.200 GB/s de ancho de banda entre chips, con soporte para FP8 y FP4. La compañía afirma que triplica el rendimiento del Zhenwu M890 anterior. La producción en masa está anunciada para el primer trimestre de 2027.
En CPU también hay calendario. El Yitian 720 llega en 2027. El Yitian 730 promete hasta un 40% más de rendimiento por gigahercio en SPECint2017 frente al Yitian 710.
Eddie Wu, director ejecutivo del grupo, puso además una cifra de infraestructura que conviene anotar: para 2032, la capacidad global de centros de datos operada por Alibaba Cloud superaría los 20 gigavatios.
Qwen 4 y la escalada a billones de parámetros
En modelos, Alibaba confirmó que Qwen 4 ya está en entrenamiento y trazó una hoja de ruta donde Qwen 4.5 y Qwen 5 escalarían hasta los 5 o 10 billones de parámetros.
El dato más interesante no es ese, sino uno más discreto. Qwen 3.8-Max completó 33 ciclos de automejora recursiva. En ese proceso su puntaje en el índice de Artificial Analysis pasó de 40 a 45. Es decir: el modelo se usó a sí mismo para mejorarse, repetidamente, con una ganancia medible.
En la capa de agentes presentaron AgentCore y un servicio llamado Agent Context. Según la compañía, reduce hasta un 67% el consumo de tokens en escenarios intensivos en conocimiento. Ese número, si se sostiene fuera del laboratorio, es dinero directo para cualquiera que opere agentes en producción.
Qué significa para América Latina
Ya hay una alternativa con presencia local. Alibaba Cloud opera regiones en México y Brasil, así que esto no es una noticia de otro continente: es un proveedor que una empresa de la región puede contratar hoy. Un stack completo fuera del eje Nvidia–Estados Unidos cambia el cálculo de precio y el de riesgo geopolítico, en direcciones opuestas.
El ahorro de tokens es lo más accionable. Si un servicio reduce de verdad el consumo en escenarios con mucho contexto, el impacto en la factura mensual de un agente en producción es mayor que cualquier mejora de benchmark. Vale la pena pedir una prueba con tu propio caso antes de creer el 67%.
Pero la pregunta del pliego sigue ahí. Para vender a un banco, a una multinacional o a una entidad pública, correr sobre infraestructura china abre una conversación que conviene tener antes de firmar, no después. No es un juicio sobre la calidad del producto: es una realidad de los procesos de compra en la región.
Los anuncios de Alibaba que hay que mirar con calma
Casi todo lo anunciado es calendario, no producto disponible. El chip entra en producción masiva en 2027, las CPU también, y los modelos de 5 a 10 billones de parámetros son una intención declarada. En esta industria, las hojas de ruta se mueven.
Lo que sí está: los modelos Qwen actuales, la plataforma de agentes y las regiones de nube. Eso es lo que se puede evaluar hoy.
Hay además un detalle de contexto que cambia la lectura. El mismo día de la apertura, un competidor chino lanzó un modelo de imagen a precio agresivo. Un día antes, otro laboratorio del país liberó pesos abiertos. La competencia interna en China se está dando a una velocidad que no se parece a la de hace dos años, y el resultado para quien compra desde fuera es precio a la baja.
Sitio oficial:
Apsara Conference de Alibaba Cloud
Reportado por: Reuters — Quartz — TelecomTV
Lee también:
Atria Dawn: Shanghái libera gratis un agente de 753.000 millones de parámetros
Los US$300.000 millones de deuda de IA que no aparecen en ningún balance
