share
spanish.china.org.cn | 28. 08. 2026 | Editor:Filo Fu [A A A]

Zhipu AI presenta el GLM-5.3-Flash con 100 000 chips chinos

Palabras clave: China, IA
Spanish.china.org.cn | 28. 08. 2026

La startup china de inteligencia artificial (IA) Zhipu AI anunció que el GLM-5.3-Flash, el primer modelo multimodal nativo de su serie GLM-5, funciona íntegramente con 100 000 chips chinos.

Esto subraya el deseo de China de contar con una infraestructura de IA a gran escala con semiconductores de producción propia.

La empresa indicó que el GLM-5.3-Flash se presentó oficialmente como un modelo de código abierto. Admite una ventana de contexto de un millón de tókenes y posee una arquitectura de 300 000 millones de parámetros. Puede implementarse en todos los chips de IA nacionales, informó el jueves.

En pruebas comparativas, obtuvo 57 puntos en el Índice de Inteligencia Artificial Analítica, a la par con el Claude Opus 4.8 de Anthropic. Tiene un precio de 0,15 dólares por millón de tókenes de entrada y 0,50 dólares por millón de tókenes de salida, aproximadamente una décima parte del GLM-5.3 y más o menos una cuadragésima parte del Claude Opus 4.8.

El equipo explicó que esto se debe principalmente a las múltiples mejoras arquitectónicas implementadas simultáneamente. Al adoptar un cuerpo híbrido de atención dispersa y lineal, se logró reducir el costo de los servicios de contexto largo y mantener las capacidades precisas en este ámbito.

Antes de su lanzamiento oficial, el modelo se probó de manera anónima como Ox Alpha —conocido como «Niu Lai» en los círculos de desarrolladores chinos— en las plataformas internacionales OpenRouter y OpenCode, donde registró más de 60 billones de tókenes en uso y se situó en la cima de las listas de uso durante la semana, con un tráfico respaldado por potencia de cómputo de chips nacionales, reportó el medio medio financiero Caixin.

Esto demuestra que los modelos chinos pueden atraer a los desarrolladores a través de un recorte en los costos y ganancias en eficiencia a nivel arquitectónico, incluso sin ninguna etiqueta de identidad. Los desarrolladores apoyan el modelo con un volumen real de uso pagado, porque al utilizarlo, nadie sabe quién es el proveedor, indicó el jueves Tian Feng, exdecano del Instituto de Investigación de la Industria de la Inteligencia de SenseTime.

Zhipu AI sostuvo que ha probado, por primera vez, el uso de un gran clúster de chips para prestar servicios en GLM-5.3-Flash, con estos chips conectados a través de su red de interconexión de banda ancha alta.

En su documentación técnica, Zhipu apuntó que su servicio de inferencia se ejecutó en un clúster de más de 100 000 chips nacionales y que «la eficiencia del equipo y el costo por token alcanzó un nivel comparable al de las unidades de procesamiento gráfico (GPU) convencionales de Nvidia».

«Esto demuestra que los chips nacionales pueden soportar plena y eficientemente la inferencia de modelos de vanguardia en escenarios masivos», afirmó la empresa.

La firma de investigación de semiconductores SemiAnalysis comentó en X que, con cada solicitud procesada por silicio nacional con una eficiencia comparable a la de Nvidia, «la ventaja competitiva de CUDA está siendo puesta a prueba una vez más», tras el anuncio de OpenAI sobre su chip de inferencia propio, Jalapeño.

El medio chino LatePost informó que los chips podrían provenir de Huawei, Moore Threads y Hygon, aunque Zhipu AI no lo ha confirmado.

Este último acontecimiento resalta la creciente competencia en el mercado de modelos de IA, ya que los desarrolladores chinos buscan demostrar su capacidad técnica y de ejecución a gran escala con semiconductores de desarrollo propio, según analistas del sector.

Al cierre de esta edición el jueves, las acciones de Zhipu AI en la bolsa de Hong Kong subieron más del 6,3 % en la sesión matutina.

Alibaba anunció el lanzamiento de su nuevo modelo multimodal Qwen3.8-Flash, con un mejor desempeño en programación y tareas de oficina, así como menores costos de entrenamiento. Qwen3.8-Flash admite una ventana de contexto predeterminada de 262 144 tókenes, ampliable a un millón, lo que le permite manejar archivos grandes, conversaciones extensas y materiales de investigación exhaustivos.

Según Tian, los últimos avances sugieren que los modelos de lenguaje a gran escala chinos van más allá del rendimiento espectacular y entran en una nueva fase de implementación masiva y rentable.

La combinación de capacidad multimodal nativa, una ventana de contexto de un millón de tókenes y la inferencia en chips de producción nacional alude a que los desarrolladores chinos son capaces de optimizar tanto la arquitectura del modelo como la infraestructura al mismo tiempo, anotó Tian.

Si las mejoras en eficiencia continúan, podrían acelerar una adopción mayor entre empresas y desarrolladores, lo que reforzaría la resiliencia a largo plazo del ecosistema de IA del país, añadió.

Los modelos nacionales de IA de lenguaje a gran escala alcanzaron un uso semanal de 36,84 billones de tókenes entre el 10 y el 16 de agosto, superando a Estados Unidos durante 16 semanas consecutivas para ocupar el primer lugar a nivel mundial, según el Securities Times de Shanghai.