Zhipu AI lanza GLM-5.3-FlashX con velocidades de inferencia de hasta 200 tokens/s
La empresa Zhipu AI (智谱) ha lanzado el modelo GLM-5.3-FlashX, cuya API y centro de experiencia ya están disponibles. Según la compañía, el modelo alcanza una velocidad de inferencia de hasta 200 tokens por segundo, gracias a una infraestructura de 100,000 chips nacionales y optimizaciones adicionales. El modelo base, GLM-5.3-Flash, fue lanzado como código abierto el 26 de agosto con 320,000 millones de parámetros totales, 18,000 millones de parámetros activos y una ventana de contexto de 1 millón de tokens. Anteriormente, el modelo fue probado bajo el nombre anónimo "Ox Alpha".
Los resúmenes los escribe una IA a partir del artículo original. No es asesoramiento de inversión.