GLM-5.3-FlashX é lançado na B.AI com acesso via API e Web Chat
A plataforma B.AI anunciou em 21 de setembro o lançamento do modelo multimodal GLM-5.3-FlashX, desenvolvido pela Z.AI. O modelo utiliza uma arquitetura esparsa com 320B de parâmetros totais e 18B de parâmetros ativos, alcançando uma velocidade de geração de até 200 tokens por segundo, o que representa um aumento de cinco vezes em relação à versão anterior. O GLM-5.3-FlashX suporta um contexto de 1M de tokens, compreensão nativa de arquivos e vídeos, e ferramentas de raciocínio, sendo voltado para fluxos de trabalho de agentes e programação interativa.
Os resumos são escritos por IA a partir do artigo original. Não é recomendação de investimento.