CoinScoop汇集全球加密货币新闻

智谱发布 GLM-5.3-FlashX,推理速度提升至 200 tokens/s

PANews ·

智谱宣布推出 GLM-5.3-FlashX 模型,目前 API 与体验中心已开放。官方称其最高推理速度可达 200 tokens/s,得益于 10 万张国产芯片提供的算力支持及 Infra 与推理优化投入。该模型基础版本 GLM-5.3-Flash 于 8 月 26 日开源,拥有 3200 亿总参数及 180 亿激活参数,支持 100 万 tokens 上下文,此前曾以“Ox Alpha”名称进行匿名测试。

  • #지푸
  • #glm
  • #인공지능

摘要由 AI 依据原文撰写,并非投资建议。

同一天的其他新闻