智譜AI、推論速度最大200 tokens/sの「GLM-5.3-FlashX」を公開
智譜AI(Zhipu AI)は、推論速度が最大200 tokens/sに達する「GLM-5.3-FlashX」を公開し、APIおよび体験センターでの提供を開始した。この高速化は、10万枚の国産チップによる推論演算能力と、インフラおよび推論最適化への追加投資によって実現された。ベースモデルである「GLM-5.3-Flash」は8月26日にオープンソース化されており、総パラメータ数3200億、アクティブパラメータ数180億、コンテキストウィンドウ100万トークンを誇る。同モデルは以前、「Ox Alpha」として匿名テストが行われていた。
要約は原文をもとに AI が作成しました。投資助言ではありません。