지푸, GLM-5.3-FlashX 모델 출시…추론 속도 200 tokens/s
지푸(智谱)가 새로운 AI 모델 GLM-5.3-FlashX를 출시했다. 10만 개의 국산 칩을 활용한 인프라 최적화를 통해 최고 추론 속도 200 tokens/s를 구현했다. 해당 모델은 3,200억 개의 파라미터를 보유하고 있으며 현재 API와 체험 센터를 통해 이용할 수 있다.
요약은 원문을 바탕으로 AI가 작성했어요. 투자 조언이 아닙니다.
지푸(智谱)가 새로운 AI 모델 GLM-5.3-FlashX를 출시했다. 10만 개의 국산 칩을 활용한 인프라 최적화를 통해 최고 추론 속도 200 tokens/s를 구현했다. 해당 모델은 3,200억 개의 파라미터를 보유하고 있으며 현재 API와 체험 센터를 통해 이용할 수 있다.
요약은 원문을 바탕으로 AI가 작성했어요. 투자 조언이 아닙니다.