- Modelos
- GLM-5.3-Flash

GLM-5.3-Flash
by Zai
GLM-5.3-Flash is Zai's first native multimodal model in the GLM-5 series. Its 320B mixture-of-experts architecture activates 18B parameters and combines sparse and linear attention for efficient long-context inference. With a 1M-token context window, it is built for coding, long-horizon agents, visual workflows, and professional knowledge work.