Text model · GLM
GL Can I run GLM-5.3-Flash? Pick your device.
GLM-5.3-Flash is a 320B MoE (18B active) model. At Q4_K_M the weights are ~199.71 GB; with KV cache and runtime overhead, budget ~204.8 GB. Select your hardware below to see the full compatibility breakdown.
NVIDIA GPUs
- Nvidia GeForce RTX 2060 (6GB) No
- Nvidia GeForce RTX 3060 Ti (8GB) No
- Nvidia GeForce GTX 1070 (8GB) No
- Nvidia GeForce RTX 3060 (12GB) No
- Nvidia GeForce RTX 4070 (12GB) No
- Nvidia GeForce RTX 4060 Ti (16GB) No
- Nvidia GeForce RTX 4080 (16GB) No
- Nvidia GeForce RTX 4090 (24GB) No
- Nvidia GeForce RTX 3090 (24GB) No
- Nvidia GeForce RTX 5090 (32GB) No
Apple Silicon Macs
- Apple M1 (8GB) No
- Apple M2 (16GB) No
- Apple M4 (16GB) No
- Apple M5 (16GB) No
- Apple M3 Pro (18GB) No
- Apple M4 (24GB) No
- Apple M4 Pro (24GB) No
- Apple M5 (32GB) No
- Apple M4 Pro (48GB) No
- Apple M5 Pro (48GB) No
- Apple M4 Max (64GB) No
- Apple M4 Max (128GB) No
- Apple M5 Max (128GB) No
- Apple M3 Ultra (256GB) No
RAM-only laptops
iPhone & iPad
Android
AMD GPUs
Memory figures are estimates. See methodology.