GLM-5.3-FlashX is the high-speed variant of Z.ai's GLM-5.3-Flash, a native multimodal model delivering inference speeds of up to 200 tokens/s. Built on the same hybrid sparse and linear attention architecture...
Resultat och priser visas bara när de finns i den aktuella källan. “Ej publicerat” är inte ett nollresultat.
| Modellversion | SWE-Bench | MMLU | GPQA | Kontext | Pris / 1M in/ut | Kunskapsgräns | Källa | Datum |
|---|---|---|---|---|---|---|---|---|
| GLM 5.3 FlashX | Ej publicerat | Ej publicerat | Ej publicerat | 1.05M tokens | Ej publicerat | Ej publicerat | Saknas | 2026-09-18 |
z-ai/glm-5.3-flashx