
GLM 5.3 Flash
85
—
35.4
GLM-5.3-Flash on 2x DGX Spark with TensorFold: 85 tok/s single stream, 174 tok/s total across 8 streams (code). Screenshot: GLM-5.3-Flash-EXL3, x1 stream 85.0 tok/s.

GLM-5.3-Flash on 2x DGX Spark with TensorFold: 85 tok/s single stream, 174 tok/s total across 8 streams (code). Screenshot: GLM-5.3-Flash-EXL3, x1 stream 85.0 tok/s.