Pairs
62 ranked
Liberated
3- 351
Qwen3.5 2BRTX 5090 · Q4_K_M
- 272.8
Qwen3.8-27BRTX PRO 6000 Blackwell Max-Q · NVFP4 · TensorFold
- 264
GLM 5.3 Flash
4× RTX PRO 6000 · EXL3 · TensorFold 0.6.2
- 238
GLM 5.3 Flash
2× RTX PRO 6000 · EXL3 · TensorFold 0.6.5
- 220
Swift 1.5 Qwen3.8 Flash-NextRTX 4090 · IQ2_XS · Strata
- 177.6
Qwen3.8-27BRTX A5000 · NVFP4 · TensorFold
- 173
Gemma-4 26B-A4B-it
UncensoredRTX 5090 · Q4_K_M
- 151.4
Qwen3.8-27BRTX PRO 6000 Blackwell Max-Q · NVFP4 · vLLM
- 142
Qwen3.8-Flash-NextRTX 5090 · IQ3_S · Strata
- 139.3
Qwen3.8-27BRTX A5000 · NVFP4 · vLLM
- 126.5
Qwen3.8-Flash-NextM5 Max · MTPLX V2.11.3
- 120
GLM 5.3 Flash
RTX PRO 6000 + 2× GB10 · EXL3 4bpw · TensorFold
- 108.6
Qwen3.6-35B-A3BM4 Pro 64GB · 4-bit · Rapid-MLX
- 104
Qwen3.8-Flash-NextRTX 5090 · IQ3_S · Strata
- 102.9
Qwen3.8-27BDGX Spark · 4-bit · TensorFold
- 100.6
Qwen3.8-Flash-NextRTX 3090 24GB · IQ2_XS · Strata
- 99.9
Qwen3.8-Flash-Next2× RTX 5060 Ti 16GB · IQ3_S · Strata
- 94.4
Qwen3.6-35B-A3BUncensoredDGX Spark · NVFP4
- 92.8
Qwen3.8-Flash-NextRTX PRO 6000 · Q4_XL · llama.cpp b11412
- 89.9
Qwen3.8-27BM5 Pro 64GB · 4-bit · TensorFold
- 85.5
Qwen3.6-35B-A3BM4 Pro · 4bit · rapid-mlx
- 85
GLM 5.3 Flash
DGX Spark · EXL3 · TensorFold
- 82.8
Qwen3.5-4BM4 Pro · 4bit · rapid-mlx
- 80.9
Qwen3.8-Flash-NextRTX 5090 · NVFP4
- 79.5
Qwen3.8-Flash-NextDGX Spark · EXL3 · EXL3
- 74.8
Qwen3.8-Flash-NextDGX Spark · NVFP4 · TensorFold
- 72
Qwen3.8-27BDGX Spark · NVFP4
- 72
Qwen3.8-Flash-NextRTX 3090 24GB · IQ3_S · Strata
- 66.7
Qwen3.8-Flash-NextRTX 5070 12GB · IQ3_XXS · Strata
- 65
AliceAI-Foundation-80B-A3B
M5 Max · Q4_K_M · llama.cpp
- 61.9
Qwen3.8-27BM6 mini 32GB · 4-bit · TensorFold
- 60.4
GLM 5.3 Flash
DGX Spark · EXL3 · TensorFold
- 57.7
DeepSeek v4.1 Flash
RTX PRO 6000 · Q2 · llama.cpp b11412
- 55.6
GLM 5.3 Flash
DGX Spark · NVFP4
- 53.8
Qwen3.8-Flash-NextRyzen AI Max+ 395 128GB · UD-IQ4_XS · Strata 0.1.40
- 53.5
Qwen3.8-Flash-NextRTX 5070 Ti 16GB · IQ3_S · Strata
- 52.7
Qwen3.8-Flash-NextRTX 3080 10GB · IQ3_S · Strata
- 51
Qwen3.8-Flash-Next CoderM5 Max · GSQ-RCO · llama.cpp
- 50
Empero Qwen3.8-35B-A3BRTX 3060 · Q4_K_M · llama.cpp
- 50
Qwen3.8-Flash-NextRTX 4060 Ti · IQ3_S · Strata
- 49.3
Qwen3.5-9BM4 Pro · 4bit · rapid-mlx
- 48.3
Qwen3-8BM4 Pro · 4bit · rapid-mlx
- 47
MiMo-V2.6-Distill-Qwen-9B
RTX 5060 · Q5_K_M · llama.cpp
- 45
Qwen3.8-Flash-NextDGX Spark · FP8
- 42.3
Qwen3.8-27BDGX Spark · NVFP4 · TensorFold 0.6.3
- 40.7
Qwen3.8-27BRTX 4090 · UD-Q4_K_XL · llama.cpp
- 40
Ornith
GTX 1660 SUPER
- 40
Qwen3.8-Flash-Next2× RTX 3060 12GB · IQ3_S · Strata
- 38.4
GLM 5.3
DGX Spark · EXL3 3.0bpw · TensorFold
- 37
Qwen3.6-35B-A3BM1 Max 32GB · UD-IQ3_XXS
- 32.3
GLM 5.3 Flash
DGX Spark · EXL3 2.05bpw · TensorFold
- 31.8
Qwen3.8-27BDGX Spark · NVFP4 · SGLang 0.5.21
- 30
GLM 5.3
DGX Spark · Int4/Int8 · sparkDash
- 28.7
Qwen3.8-27BDGX Spark · NVFP4 · vLLM 0.30.0
- 27.7
Qwen3.8-Flash-NextRTX 3060 · IQ2_XS · Strata
- 23
Qwen3.8-27BRTX 5060 Ti · IQ3_XXS · llama.cpp
- 19
Qwen3.8-27BRTX 5060 Ti · UD-Q2_K_XL · llama.cpp
- 18.6
GLM 5.3 Flash
DGX Spark · EXL3 · EXL3
- 15
GLM 5.3 Flash
DGX Spark · NVFP4 · vLLM
- 14
Nex-N2.5-mini
RTX 5060 Ti · Q4_K_M · llama.cpp
- 10
Qwen3.8-27B TurboFCFusionUncensoredRTX 5060 Ti · IQ2_M · llama.cpp
- 7.8
Qwen3.8-Flash-NextM5 Max · Q4_K_M · LM Studio








