Fastest & Best quality & Largest context
/models/hub/models--unsloth--Qwen3.8-27B-GGUF/snapshots/f1bfb127c64f7072bdd2cad55f258b9c8b2910fe/Qwen3.8-27B-UD-Q6_K_XL.gguf
27B
90.1 tok/sQuality 88.6Context 250,000 tokens
Highest token generation speed at 90.1 tok/s. Highest completed quality score at 88.6. Largest context that fits in 96GB VRAM, at 250,000 tokens.