Hardware Benchmarks

Best Local LLM Performance for RTX 3080 Ti

Compare RTX 3080 Ti benchmark results and see which models actually earn the best completed quality scores.

ShareRedditX

Hardware Overview

GPU-specific specifications for local LLM planning.

NVIDIA GeForce RTX 3080 Ti
VRAM
12GB

Recommended Models

Models we recommend for RTX 3080 Ti.

Fastest & Largest context

unsloth/gemma-4-26B-A4B-it-GGUF:UD-Q8_K_XL

26B

125.2 tok/sContext 131,072 tokens

Highest token generation speed at 125.2 tok/s. Largest context that fits in 12GB VRAM, at 131,072 tokens.

Best quality

unsloth/Qwen3.8-27B-GGUF:UD-Q6_K_XL

27B

47.1 tok/sQuality 90.1

Highest completed quality score at 90.1.

Benchmark Results

Completed quality-ranked benchmark results for NVIDIA GeForce RTX 3080 Ti.