Hardware Benchmarks

Best Local LLM Performance for RTX 3080 + RTX 3080 Ti

Compare RTX 3080 + RTX 3080 Ti benchmark results and see which models actually earn the best completed quality scores.

ShareRedditX

Hardware Overview

GPU-specific specifications for local LLM planning.

NVIDIA GeForce RTX 3080 + NVIDIA GeForce RTX 3080 Ti
VRAM
32GB
Architecture
Multi-GPU

Recommended Models

Models we recommend for RTX 3080 + RTX 3080 Ti.

Fastest

unsloth/NVIDIA-Nemotron-3.5-Lightning-30B-A3B-GGUF:UD-Q4_K_XL

30B

159.2 tok/s

Highest token generation speed at 159.2 tok/s.

Best quality

unsloth/Qwen3.8-27B-GGUF:UD-Q6_K_XL

27B

47.1 tok/sQuality 90.1

Highest completed quality score at 90.1.

Largest context

unsloth/gemma-4-26B-A4B-it-GGUF:UD-Q8_K_XL

26B

125.2 tok/sContext 131,072 tokens

Largest context that fits in 32GB VRAM, at 131,072 tokens.

Benchmark Results

Completed quality-ranked benchmark results for NVIDIA GeForce RTX 3080 + NVIDIA GeForce RTX 3080 Ti.