Home / Models / Llama 3.3 70B Instruct / AMD Radeon RX 6800 16 GB
Can Llama 3.3 70B Instruct run on AMD Radeon RX 6800 16 GB?
Can it run? Yes, with CPU/RAM offload. Full GPU fit? No.
Can it run?
- Can it run?
- Yes, with CPU/RAM offload. This is not equivalent to full-GPU inference.
- Full GPU fit?
- No
- Model
- Llama 3.3 70B Instruct · 71B
- GPU
- AMD Radeon RX 6800 16 GB · 16 GB advertised
Memory calculation
Breakdown for Q4 at 8K context, batch size 1. Calculator v1.0.0.
| Model weights | 41.4 GB |
|---|---|
| KV cache | 2.5 GB |
| Runtime reserve | 2.6 GB |
| Safety margin | 1.5 GB |
| Required (estimated) | 48.0 GB |
| GPU usable VRAM | 14.4 GB |
Result: DOES NOT FIT
Quantization table
| Quantization | 2K | 4K | 8K | 16K | 32K | 64K | 128K |
|---|---|---|---|---|---|---|---|
| BF16 | No | No | No | No | No | No | No |
| FP16 | No | No | No | No | No | No | No |
| Q3 | Offload | Offload | Offload | Offload | Offload | Offload | Offload |
| Q4 | No | No | No | No | No | No | No |
| Q5 | No | No | No | No | No | No | No |
| Q6 | No | No | No | No | No | No | No |
| Q8 | No | No | No | No | No | No | No |
What fits entirely in VRAM?
No calculated full-VRAM fit at the evaluated quantizations and context lengths.
What requires RAM offload?
Weights may run with CPU/RAM offload. That is not equivalent to full-GPU inference. RigForAI does not estimate tokens/sec in this release.
Available graphics cards
These SKUs use this GPU chip. Amazon CTAs appear only for EXACT/HIGH matches. Absence of a price does not change the compatibility result above.

GIGABYTE AORUS Radeon RX 6800 MASTER 16G AMD 16 GB GDDR6
16 GB · Amazon EXACT
$629.99
Check price on Amazon
MSI GAMING Radeon RX 6800 X TRIO 16G AMD 16 GB GDDR6
16 GB · Amazon EXACT
$1580.21
Check price on Amazon
GIGABYTE GAMING Radeon RX 6800 OC 16G AMD 16 GB GDDR6
16 GB · Amazon EXACT
$799.00
Check price on Amazon
ASUS TUF Gaming TUF-RX6800-O16G-GAMING AMD Radeon RX 6800 16 GB GDDR6
16 GB · Amazon unmatched

ASUS ROG -STRIX-RX6800-O16G-GAMING AMD Radeon RX 6800 16 GB GDDR6
16 GB · Amazon unmatched
Sources
Model: official config meta-llama/Llama-3.3-70B-Instruct (official-fallback-config). GPU/product specs: Icecat. Compatibility: RigForAI calculator v1.0.0 estimated VRAM · Q8 at 8K: DOES_NOT_FIT. Amazon: affiliate commerce match, not a spec source.