Classement

NVIDIA

RTX 3080 Laptop GPU

8 Go

VRAM

—

Meilleure génération

—

Efficacité (réf.)

—

Coût élec. / M tokens (réf.) · 0,25 €/kWh

Ce que cette carte fait tourner

Qwen3.5 0.8B Q4_K_M

0.58 Go

Non mesuré

Qwen3.5 2B Q4_K_M

1.4 Go

Non mesuré

Llama 3.2 3B Instruct Q4_K_M

2.02 Go

Non mesuré

Qwen3.5 4B Q4_K_M

3.01 Go

Non mesuré

Qwen2.5 7B Instruct Q4_K_M

4.68 Go

Non mesuré

Qwen2.5 Coder 7B Q4_K_M

4.68 Go

Non mesuré

Meta Llama 3.1 8B Instruct Q4_K_M

4.92 Go

Non mesuré

Qwen2.5 14B Instruct Q4_K_M

8.99 Go

Ne tient pas en VRAM

DeepSeek R1 Distill Qwen 14B Q4_K_M

8.99 Go

Ne tient pas en VRAM

Qwen2.5 Coder 14B Q4_K_M

8.99 Go

Ne tient pas en VRAM

Phi-4 Q4_K_M

9.05 Go

Ne tient pas en VRAM

Fluide ≥ 60 tok/s (plus vite qu'on ne lit) · Confortable 30-60 · Lent < 30 · « Ne tient pas » = taille du modèle + 2 Go de marge > VRAM (le déchargement CPU est exclu du protocole : les chiffres n'auraient plus de sens).

Mesures par modèle

Aucun run pour cette carte. À toi de jouer : lancer le bench.

VRAM utilisée = pic de mémoire GPU système pendant le run (inclut l'OS, compte ~0,5 à 1 Go de plus que le modèle seul).