Classement

NVIDIA

RTX 5050 Laptop GPU

8 Go

VRAM

—

Meilleure génération

—

Efficacité (réf.)

—

Coût élec. / M tokens (réf.) · 0,25 €/kWh

Ce que cette carte fait tourner

Gemma 3 270M Q4_K_M

0.25 Go

Non mesuré

Qwen2.5 0.5B Q4_K_M

0.4 Go

Non mesuré

Qwen2.5 Coder 0.5B Q4_K_M

0.4 Go

Non mesuré

Qwen3 0.6B Q4_K_M

0.48 Go

Non mesuré

Qwen3.5 0.8B Q4_K_M

0.58 Go

Non mesuré

LFM2.5 1.2B Q4_K_M

0.73 Go

Non mesuré

Llama 3.2 1B Q4_K_M

0.81 Go

Non mesuré

Qwen2.5 1.5B Q4_K_M

0.99 Go

Non mesuré

Qwen2.5 Coder 1.5B Q4_K_M

0.99 Go

Non mesuré

R1 Distill 1.5B Qwen Q4_K_M

1.12 Go

Non mesuré

Qwen3 1.7B Q4_K_M

1.28 Go

Non mesuré

Qwen3.5 2B Q4_K_M

1.4 Go

Non mesuré

Gemma 2 2B Q4_K_M

1.71 Go

Non mesuré

Qwen2.5 3B Q4_K_M

1.93 Go

Non mesuré

Qwen2.5 Coder 3B Q4_K_M

1.93 Go

Non mesuré

Llama 3.2 3B Instruct Q4_K_M

2.02 Go

Non mesuré

Ministral 3 3B Q4_K_M

2.15 Go

Non mesuré

Granite 4.1 3B Q4_K_M

2.17 Go

Non mesuré

Phi-4 mini 3.8B Q4_K_M

2.49 Go

Non mesuré

Qwen3 2507 4B Q4_K_M

2.5 Go

Non mesuré

Qwen3 4B Q4_K_M

2.5 Go

Non mesuré

Gemma 3n E2B Q4_K_M

2.79 Go

Non mesuré

Qwen3.5 4B Q4_K_M

3.01 Go

Non mesuré

Gemma 4 E2B Q4_K_M

3.46 Go

Non mesuré

Gemma 3n E4B Q4_K_M

4.24 Go

Non mesuré

Mistral 7B 7B Q4_K_M

4.37 Go

Non mesuré

Qwen2.5 7B Instruct Q4_K_M

4.68 Go

Non mesuré

Qwen2.5 Coder 7B Q4_K_M

4.68 Go

Non mesuré

R1 Distill 7B Qwen Q4_K_M

4.68 Go

Non mesuré

Meta Llama 3.1 8B Instruct Q4_K_M

4.92 Go

Non mesuré

Qwen3 8B Q4_K_M

5.03 Go

Non mesuré

R1 0528 (Qwen3) 8B Q4_K_M

5.03 Go

Non mesuré

Ministral 3 8B Q4_K_M

5.2 Go

Non mesuré

Gemma 4 E4B Q4_K_M

5.41 Go

Non mesuré

Gemma 2 9B Q4_K_M

5.76 Go

Non mesuré

Qwen3.5 9B Q4_K_M

6.17 Go

Ne tient pas en VRAM

Gemma 4 12B Q4_K_M

7.66 Go

Ne tient pas en VRAM

Ministral 3 14B Q4_K_M

8.24 Go

Ne tient pas en VRAM

Qwen2.5 14B Instruct Q4_K_M

8.99 Go

Ne tient pas en VRAM

DeepSeek R1 Distill Qwen 14B Q4_K_M

8.99 Go

Ne tient pas en VRAM

Qwen2.5 Coder 14B Q4_K_M

8.99 Go

Ne tient pas en VRAM

Qwen3 14B Q4_K_M

9 Go

Ne tient pas en VRAM

Phi-4 Q4_K_M

9.05 Go

Ne tient pas en VRAM

Coder V2 Lite 16B-A2.4B Q4_K_M

10.36 Go

Ne tient pas en VRAM

Fluide ≥ 60 tok/s (plus vite qu'on ne lit) · Confortable 30-60 · Lent < 30 · « Ne tient pas » = taille du modèle + 2 Go de marge > VRAM (le déchargement CPU est exclu du protocole : les chiffres n'auraient plus de sens).

Mesures par modèle

Aucun run pour cette carte. À toi de jouer : lancer le bench.

VRAM utilisée = pic de mémoire GPU système pendant le run (inclut l'OS, compte ~0,5 à 1 Go de plus que le modèle seul).