DeepSeek

R1 Distill

raisonnement

Choisissez une taille : la mémoire vidéo indiquée correspond au fichier Q4_K_M (la quantisation du protocole) plus environ 1,5 Go pour un contexte de 4 000 tokens.

1.5B Qwen

carte 8 Go
Paramètres
1,8 Md
Fichier Q4_K_M
1,0 Go
VRAM conseillée
≥ 2,5 Go
Contexte max
131 072

Pas encore mesuré

7B Qwen

carte 8 Go
Paramètres
7,6 Md
Fichier Q4_K_M
4,4 Go
VRAM conseillée
≥ 5,9 Go
Contexte max
131 072

Pas encore mesuré

8B Llama

carte 8 Go
Paramètres
8 Md
Fichier Q4_K_M
4,6 Go
VRAM conseillée
≥ 6,1 Go
Contexte max
131 072

Pas encore mesuré

14B Qwen

carte 12 Go
Paramètres
14,8 Md
Fichier Q4_K_M
8,4 Go
VRAM conseillée
≥ 9,9 Go
Contexte max
131 072

Pas encore mesuré

32B Qwen

carte 24 Go
Paramètres
32,8 Md
Fichier Q4_K_M
18,5 Go
VRAM conseillée
≥ 20,0 Go
Contexte max
131 072

Pas encore mesuré

70B Llama

> 32 Go
Paramètres
70,6 Md
Fichier Q4_K_M
39,6 Go
VRAM conseillée
≥ 41,1 Go
Contexte max
131 072

Pas encore mesuré

MoE (« 30B-A3B ») : toute la mémoire d'un 30B, mais la vitesse d'un modèle de 3 Md de paramètres actifs. « > 32 Go » : plusieurs cartes, ou une partie du modèle en mémoire système (bien plus lent).