DeepSeek
R1 Distill
raisonnement
Choisissez une taille : la mémoire vidéo indiquée correspond au fichier Q4_K_M (la quantisation du protocole) plus environ 1,5 Go pour un contexte de 4 000 tokens.
1.5B Qwen
carte 8 Go- Paramètres
- 1,8 Md
- Fichier Q4_K_M
- 1,0 Go
- VRAM conseillée
- ≥ 2,5 Go
- Contexte max
- 131 072
Pas encore mesuré
7B Qwen
carte 8 Go- Paramètres
- 7,6 Md
- Fichier Q4_K_M
- 4,4 Go
- VRAM conseillée
- ≥ 5,9 Go
- Contexte max
- 131 072
Pas encore mesuré
8B Llama
carte 8 Go- Paramètres
- 8 Md
- Fichier Q4_K_M
- 4,6 Go
- VRAM conseillée
- ≥ 6,1 Go
- Contexte max
- 131 072
Pas encore mesuré
14B Qwen
carte 12 Go- Paramètres
- 14,8 Md
- Fichier Q4_K_M
- 8,4 Go
- VRAM conseillée
- ≥ 9,9 Go
- Contexte max
- 131 072
Pas encore mesuré
32B Qwen
carte 24 Go- Paramètres
- 32,8 Md
- Fichier Q4_K_M
- 18,5 Go
- VRAM conseillée
- ≥ 20,0 Go
- Contexte max
- 131 072
Pas encore mesuré
70B Llama
> 32 Go- Paramètres
- 70,6 Md
- Fichier Q4_K_M
- 39,6 Go
- VRAM conseillée
- ≥ 41,1 Go
- Contexte max
- 131 072
Pas encore mesuré
MoE (« 30B-A3B ») : toute la mémoire d'un 30B, mais la vitesse d'un modèle de 3 Md de paramètres actifs. « > 32 Go » : plusieurs cartes, ou une partie du modèle en mémoire système (bien plus lent).