Alibaba

Qwen3

raisonnementMoE

Choisissez une taille : la mémoire vidéo indiquée correspond au fichier Q4_K_M (la quantisation du protocole) plus environ 1,5 Go pour un contexte de 4 000 tokens.

0.6B

carte 8 Go
Paramètres
0,8 Md
Fichier Q4_K_M
0,5 Go
VRAM conseillée
≥ 2,0 Go
Contexte max
40 960

Pas encore mesuré

1.7B

carte 8 Go
Paramètres
2 Md
Fichier Q4_K_M
1,2 Go
VRAM conseillée
≥ 2,7 Go
Contexte max
40 960

Pas encore mesuré

4B

carte 8 Go
Paramètres
4 Md
Fichier Q4_K_M
2,3 Go
VRAM conseillée
≥ 3,8 Go
Contexte max
40 960

Pas encore mesuré

8B

carte 8 Go
Paramètres
8,2 Md
Fichier Q4_K_M
4,7 Go
VRAM conseillée
≥ 6,2 Go
Contexte max
40 960

Pas encore mesuré

14B

carte 12 Go
Paramètres
14,8 Md
Fichier Q4_K_M
8,4 Go
VRAM conseillée
≥ 9,9 Go
Contexte max
40 960

Pas encore mesuré

32B

carte 24 Go
Paramètres
32,8 Md
Fichier Q4_K_M
18,4 Go
VRAM conseillée
≥ 19,9 Go
Contexte max
40 960

Pas encore mesuré

30B-A3B

carte 24 Go
Paramètres
30,5 Md · 3 Md actifs
Fichier Q4_K_M
17,4 Go
VRAM conseillée
≥ 18,9 Go
Contexte max
40 960

Pas encore mesuré

235B-A22B

> 32 Go
Paramètres
235,1 Md · 22 Md actifs
Fichier Q4_K_M
132,4 Go
VRAM conseillée
≥ 133,9 Go
Contexte max
40 960

Pas encore mesuré

MoE (« 30B-A3B ») : toute la mémoire d'un 30B, mais la vitesse d'un modèle de 3 Md de paramètres actifs. « > 32 Go » : plusieurs cartes, ou une partie du modèle en mémoire système (bien plus lent).