Google

Gemma 4

visionMoE

Choisissez une taille : la mémoire vidéo indiquée correspond au fichier Q4_K_M (la quantisation du protocole) plus environ 1,5 Go pour un contexte de 4 000 tokens.

E2B

carte 8 Go
Paramètres
5,1 Md
Fichier Q4_K_M
3,2 Go
VRAM conseillée
≥ 4,7 Go
Contexte max
131 072

Pas encore mesuré

E4B

carte 8 Go
Paramètres
8 Md
Fichier Q4_K_M
5,0 Go
VRAM conseillée
≥ 6,5 Go
Contexte max
131 072

Pas encore mesuré

12B

carte 12 Go
Paramètres
12 Md
Fichier Q4_K_M
7,1 Go
VRAM conseillée
≥ 8,6 Go
Contexte max
262 144

Pas encore mesuré

26B-A4B

carte 24 Go
Paramètres
25,8 Md · 4 Md actifs
Fichier Q4_K_M
15,9 Go
VRAM conseillée
≥ 17,4 Go
Contexte max
262 144

Pas encore mesuré

31B

carte 24 Go
Paramètres
31,3 Md
Fichier Q4_K_M
18,3 Go
VRAM conseillée
≥ 19,8 Go
Contexte max
262 144

Pas encore mesuré

MoE (« 30B-A3B ») : toute la mémoire d'un 30B, mais la vitesse d'un modèle de 3 Md de paramètres actifs. « > 32 Go » : plusieurs cartes, ou une partie du modèle en mémoire système (bien plus lent).