Gemma 4
visionMoE
Choisissez une taille : la mémoire vidéo indiquée correspond au fichier Q4_K_M (la quantisation du protocole) plus environ 1,5 Go pour un contexte de 4 000 tokens.
E2B
carte 8 Go- Paramètres
- 5,1 Md
- Fichier Q4_K_M
- 3,2 Go
- VRAM conseillée
- ≥ 4,7 Go
- Contexte max
- 131 072
Pas encore mesuré
E4B
carte 8 Go- Paramètres
- 8 Md
- Fichier Q4_K_M
- 5,0 Go
- VRAM conseillée
- ≥ 6,5 Go
- Contexte max
- 131 072
Pas encore mesuré
12B
carte 12 Go- Paramètres
- 12 Md
- Fichier Q4_K_M
- 7,1 Go
- VRAM conseillée
- ≥ 8,6 Go
- Contexte max
- 262 144
Pas encore mesuré
26B-A4B
carte 24 Go- Paramètres
- 25,8 Md · 4 Md actifs
- Fichier Q4_K_M
- 15,9 Go
- VRAM conseillée
- ≥ 17,4 Go
- Contexte max
- 262 144
Pas encore mesuré
31B
carte 24 Go- Paramètres
- 31,3 Md
- Fichier Q4_K_M
- 18,3 Go
- VRAM conseillée
- ≥ 19,8 Go
- Contexte max
- 262 144
Pas encore mesuré
MoE (« 30B-A3B ») : toute la mémoire d'un 30B, mais la vitesse d'un modèle de 3 Md de paramètres actifs. « > 32 Go » : plusieurs cartes, ou une partie du modèle en mémoire système (bien plus lent).