Google

Gemma 3

vision

Choisissez une taille : la mémoire vidéo indiquée correspond au fichier Q4_K_M (la quantisation du protocole) plus environ 1,5 Go pour un contexte de 4 000 tokens.

270M

carte 8 Go
Paramètres
0,3 Md
Fichier Q4_K_M
0,2 Go
VRAM conseillée
≥ 1,7 Go
Contexte max
32 768

Pas encore mesuré

1B

carte 8 Go
Paramètres
1 Md
Fichier Q4_K_M
0,8 Go
VRAM conseillée
≥ 2,3 Go
Contexte max
32 768

Pas encore mesuré

4B

carte 8 Go
Paramètres
4,3 Md
Fichier Q4_K_M
2,3 Go
VRAM conseillée
≥ 3,8 Go
Contexte max
131 072

Pas encore mesuré

12B

carte 12 Go
Paramètres
12,2 Md
Fichier Q4_K_M
6,8 Go
VRAM conseillée
≥ 8,3 Go
Contexte max
131 072

Pas encore mesuré

27B

carte 24 Go
Paramètres
27,4 Md
Fichier Q4_K_M
15,4 Go
VRAM conseillée
≥ 16,9 Go
Contexte max
131 072

Pas encore mesuré

MoE (« 30B-A3B ») : toute la mémoire d'un 30B, mais la vitesse d'un modèle de 3 Md de paramètres actifs. « > 32 Go » : plusieurs cartes, ou une partie du modèle en mémoire système (bien plus lent).