Meta

Llama 4

MoEvision

Choisissez une taille : la mémoire vidéo indiquée correspond au fichier Q4_K_M (la quantisation du protocole) plus environ 1,5 Go pour un contexte de 4 000 tokens.

Scout 109B-A17B

> 32 Go
Paramètres
108,6 Md · 17 Md actifs
Fichier Q4_K_M
62,9 Go
VRAM conseillée
≥ 64,4 Go
Contexte max
10 485 760

Pas encore mesuré

Maverick 400B-A17B

> 32 Go
Paramètres
401,6 Md · 17 Md actifs
Fichier Q4_K_M
226,1 Go
VRAM conseillée
≥ 227,6 Go
Contexte max
1 048 576

Pas encore mesuré

MoE (« 30B-A3B ») : toute la mémoire d'un 30B, mais la vitesse d'un modèle de 3 Md de paramètres actifs. « > 32 Go » : plusieurs cartes, ou une partie du modèle en mémoire système (bien plus lent).