Meta
Llama 4
MoEvision
Choisissez une taille : la mémoire vidéo indiquée correspond au fichier Q4_K_M (la quantisation du protocole) plus environ 1,5 Go pour un contexte de 4 000 tokens.
Scout 109B-A17B
> 32 Go- Paramètres
- 108,6 Md · 17 Md actifs
- Fichier Q4_K_M
- 62,9 Go
- VRAM conseillée
- ≥ 64,4 Go
- Contexte max
- 10 485 760
Pas encore mesuré
Maverick 400B-A17B
> 32 Go- Paramètres
- 401,6 Md · 17 Md actifs
- Fichier Q4_K_M
- 226,1 Go
- VRAM conseillée
- ≥ 227,6 Go
- Contexte max
- 1 048 576
Pas encore mesuré
MoE (« 30B-A3B ») : toute la mémoire d'un 30B, mais la vitesse d'un modèle de 3 Md de paramètres actifs. « > 32 Go » : plusieurs cartes, ou une partie du modèle en mémoire système (bien plus lent).