Family Qwen Meta Llama Google Gemma DeepSeek Mistral Microsoft Phi gpt-oss GLM NVIDIA Nemotron IBM Granite Petits modèles Version Qwen3.8 Qwen3.6 Qwen3.5 Qwen3 Coder Qwen3 2507 Qwen3 QwQ Qwen2.5 Coder Qwen2.5 Size 0.5B · 0,4 Go 1.5B · 0,9 Go 3B · 1,8 Go 7B · 4,4 Go 14B · 8,4 Go 32B · 18,5 Go 72B · 44,2 Go
Cards (1/4) · click = add a column for this model
Vendor NVIDIA Chip Pick a chip… RTX 3050 · 8 Go · no reference RTX 3050 Laptop GPU · 4 Go · no reference RTX 3050 Ti Laptop GPU · 4 Go · no reference RTX 3060 · 12 Go · no reference RTX 3060 Laptop GPU · 6 Go · no reference RTX 3060 Ti · 8 Go · no reference RTX 3070 · 8 Go · no reference RTX 3070 Laptop GPU · 8 Go · no reference RTX 3070 Ti · 8 Go · no reference RTX 3070 Ti Laptop GPU · 8 Go · no reference RTX 3080 · 10 Go · no reference RTX 3080 Laptop GPU · 8 Go · no reference RTX 3080 Ti · 12 Go · no reference RTX 3080 Ti Laptop GPU · 16 Go · no reference RTX 3090 · 24 Go · no reference RTX 3090 Ti · 24 Go · no reference RTX 4050 Laptop GPU · 6 Go · no reference RTX 4060 · 8 Go · no reference RTX 4060 Laptop GPU · 8 Go · no reference RTX 4060 Ti · 8 Go · no reference RTX 4070 · 12 Go · no reference RTX 4070 Laptop GPU · 8 Go · no reference RTX 4070 SUPER · 12 Go · no reference RTX 4070 Ti · 12 Go · ≈ 372 tok/s RTX 4070 Ti SUPER · 16 Go · no reference RTX 4080 · 16 Go · no reference RTX 4080 Laptop GPU · 12 Go · no reference RTX 4080 SUPER · 16 Go · no reference RTX 4090 · 24 Go · no reference RTX 4090 Laptop GPU · 16 Go · no reference RTX 5050 · 8 Go · no reference RTX 5050 Laptop GPU · 8 Go · no reference RTX 5060 · 8 Go · no reference RTX 5060 Laptop GPU · 8 Go · no reference RTX 5060 Ti · 16 Go · no reference RTX 5070 · 12 Go · no reference RTX 5070 Laptop GPU · 8 Go · no reference RTX 5070 Ti · 16 Go · 481 tok/s RTX 5070 Ti Laptop GPU · 12 Go · no reference RTX 5080 · 16 Go · no reference RTX 5080 Laptop GPU · 16 Go · no reference RTX 5090 · 32 Go · no reference RTX 5090 Laptop GPU · 24 Go · no reference
RTX 4070 Ti 12 Go ≈ 372 tok/s
green = measured · orange = estimated · switch models between additions to compare different models.