Family Qwen Meta Llama Google Gemma DeepSeek Mistral Microsoft Phi gpt-oss GLM NVIDIA Nemotron IBM Granite Petits modèles Version DeepSeek V4 Flash R1 0528 (Qwen3) R1 / V3 R1 Distill Coder V2 Lite Size 1.5B Qwen · 1,0 Go 7B Qwen · 4,4 Go 8B Llama · 4,6 Go 14B Qwen · 8,4 Go 32B Qwen · 18,5 Go 70B Llama · 39,6 Go
Cards (1/4) · click = add a column for this model
Vendor NVIDIA Chip Pick a chip… RTX 3050 · 8 Go · no reference RTX 3050 Laptop GPU · 4 Go · does not fit RTX 3050 Ti Laptop GPU · 4 Go · does not fit RTX 3060 · 12 Go · no reference RTX 3060 Laptop GPU · 6 Go · does not fit RTX 3060 Ti · 8 Go · no reference RTX 3070 · 8 Go · no reference RTX 3070 Laptop GPU · 8 Go · no reference RTX 3070 Ti · 8 Go · no reference RTX 3070 Ti Laptop GPU · 8 Go · no reference RTX 3080 · 10 Go · no reference RTX 3080 Laptop GPU · 8 Go · no reference RTX 3080 Ti · 12 Go · no reference RTX 3080 Ti Laptop GPU · 16 Go · no reference RTX 3090 · 24 Go · no reference RTX 3090 Ti · 24 Go · no reference RTX 4050 Laptop GPU · 6 Go · does not fit RTX 4060 · 8 Go · no reference RTX 4060 Laptop GPU · 8 Go · no reference RTX 4060 Ti · 8 Go · no reference RTX 4070 · 12 Go · no reference RTX 4070 Laptop GPU · 8 Go · no reference RTX 4070 SUPER · 12 Go · no reference RTX 4070 Ti · 12 Go · ≈ 91,9 tok/s RTX 4070 Ti SUPER · 16 Go · no reference RTX 4080 · 16 Go · no reference RTX 4080 Laptop GPU · 12 Go · no reference RTX 4080 SUPER · 16 Go · no reference RTX 4090 · 24 Go · no reference RTX 4090 Laptop GPU · 16 Go · no reference RTX 5050 · 8 Go · no reference RTX 5050 Laptop GPU · 8 Go · no reference RTX 5060 · 8 Go · no reference RTX 5060 Laptop GPU · 8 Go · no reference RTX 5060 Ti · 16 Go · no reference RTX 5070 · 12 Go · no reference RTX 5070 Laptop GPU · 8 Go · no reference RTX 5070 Ti · 16 Go · ≈ 151 tok/s RTX 5070 Ti Laptop GPU · 12 Go · no reference RTX 5080 · 16 Go · no reference RTX 5080 Laptop GPU · 16 Go · no reference RTX 5090 · 32 Go · no reference RTX 5090 Laptop GPU · 24 Go · no reference
RTX 5070 Ti 16 Go ≈ 151 tok/s
green = measured · orange = estimated · switch models between additions to compare different models.