Simulateur
Ressentir la vitesse, avant d'acheter Un chiffre ne dit pas grand-chose : 90 tokens/s, c'est rapide ou pas ? Choisis un modèle, ajoute des cartes — et même d'autres modèles — puis regarde la même réponse s'écrire à la vitesse de chaque combinaison.
Simulation : texte pré-écrit, rejoué à la vitesse mesurée en base — ou estimée quand la combinaison n'a pas encore été mesurée (colonne marquée « estimé »). Aucun LLM ne tourne ici.
Famille Qwen Meta Llama Google Gemma DeepSeek Mistral Microsoft Phi gpt-oss GLM NVIDIA Nemotron IBM Granite Petits modèles Version Phi-4 reasoning Phi-4 Phi-3.5 Taille mini 3.8B · 2,2 Go
Cartes (0/4) · clic = ajouter une colonne pour ce modèle
Constructeur NVIDIA Puce Choisir une puce… RTX 3050 · 8 Go · aucune référence RTX 3050 Laptop GPU · 4 Go · aucune référence RTX 3050 Ti Laptop GPU · 4 Go · aucune référence RTX 3060 · 12 Go · aucune référence RTX 3060 Laptop GPU · 6 Go · aucune référence RTX 3060 Ti · 8 Go · aucune référence RTX 3070 · 8 Go · aucune référence RTX 3070 Laptop GPU · 8 Go · aucune référence RTX 3070 Ti · 8 Go · aucune référence RTX 3070 Ti Laptop GPU · 8 Go · aucune référence RTX 3080 · 10 Go · aucune référence RTX 3080 Laptop GPU · 8 Go · aucune référence RTX 3080 Ti · 12 Go · aucune référence RTX 3080 Ti Laptop GPU · 16 Go · aucune référence RTX 3090 · 24 Go · aucune référence RTX 3090 Ti · 24 Go · aucune référence RTX 4050 Laptop GPU · 6 Go · aucune référence RTX 4060 · 8 Go · aucune référence RTX 4060 Laptop GPU · 8 Go · aucune référence RTX 4060 Ti · 8 Go · aucune référence RTX 4070 · 12 Go · aucune référence RTX 4070 Laptop GPU · 8 Go · aucune référence RTX 4070 SUPER · 12 Go · aucune référence RTX 4070 Ti · 12 Go · ≈ 165 tok/s RTX 4070 Ti SUPER · 16 Go · aucune référence RTX 4080 · 16 Go · aucune référence RTX 4080 Laptop GPU · 12 Go · aucune référence RTX 4080 SUPER · 16 Go · aucune référence RTX 4090 · 24 Go · aucune référence RTX 4090 Laptop GPU · 16 Go · aucune référence RTX 5050 · 8 Go · aucune référence RTX 5050 Laptop GPU · 8 Go · aucune référence RTX 5060 · 8 Go · aucune référence RTX 5060 Laptop GPU · 8 Go · aucune référence RTX 5060 Ti · 16 Go · aucune référence RTX 5070 · 12 Go · aucune référence RTX 5070 Laptop GPU · 8 Go · aucune référence RTX 5070 Ti · 16 Go · ≈ 234 tok/s RTX 5070 Ti Laptop GPU · 12 Go · aucune référence RTX 5080 · 16 Go · aucune référence RTX 5080 Laptop GPU · 16 Go · aucune référence RTX 5090 · 32 Go · aucune référence RTX 5090 Laptop GPU · 24 Go · aucune référence
vert = mesuré · orange = estimé · change de modèle entre deux ajouts pour comparer des modèles différents.
Lancer la simulationMême réponse (705 tokens), à la vitesse de chaque colonne
Choisis un modèle puis une ou plusieurs cartes pour ouvrir les colonnes.
TokenBench · V1.0 · Mesures réalisées avec llama.cpp
Confidentialité et cookies