← Tous les modèlesTEST DU MODÈLE

Puis-je faire tourner Ministral 3 3B ?

Ministral 3 3B de Mistral AI demande environ 4 GB de RAM avec la quantisation 4 bits recommandée (1.8 GB à télécharger). Votre matériel est vérifié ci-dessous — instantanément, rien ne quitte votre navigateur. Comptez environ ~168 tok/s sur un NVIDIA RTX 3060 12GB.

Lecture des signaux matériels…

Notes pratiques

Le Ministral 3 3B est la réponse de Mistral à la question "quel est le plus petit modèle qui ressemble encore à un vrai assistant ?". Avec 3B de paramètres, il est conçu pour le chat et des tâches légères de vision sur le matériel que vous possédez déjà. Une quantification en 4 bits tient autour de 1.8 GB, et vous pouvez réduire la version q2 à 1.3 GB si vous êtes vraiment à court d'espace. Avec seulement 4 GB de RAM au minimum, il tourne sur un ordinateur portable d'entrée de gamme, un vieux GPU de 4 GB ou n'importe quel Mac Apple Silicon sans que vous ayez à vous soucier de la mémoire. C'est le modèle vers lequel on se tourne quand un plus gros ne rentre pas.

À l'usage quotidien, c'est la vitesse qui marque le plus. Sur une RTX 3060, vous voyez environ 168 tokens par seconde, un M-series Max approche les 192 tok/s, et une 4090 atteint près de 471 tok/s - le tout bien plus rapide que ce que vous pouvez lire, si bien que les réponses semblent instantanées. En CPU seul sur de la DDR5, vous obtenez encore ~28 tok/s, ce qui reste utilisable pour du traitement par lots. La fenêtre de contexte est généreuse à 256K, mais voyez-la comme un plafond. La remplir devient vite coûteux : à 128K de contexte, la charge mémoire totale grimpe à environ 12.6 GB, bien au-delà de l'empreinte du modèle lui-même - gardez donc un contexte de travail modeste sur les petites machines.

Pour être honnête, en 3B vous échangez un peu de profondeur contre cette vitesse et cette empreinte minuscule. Mistral 7B tient généralement mieux sur du raisonnement plus difficile et de longues chaînes d'instructions, et Mistral Nemo 12B reprend nettement l'avantage si vous avez de la mémoire à revendre. Là où le Ministral 3 3B gagne, c'est dans la combinaison d'un débit brut et du fait qu'il gère aussi la vision - ce que les plus gros Mistral, dédiés uniquement au chat, ne font pas. Il est distribué sous licence Apache 2.0, vous pouvez donc l'utiliser commercialement sans aucune contrainte. Pour un petit modèle rapide, gratuit et polyvalent, il mérite sa place.

Caractéristiques

Paramètres3B
Fenêtre de contexte256K tokens
ÉditeurMistral AI
LicenceApache 2.0
Sortie2025-12
Idéal pourChat, Vision

Taille selon la quantisation

QuantisationBits/poidsTéléchargementRAM min.Qualité
Q2_K3.351.3 GB4 GBPerte sensible
Q4_K_MRecommandée4.851.8 GB4 GBRecommandée
Q5_K_M5.652.1 GB6 GBÉlevée
Q8_08.53.2 GB6 GBQuasi originale
F16166.0 GB12 GBOriginale

Les tailles sont estimées à partir du nombre de paramètres × bits par poids ; les builds GGUF réels varient légèrement. · Données mises à jour: 2026-06-11 · Comment nous calculons ces chiffres →

Mémoire nécessaire selon la longueur de contexte

ContexteCache KV (est.)Mémoire totale (Q4)
4K tokens~0.3 GB~2.1 GB
8K tokens~0.7 GB~2.5 GB
32K tokens~2.7 GB~4.5 GB
128K tokens~10.8 GB~12.6 GB

Le cache KV grossit avec la longueur du contexte — un modèle qui tient à 4K peut manquer de mémoire à 32K. Les estimations supposent un cache FP16 avec grouped-query attention ; l'usage réel varie selon le runtime.

Vitesse estimée selon le matériel

MatérielBande passante~Vitesse
NVIDIA RTX 3060 12GB360 GB/s~168 tok/s
NVIDIA RTX 4090 24GB1008 GB/s~471 tok/s
Apple M-series (base)100 GB/s~47 tok/s
Apple M-series Pro270 GB/s~126 tok/s
Apple M-series Max410 GB/s~192 tok/s
CPU only (dual-channel DDR5)60 GB/s~28 tok/s

La génération de tokens est limitée par la bande passante mémoire : tok/s ≈ bande passante × 0,85 ÷ taille du modèle en Q4. Les chiffres réels varient selon le runtime et la longueur du contexte.

Le faire tourner en local

Le chemin le plus simple est Ollama — une commande et vous discutez :

ollama run ministral-3:3b

Questions fréquentes

Configuration requise pour Ministral 3 3B — Puis-je le faire tourner en local ?