Aller au contenu
Abonnement IAElevenLabs — ElevenLabs6 €/moisVoir l'offrePublicité · prix mis à jour automatiquement
Accueil > Intelligence artificielle > IA en local

Quelle IA peut tourner sur mon PC ?

Réponse rapide. C'est la VRAM de votre carte graphique qui décide — ni votre mémoire vive, ni votre processeur. On peut avoir 128 Go de RAM et ne pas faire tourner un modèle qu'une carte de 16 Go avale sans effort. Donnez votre carte ci-dessous : vous saurez ce qui tourne chez vous, en quelle qualité, avec quel logiciel — et si vous avez le droit de vendre ce que vous produisez avec.

Mis à jour le

La mémoire de votre carte graphique décide de tout. Un modèle doit y tenir en entier pour répondre vite. Votre mémoire vive ne vient qu'en second, quand ça déborde — et votre processeur en dernier.

Tout effacer

Avec 12 Go de mémoire vidéo, 455 modèles de notre catalogue tiennent dans votre carte — le meilleur étant Qwen3.5-27B en 4 bits.
Il manque votre mémoire vive — et sur votre carte, elle change tout. 270 modèles sont annoncés hors de portée ci-dessous. Mais un modèle trop gros pour la carte tourne quand même en débordant sur la mémoire vive : plus lentement, et c'est tout.

Renseignez le champ « Votre mémoire vive » ci-dessus, et cette page vous dira lesquels passent malgré tout. Sur une carte de 4 Go, ça fait la différence entre aucun modèle et sept.

Modèles 1 à 60 sur 455 qui tiennent · page 1 sur 8

Classés par le meilleur modèle qui tient chez vous, pas par le plus économe dans l'absolu — c'est toute la différence avec les classements qui conseillent un modèle minuscule à une grosse carte.
Modèle Taille Il faut Chez vous Pour quoi faire Usage commercial
Qwen3.5-27B Alibaba indice 23
Où le téléchargerLe dépôt officiel sur Hugging FaceLe poids du fichier est la mémoire qu'il réclame : une version plus légère tourne sur une plus petite carte.
plancher éditeur 8,6 Go en 4 bits Tient largement Il reste de la place pour un contexte long et pour travailler à côté. LLM Texte avec LM Studio ou Ollama Ouvert vérifiez la licence exacte du modèle avant de vendre
K2 Horizon 7B MBZUAI Institute of Foundation Models indice 21 9 Md 5,2 Go en 4 bits Tient largement Il reste de la place pour un contexte long et pour travailler à côté. LLM Texte avec LM Studio ou Ollama Ouvert vérifiez la licence exacte du modèle avant de vendre
Annoncé 7 milliards, mais le dépôt IFM/K2-Horizon-7B en compte 9,00 : c'est ce qui occupe la mémoire.
Qwen3.6-35B-A3B Alibaba indice 18
Où le téléchargerLe dépôt officiel sur Hugging FaceLe poids du fichier est la mémoire qu'il réclame : une version plus légère tourne sur une plus petite carte.
plancher éditeur 10,1 Go en 4 bits Tient largement Il reste de la place pour un contexte long et pour travailler à côté. LLM Texte avec LM Studio ou Ollama Ouvert vérifiez la licence exacte du modèle avant de vendre
gemma-4-26B-A4B-it Google indice 17
Où le téléchargerLe dépôt officiel sur Hugging FaceLe poids du fichier est la mémoire qu'il réclame : une version plus légère tourne sur une plus petite carte.
plancher éditeur 9,9 Go en 4 bits Tient largement Il reste de la place pour un contexte long et pour travailler à côté. LLM Texte avec LM Studio ou Ollama Ouvert vérifiez la licence exacte du modèle avant de vendre
K2 Horizon 3.7B MBZUAI Institute of Foundation Models indice 16 5,06 Md 5,8 Go en 8 bits Tient largement Il reste de la place pour un contexte long et pour travailler à côté. LLM Texte avec LM Studio ou Ollama Ouvert vérifiez la licence exacte du modèle avant de vendre
Annoncé 3,7 milliards, mais le dépôt IFM/K2-Horizon-3.7B en compte 5,06 : c'est ce qui occupe la mémoire.
Ling-3.0-tiny inclusionAI indice 15
Où le téléchargerLe dépôt officiel sur Hugging FaceLe poids du fichier est la mémoire qu'il réclame : une version plus légère tourne sur une plus petite carte.
7,89 Md 9,1 Go en 8 bits Tient largement Il reste de la place pour un contexte long et pour travailler à côté. LLM Texte avec LM Studio ou Ollama Ouvert vérifiez la licence exacte du modèle avant de vendre
Qwen3.5-9B Alibaba indice 14
Où le téléchargerLe dépôt officiel sur Hugging FaceLe poids du fichier est la mémoire qu'il réclame : une version plus légère tourne sur une plus petite carte.
plancher éditeur 3,2 Go en 4 bits Tient largement Il reste de la place pour un contexte long et pour travailler à côté. Multimodal avec LM Studio ou Ollama Ouvert vérifiez la licence exacte du modèle avant de vendre
Qwen3.5-4B Alibaba indice 13
Où le téléchargerLe dépôt officiel sur Hugging FaceLe poids du fichier est la mémoire qu'il réclame : une version plus légère tourne sur une plus petite carte.
4,66 Md 5,4 Go en 8 bits Tient largement Il reste de la place pour un contexte long et pour travailler à côté. LLM Texte avec LM Studio ou Ollama Ouvert vérifiez la licence exacte du modèle avant de vendre
MiniCPM5-2B OpenBMB indice 12 2,52 Md 5,8 Go en pleine précision Tient largement Il reste de la place pour un contexte long et pour travailler à côté. LLM Texte avec LM Studio ou Ollama Ouvert vérifiez la licence exacte du modèle avant de vendre
Dépôt openbmb/MiniCPM5-2B : 2,52 milliards, un peu plus que les 2 du nom.
G9v3-3B AI9Stars indice 11 2,99 Md 6,9 Go en pleine précision Tient largement Il reste de la place pour un contexte long et pour travailler à côté. LLM Texte avec LM Studio ou Ollama Ouvert vérifiez la licence exacte du modèle avant de vendre
gpt-oss-20b OpenAI indice 10
Où le téléchargerLe dépôt officiel sur Hugging FaceLe poids du fichier est la mémoire qu'il réclame : une version plus légère tourne sur une plus petite carte.
21,51 Md 12,4 Go en 4 bits Tient, mais juste Ça entre. Réduisez le contexte si vous voyez des ralentissements, et fermez les jeux et navigateurs qui mangent de la mémoire vidéo. LLM Texte avec LM Studio ou Ollama Ouvert vérifiez la licence exacte du modèle avant de vendre
Le petit frere du gpt-oss 120B deja au catalogue.
gemma-4-E4B-it Google indice 9
Où le téléchargerLe dépôt officiel sur Hugging FaceLe poids du fichier est la mémoire qu'il réclame : une version plus légère tourne sur une plus petite carte.
8 Md 9,2 Go en 8 bits Tient largement Il reste de la place pour un contexte long et pour travailler à côté. Multimodal avec LM Studio ou Ollama Ouvert vérifiez la licence exacte du modèle avant de vendre
Granite 4.2 3B IBM indice 9 3,66 Md 8,4 Go en pleine précision Tient largement Il reste de la place pour un contexte long et pour travailler à côté. LLM Texte avec LM Studio ou Ollama Ouvert vérifiez la licence exacte du modèle avant de vendre
MiniCPM5-1B OpenBMB indice 9
Où le téléchargerLe dépôt officiel sur Hugging FaceLe poids du fichier est la mémoire qu'il réclame : une version plus légère tourne sur une plus petite carte.
plancher éditeur 0,6 Go en 4 bits Tient largement Il reste de la place pour un contexte long et pour travailler à côté. Multimodal avec LM Studio ou Ollama Ouvert vérifiez la licence exacte du modèle avant de vendre
gemma-4-E2B-it Google indice 8
Où le téléchargerLe dépôt officiel sur Hugging FaceLe poids du fichier est la mémoire qu'il réclame : une version plus légère tourne sur une plus petite carte.
5,12 Md 5,9 Go en 8 bits Tient largement Il reste de la place pour un contexte long et pour travailler à côté. Multimodal avec LM Studio ou Ollama Ouvert vérifiez la licence exacte du modèle avant de vendre
LFM2.5-2.6B Liquid AI indice 8 2,7 Md 6,2 Go en pleine précision Tient largement Il reste de la place pour un contexte long et pour travailler à côté. LLM Texte avec LM Studio ou Ollama Ouvert vérifiez la licence exacte du modèle avant de vendre
Qwen3-VL-32B-Instruct Alibaba indice 8
Où le téléchargerLe dépôt officiel sur Hugging FaceLe poids du fichier est la mémoire qu'il réclame : une version plus légère tourne sur une plus petite carte.
plancher éditeur 8,9 Go en 4 bits Tient largement Il reste de la place pour un contexte long et pour travailler à côté. Multimodal avec LM Studio ou Ollama Ouvert vérifiez la licence exacte du modèle avant de vendre
granite-4.1-8b IBM indice 7
Où le téléchargerLe dépôt officiel sur Hugging FaceLe poids du fichier est la mémoire qu'il réclame : une version plus légère tourne sur une plus petite carte.
8,79 Md 10,1 Go en 8 bits Tient largement Il reste de la place pour un contexte long et pour travailler à côté. LLM Texte avec LM Studio ou Ollama Ouvert vérifiez la licence exacte du modèle avant de vendre
Qwen3-VL-8B-Instruct Alibaba indice 7
Où le téléchargerLe dépôt officiel sur Hugging FaceLe poids du fichier est la mémoire qu'il réclame : une version plus légère tourne sur une plus petite carte.
plancher éditeur 2,3 Go en 4 bits Tient largement Il reste de la place pour un contexte long et pour travailler à côté. Multimodal avec LM Studio ou Ollama Ouvert vérifiez la licence exacte du modèle avant de vendre
Phi-4 Microsoft indice 6
Où le téléchargerLe dépôt officiel sur Hugging FaceLe poids du fichier est la mémoire qu'il réclame : une version plus légère tourne sur une plus petite carte.
14 Md 8,1 Go en 4 bits Tient largement Il reste de la place pour un contexte long et pour travailler à côté. LLM Texte avec LM Studio ou Ollama Ouvert vérifiez la licence exacte du modèle avant de vendre
Petit modèle taillé pour le raisonnement et le code. C'est l'exemple type du modèle qu'on spécialise avec un RAG ou un LoRA plutôt que d'aller chercher plus gros.
Phi-4-mini Microsoft indice 6
Où le téléchargerLe dépôt officiel sur Hugging FaceLe poids du fichier est la mémoire qu'il réclame : une version plus légère tourne sur une plus petite carte.
plancher éditeur 2,5 Go en 4 bits Tient largement Il reste de la place pour un contexte long et pour travailler à côté. LLM Texte avec LM Studio ou Ollama Ouvert vérifiez la licence exacte du modèle avant de vendre
Qwen2.5-Coder-7B-Instruct Alibaba indice 6
Où le téléchargerLe dépôt officiel sur Hugging FaceLe poids du fichier est la mémoire qu'il réclame : une version plus légère tourne sur une plus petite carte.
7 Md 8,1 Go en 8 bits Tient largement Il reste de la place pour un contexte long et pour travailler à côté. LLM Texte avec LM Studio ou Ollama Ouvert vérifiez la licence exacte du modèle avant de vendre
Qwen3-VL-4B-Instruct Alibaba indice 6
Où le téléchargerLe dépôt officiel sur Hugging FaceLe poids du fichier est la mémoire qu'il réclame : une version plus légère tourne sur une plus petite carte.
4,44 Md 10,2 Go en pleine précision Tient largement Il reste de la place pour un contexte long et pour travailler à côté. Multimodal avec LM Studio ou Ollama Ouvert vérifiez la licence exacte du modèle avant de vendre
Qwen3.5-0.8B Alibaba indice 6
Où le téléchargerLe dépôt officiel sur Hugging FaceLe poids du fichier est la mémoire qu'il réclame : une version plus légère tourne sur une plus petite carte.
0,8 Md 1,8 Go en pleine précision Tient largement Il reste de la place pour un contexte long et pour travailler à côté. LLM Texte avec LM Studio ou Ollama Ouvert vérifiez la licence exacte du modèle avant de vendre
Gemma 3 4B Google indice 5
Où le téléchargerLe dépôt officiel sur Hugging FaceLe poids du fichier est la mémoire qu'il réclame : une version plus légère tourne sur une plus petite carte.
plancher éditeur 2,5 Go en 4 bits Tient largement Il reste de la place pour un contexte long et pour travailler à côté. LLM Texte avec LM Studio ou Ollama Ouvert vérifiez la licence exacte du modèle avant de vendre
LFM2.5-VL-1.6B Liquid AI indice 5
Où le téléchargerLe dépôt officiel sur Hugging FaceLe poids du fichier est la mémoire qu'il réclame : une version plus légère tourne sur une plus petite carte.
1,6 Md 3,7 Go en pleine précision Tient largement Il reste de la place pour un contexte long et pour travailler à côté. Multimodal avec LM Studio ou Ollama Ouvert vérifiez la licence exacte du modèle avant de vendre
2x-AnimeSharpV4 Kim2091 indice 0
Où le téléchargerLe dépôt officiel sur Hugging FaceLe poids du fichier est la mémoire qu'il réclame : une version plus légère tourne sur une plus petite carte.
plancher éditeur 0,1 Go en 4 bits Tient largement Il reste de la place pour un contexte long et pour travailler à côté. Generative Image avec ComfyUI Propriétaire
ACE-Step 1.5 ACE-Step indice 0
Où le téléchargerLe dépôt officiel sur Hugging FaceLe poids du fichier est la mémoire qu'il réclame : une version plus légère tourne sur une plus petite carte.
plancher éditeur 0,8 Go en 4 bits Tient largement Il reste de la place pour un contexte long et pour travailler à côté. Generative Audio avec ComfyUI Ouvert vérifiez la licence exacte du modèle avant de vendre
Ace-Step-1.5-ScragVAE scragnog indice 0
Où le téléchargerLe dépôt officiel sur Hugging FaceLe poids du fichier est la mémoire qu'il réclame : une version plus légère tourne sur une plus petite carte.
plancher éditeur 1 Go en 4 bits Tient largement Il reste de la place pour un contexte long et pour travailler à côté. Generative Audio avec ComfyUI Propriétaire
ACE-Step-v1-3.5B ACE-Step indice 0
Où le téléchargerLe dépôt officiel sur Hugging FaceLe poids du fichier est la mémoire qu'il réclame : une version plus légère tourne sur une plus petite carte.
plancher éditeur 7,7 Go en 4 bits Tient largement Il reste de la place pour un contexte long et pour travailler à côté. Generative Audio avec ComfyUI Propriétaire
ACE-Step-v1-chinese-rap-LoRA ACE-Step indice 0
Où le téléchargerLe dépôt officiel sur Hugging FaceLe poids du fichier est la mémoire qu'il réclame : une version plus légère tourne sur une plus petite carte.
plancher éditeur 0,5 Go en 4 bits Tient largement Il reste de la place pour un contexte long et pour travailler à côté. Generative Audio avec ComfyUI Propriétaire
acestep-5Hz-lm-0.6B ACE-Step indice 0
Où le téléchargerLe dépôt officiel sur Hugging FaceLe poids du fichier est la mémoire qu'il réclame : une version plus légère tourne sur une plus petite carte.
plancher éditeur 1,2 Go en 4 bits Tient largement Il reste de la place pour un contexte long et pour travailler à côté. Generative Audio avec ComfyUI Propriétaire
acestep-5Hz-lm-4B ACE-Step indice 0
Où le téléchargerLe dépôt officiel sur Hugging FaceLe poids du fichier est la mémoire qu'il réclame : une version plus légère tourne sur une plus petite carte.
plancher éditeur 7,8 Go en 4 bits Tient largement Il reste de la place pour un contexte long et pour travailler à côté. Generative Audio avec ComfyUI Propriétaire
acestep-v15-base ACE-Step indice 0
Où le téléchargerLe dépôt officiel sur Hugging FaceLe poids du fichier est la mémoire qu'il réclame : une version plus légère tourne sur une plus petite carte.
plancher éditeur 4,5 Go en 4 bits Tient largement Il reste de la place pour un contexte long et pour travailler à côté. Generative Audio avec ComfyUI Propriétaire
acestep-v15-sft ACE-Step indice 0
Où le téléchargerLe dépôt officiel sur Hugging FaceLe poids du fichier est la mémoire qu'il réclame : une version plus légère tourne sur une plus petite carte.
plancher éditeur 4,5 Go en 4 bits Tient largement Il reste de la place pour un contexte long et pour travailler à côté. Generative Audio avec ComfyUI Propriétaire
acestep-v15-xl-turbo-diffusers ACE-Step indice 0
Où le téléchargerLe dépôt officiel sur Hugging FaceLe poids du fichier est la mémoire qu'il réclame : une version plus légère tourne sur une plus petite carte.
plancher éditeur 10,3 Go en 4 bits Tient largement Il reste de la place pour un contexte long et pour travailler à côté. Generative Audio avec ComfyUI Propriétaire
ActionMesh facebook indice 0
Où le téléchargerLe dépôt officiel sur Hugging FaceLe poids du fichier est la mémoire qu'il réclame : une version plus légère tourne sur une plus petite carte.
plancher éditeur 6,2 Go en 4 bits Tient largement Il reste de la place pour un contexte long et pour travailler à côté. Generative 3D avec LM Studio ou Ollama Propriétaire
amanatsu-illustrious-v11-sdxl John6666 indice 0
Où le téléchargerLe dépôt officiel sur Hugging FaceLe poids du fichier est la mémoire qu'il réclame : une version plus légère tourne sur une plus petite carte.
plancher éditeur 6,9 Go en 4 bits Tient largement Il reste de la place pour un contexte long et pour travailler à côté. Generative Image avec ComfyUI Propriétaire
Anima 2.9B Gazingstars123 indice 0
Où le téléchargerLe dépôt officiel sur Hugging FaceLe poids du fichier est la mémoire qu'il réclame : une version plus légère tourne sur une plus petite carte.
2,9 Md 6,7 Go en pleine précision Tient largement Il reste de la place pour un contexte long et pour travailler à côté. Generative Image avec ComfyUI Ouvert vérifiez la licence exacte du modèle avant de vendre
AnimateDiff-Lightning ByteDance indice 0
Où le téléchargerLe dépôt officiel sur Hugging FaceLe poids du fichier est la mémoire qu'il réclame : une version plus légère tourne sur une plus petite carte.
plancher éditeur 6,8 Go en 4 bits Tient largement Il reste de la place pour un contexte long et pour travailler à côté. Generative Video avec ComfyUI Propriétaire
animatediff-motion-adapter-v1-5-2 guoyww indice 0
Où le téléchargerLe dépôt officiel sur Hugging FaceLe poids du fichier est la mémoire qu'il réclame : une version plus légère tourne sur une plus petite carte.
plancher éditeur 3,4 Go en 4 bits Tient largement Il reste de la place pour un contexte long et pour travailler à côté. Generative Video avec ComfyUI Propriétaire
AnimateLCM wangfuyun indice 0
Où le téléchargerLe dépôt officiel sur Hugging FaceLe poids du fichier est la mémoire qu'il réclame : une version plus légère tourne sur une plus petite carte.
plancher éditeur 4,4 Go en 4 bits Tient largement Il reste de la place pour un contexte long et pour travailler à côté. Generative Video avec ComfyUI Propriétaire
AnyPose lilylilith indice 0
Où le téléchargerLe dépôt officiel sur Hugging FaceLe poids du fichier est la mémoire qu'il réclame : une version plus légère tourne sur une plus petite carte.
plancher éditeur 0,6 Go en 4 bits Tient largement Il reste de la place pour un contexte long et pour travailler à côté. Generative Image avec ComfyUI Propriétaire
anysplat lhjiang indice 0
Où le téléchargerLe dépôt officiel sur Hugging FaceLe poids du fichier est la mémoire qu'il réclame : une version plus légère tourne sur une plus petite carte.
plancher éditeur 2,7 Go en 4 bits Tient largement Il reste de la place pour un contexte long et pour travailler à côté. Generative 3D avec LM Studio ou Ollama Propriétaire
Anything2Real lrzjason indice 0
Où le téléchargerLe dépôt officiel sur Hugging FaceLe poids du fichier est la mémoire qu'il réclame : une version plus légère tourne sur une plus petite carte.
plancher éditeur 1,8 Go en 4 bits Tient largement Il reste de la place pour un contexte long et pour travailler à côté. Generative Image avec ComfyUI Propriétaire
asset-harvester nvidia indice 0
Où le téléchargerLe dépôt officiel sur Hugging FaceLe poids du fichier est la mémoire qu'il réclame : une version plus légère tourne sur une plus petite carte.
plancher éditeur 11,9 Go en 4 bits Tient, mais juste Ça entre. Réduisez le contexte si vous voyez des ralentissements, et fermez les jeux et navigateurs qui mangent de la mémoire vidéo. Generative 3D avec LM Studio ou Ollama Propriétaire
Audio8-TTS-Preview-0.1b Audio8 indice 0
Où le téléchargerLe dépôt officiel sur Hugging FaceLe poids du fichier est la mémoire qu'il réclame : une version plus légère tourne sur une plus petite carte.
plancher éditeur 1,6 Go en 4 bits Tient largement Il reste de la place pour un contexte long et pour travailler à côté. Generative Audio avec ComfyUI Propriétaire
Audio8-TTS-Preview-0.6b Audio8 indice 0
Où le téléchargerLe dépôt officiel sur Hugging FaceLe poids du fichier est la mémoire qu'il réclame : une version plus légère tourne sur une plus petite carte.
plancher éditeur 2,4 Go en 4 bits Tient largement Il reste de la place pour un contexte long et pour travailler à côté. Generative Audio avec ComfyUI Propriétaire
AudioSR drbaph indice 0
Où le téléchargerLe dépôt officiel sur Hugging FaceLe poids du fichier est la mémoire qu'il réclame : une version plus légère tourne sur une plus petite carte.
plancher éditeur 6,2 Go en 4 bits Tient largement Il reste de la place pour un contexte long et pour travailler à côté. Generative Audio avec ComfyUI Ouvert vérifiez la licence exacte du modèle avant de vendre
avtr-1 avaturn-live indice 0
Où le téléchargerLe dépôt officiel sur Hugging FaceLe poids du fichier est la mémoire qu'il réclame : une version plus légère tourne sur une plus petite carte.
plancher éditeur 1,8 Go en 4 bits Tient largement Il reste de la place pour un contexte long et pour travailler à côté. Generative Video avec ComfyUI Propriétaire
bark-small suno indice 0
Où le téléchargerLe dépôt officiel sur Hugging FaceLe poids du fichier est la mémoire qu'il réclame : une version plus légère tourne sur une plus petite carte.
plancher éditeur 1,6 Go en 4 bits Tient largement Il reste de la place pour un contexte long et pour travailler à côté. Generative Audio avec ComfyUI Propriétaire
beatrice-trainer fierce-cats indice 0
Où le téléchargerLe dépôt officiel sur Hugging FaceLe poids du fichier est la mémoire qu'il réclame : une version plus légère tourne sur une plus petite carte.
plancher éditeur 0 Go en 4 bits Tient largement Il reste de la place pour un contexte long et pour travailler à côté. Generative Audio avec ComfyUI Propriétaire
Bernini-R-LightX2V-4step-loras rzgar indice 0
Où le téléchargerLe dépôt officiel sur Hugging FaceLe poids du fichier est la mémoire qu'il réclame : une version plus légère tourne sur une plus petite carte.
plancher éditeur 2,3 Go en 4 bits Tient largement Il reste de la place pour un contexte long et pour travailler à côté. Generative Image avec ComfyUI Propriétaire
BFS-Best-Face-Swap Alissonerdx indice 0
Où le téléchargerLe dépôt officiel sur Hugging FaceLe poids du fichier est la mémoire qu'il réclame : une version plus légère tourne sur une plus petite carte.
plancher éditeur 11,8 Go en 4 bits Tient, mais juste Ça entre. Réduisez le contexte si vous voyez des ralentissements, et fermez les jeux et navigateurs qui mangent de la mémoire vidéo. Generative Image avec ComfyUI Propriétaire
BFS-Best-Face-Swap-Video Alissonerdx indice 0
Où le téléchargerLe dépôt officiel sur Hugging FaceLe poids du fichier est la mémoire qu'il réclame : une version plus légère tourne sur une plus petite carte.
plancher éditeur 8,5 Go en 4 bits Tient largement Il reste de la place pour un contexte long et pour travailler à côté. Generative Video avec ComfyUI Propriétaire
bigaspv2-5 fancyfeast indice 0
Où le téléchargerLe dépôt officiel sur Hugging FaceLe poids du fichier est la mémoire qu'il réclame : une version plus légère tourne sur une plus petite carte.
plancher éditeur 2,1 Go en 4 bits Tient largement Il reste de la place pour un contexte long et pour travailler à côté. Generative Image avec ComfyUI Propriétaire
BigVGAN v2 NVIDIA indice 0
Où le téléchargerLe dépôt officiel sur Hugging Face
  • bigvgan_generator.pt — 0,53 Go
Le poids du fichier est la mémoire qu'il réclame : une version plus légère tourne sur une plus petite carte.
plancher éditeur 0,5 Go en 4 bits Tient largement Il reste de la place pour un contexte long et pour travailler à côté. Generative Audio avec ComfyUI Ouvert vérifiez la licence exacte du modèle avant de vendre
bigvgan_v2_24khz_100band_256x nvidia indice 0
Où le téléchargerLe dépôt officiel sur Hugging FaceLe poids du fichier est la mémoire qu'il réclame : une version plus légère tourne sur une plus petite carte.
plancher éditeur 3,5 Go en 4 bits Tient largement Il reste de la place pour un contexte long et pour travailler à côté. Generative Audio avec ComfyUI Propriétaire
BrickGPT AvaLovelace indice 0
Où le téléchargerLe dépôt officiel sur Hugging FaceLe poids du fichier est la mémoire qu'il réclame : une version plus légère tourne sur une plus petite carte.
plancher éditeur 0 Go en 4 bits Tient largement Il reste de la place pour un contexte long et pour travailler à côté. Generative 3D avec LM Studio ou Ollama Propriétaire
CharacterSheet Alissonerdx indice 0
Où le téléchargerLe dépôt officiel sur Hugging FaceLe poids du fichier est la mémoire qu'il réclame : une version plus légère tourne sur une plus petite carte.
plancher éditeur 2,3 Go en 4 bits Tient largement Il reste de la place pour un contexte long et pour travailler à côté. Generative Image avec ComfyUI Propriétaire
270 modèles ne tiennent pas sur cette machine, même en débordant — les voir quand même

Ils sont là pour situer la frontière : au-delà, c'est le cloud, quelle que soit la carte qu'on achète. Rien n'est caché, c'est juste rangé.
On en montre 30 sur 270 : les plus proches de votre machine. Les suivants s'en éloignent sans rien vous apprendre de plus, et les afficher tous alourdirait la page de plusieurs centaines de kilo-octets.

Modèle Taille Il faut Chez vous Pour quoi faire Usage commercial
MiMo-V2.6-Pro XiaomiMiMo indice 46 1024 Md 588,8 Go en 4 bits Hors de portée Même en débordant sur la mémoire vive, il n'y a pas la place. Il faudrait une carte plus grande, ou un modèle plus petit. Multimodal avec LM Studio ou Ollama Ouvert vérifiez la licence exacte du modèle avant de vendre
Dépôt XiaomiMiMo/MiMo-V2.6-Pro-RL : plus de mille milliards de paramètres. Ouvert, mais hors de portée de tout matériel personnel.
Kimi K3 (poids ouverts) Moonshot AI indice 44
Où le téléchargerLe dépôt officiel sur Hugging FaceLe poids du fichier est la mémoire qu'il réclame : une version plus légère tourne sur une plus petite carte.
plancher éditeur 509 Go en 4 bits Hors de portée Même en débordant sur la mémoire vive, il n'y a pas la place. Il faudrait une carte plus grande, ou un modèle plus petit. LLM Texte avec LM Studio ou Ollama Propriétaire
Qwen3.8 2.4T A95B Alibaba indice 40
Où le téléchargerLe dépôt officiel sur Hugging FaceLe poids du fichier est la mémoire qu'il réclame : une version plus légère tourne sur une plus petite carte.
2400 Md dont 95 Md actifs 1380 Go en 4 bits Hors de portée Même en débordant sur la mémoire vive, il n'y a pas la place. Il faudrait une carte plus grande, ou un modèle plus petit. LLM Texte avec LM Studio ou Ollama Ouvert vérifiez la licence exacte du modèle avant de vendre
Le « A95B » du nom désigne les paramètres ACTIFS. Hors de portée d'une machine personnelle : il faut loger les 2 400 milliards en mémoire, même si seuls 95 travaillent à chaque jeton.
Qwen3.8-Flash-Next Alibaba indice 40 180 Md 103,5 Go en 4 bits Hors de portée Même en débordant sur la mémoire vive, il n'y a pas la place. Il faudrait une carte plus grande, ou un modèle plus petit. Multimodal avec LM Studio ou Ollama Ouvert vérifiez la licence exacte du modèle avant de vendre
GLM-5.2 Z.AI indice 34
Où le téléchargerLe dépôt officiel sur Hugging FaceLe poids du fichier est la mémoire qu'il réclame : une version plus légère tourne sur une plus petite carte.
753 Md 433 Go en 4 bits Hors de portée Même en débordant sur la mémoire vive, il n'y a pas la place. Il faudrait une carte plus grande, ou un modèle plus petit. LLM Texte avec LM Studio ou Ollama Ouvert vérifiez la licence exacte du modèle avant de vendre
Motif 3 Motif Technologies indice 34 314,84 Md 181 Go en 4 bits Hors de portée Même en débordant sur la mémoire vive, il n'y a pas la place. Il faudrait une carte plus grande, ou un modèle plus petit. LLM Texte avec LM Studio ou Ollama Ouvert vérifiez la licence exacte du modèle avant de vendre
Qwen3.8-27B Alibaba indice 34
Où le téléchargerLe dépôt officiel sur Hugging FaceLe poids du fichier est la mémoire qu'il réclame : une version plus légère tourne sur une plus petite carte.
27 Md 15,5 Go en 4 bits Hors de portée Même en débordant sur la mémoire vive, il n'y a pas la place. Il faudrait une carte plus grande, ou un modèle plus petit. Multimodal avec LM Studio ou Ollama Ouvert vérifiez la licence exacte du modèle avant de vendre
Dense 27 milliards, licence Apache 2.0, multimodal (texte, image, vidéo), contexte natif 262 144 jetons.
MiniMax-M3 MiniMax indice 29
Où le téléchargerLe dépôt officiel sur Hugging FaceLe poids du fichier est la mémoire qu'il réclame : une version plus légère tourne sur une plus petite carte.
427 Md 245,5 Go en 4 bits Hors de portée Même en débordant sur la mémoire vive, il n'y a pas la place. Il faudrait une carte plus grande, ou un modèle plus petit. Multimodal avec LM Studio ou Ollama Ouvert vérifiez la licence exacte du modèle avant de vendre
Kimi K2.6 Moonshot AI indice 27
Où le téléchargerLe dépôt officiel sur Hugging FaceLe poids du fichier est la mémoire qu'il réclame : une version plus légère tourne sur une plus petite carte.
1000 Md 575 Go en 4 bits Hors de portée Même en débordant sur la mémoire vive, il n'y a pas la place. Il faudrait une carte plus grande, ou un modèle plus petit. Multimodal avec LM Studio ou Ollama Ouvert vérifiez la licence exacte du modèle avant de vendre
Mille milliards de paramètres. Ouvert, téléchargeable… et hors de portée de tout matériel personnel. C'est utile de le voir écrit.
K2 Horizon MoVA 36B A4B MBZUAI Institute of Foundation Models indice 25 37,44 Md dont 4 Md actifs 21,5 Go en 4 bits Hors de portée Même en débordant sur la mémoire vive, il n'y a pas la place. Il faudrait une carte plus grande, ou un modèle plus petit. LLM Texte avec LM Studio ou Ollama Ouvert vérifiez la licence exacte du modèle avant de vendre
Ling 3.0 Flash inclusionAI indice 25 127,49 Md 73,3 Go en 4 bits Hors de portée Même en débordant sur la mémoire vive, il n'y a pas la place. Il faudrait une carte plus grande, ou un modèle plus petit. LLM Texte avec LM Studio ou Ollama Ouvert vérifiez la licence exacte du modèle avant de vendre
Nemotron 3 Ultra NVIDIA indice 23
Où le téléchargerLe dépôt officiel sur Hugging FaceLe poids du fichier est la mémoire qu'il réclame : une version plus légère tourne sur une plus petite carte.
550 Md dont 55 Md actifs 316,3 Go en 4 bits Hors de portée Même en débordant sur la mémoire vive, il n'y a pas la place. Il faudrait une carte plus grande, ou un modèle plus petit. LLM Texte avec LM Studio ou Ollama Ouvert vérifiez la licence exacte du modèle avant de vendre
G9v3-39A5B AI9Stars indice 22 38,97 Md dont 5 Md actifs 22,4 Go en 4 bits Hors de portée Même en débordant sur la mémoire vive, il n'y a pas la place. Il faudrait une carte plus grande, ou un modèle plus petit. LLM Texte avec LM Studio ou Ollama Ouvert vérifiez la licence exacte du modèle avant de vendre
Qwen3.6 27B Alibaba indice 21
Où le téléchargerLe dépôt officiel sur Hugging FaceLe poids du fichier est la mémoire qu'il réclame : une version plus légère tourne sur une plus petite carte.
27 Md 15,5 Go en 4 bits Hors de portée Même en débordant sur la mémoire vive, il n'y a pas la place. Il faudrait une carte plus grande, ou un modèle plus petit. Multimodal avec LM Studio ou Ollama Ouvert vérifiez la licence exacte du modèle avant de vendre
Gemma 4 31B Google indice 19
Où le téléchargerLe dépôt officiel sur Hugging FaceLe poids du fichier est la mémoire qu'il réclame : une version plus légère tourne sur une plus petite carte.
31 Md 17,8 Go en 4 bits Hors de portée Même en débordant sur la mémoire vive, il n'y a pas la place. Il faudrait une carte plus grande, ou un modèle plus petit. Multimodal avec LM Studio ou Ollama Ouvert vérifiez la licence exacte du modèle avant de vendre
Qwen3.5-35B-A3B Alibaba indice 19
Où le téléchargerLe dépôt officiel sur Hugging FaceLe poids du fichier est la mémoire qu'il réclame : une version plus légère tourne sur une plus petite carte.
36 Md dont 3 Md actifs 20,7 Go en 4 bits Hors de portée Même en débordant sur la mémoire vive, il n'y a pas la place. Il faudrait une carte plus grande, ou un modèle plus petit. LLM Texte avec LM Studio ou Ollama Ouvert vérifiez la licence exacte du modèle avant de vendre
Melange d'experts : 36 milliards a loger en memoire, 3 seulement travaillent a chaque jeton.
Qwen3.5-122B-A10B Alibaba indice 18
Où le téléchargerLe dépôt officiel sur Hugging FaceLe poids du fichier est la mémoire qu'il réclame : une version plus légère tourne sur une plus petite carte.
plancher éditeur 36,7 Go en 4 bits Hors de portée Même en débordant sur la mémoire vive, il n'y a pas la place. Il faudrait une carte plus grande, ou un modèle plus petit. LLM Texte avec LM Studio ou Ollama Ouvert vérifiez la licence exacte du modèle avant de vendre
Muse Glimmer Meta indice 17
Où le téléchargerLe dépôt officiel sur Hugging FaceLe poids du fichier est la mémoire qu'il réclame : une version plus légère tourne sur une plus petite carte.
30 Md 17,3 Go en 4 bits Hors de portée Même en débordant sur la mémoire vive, il n'y a pas la place. Il faudrait une carte plus grande, ou un modèle plus petit. Multimodal avec LM Studio ou Ollama Ouvert vérifiez la licence exacte du modèle avant de vendre
Dense 30 milliards, Apache 2.0, agentique. ⚠ Ne tient PAS sur une carte de 16 Go : il faut 24 Go. C'est le cas d'école de cette page — Nicolas possède les 5080 et 5070 Ti, et ni l'une ni l'autre ne le fait tourner en mémoire vidéo.
GLM-4.7-Flash Z.AI indice 15
Où le téléchargerLe dépôt officiel sur Hugging FaceLe poids du fichier est la mémoire qu'il réclame : une version plus légère tourne sur une plus petite carte.
plancher éditeur 18,2 Go en 4 bits Hors de portée Même en débordant sur la mémoire vive, il n'y a pas la place. Il faudrait une carte plus grande, ou un modèle plus petit. LLM Texte avec LM Studio ou Ollama Ouvert vérifiez la licence exacte du modèle avant de vendre
Mistral Medium 3.5 Mistral indice 14
Où le téléchargerLe dépôt officiel sur Hugging FaceLe poids du fichier est la mémoire qu'il réclame : une version plus légère tourne sur une plus petite carte.
128 Md 73,6 Go en 4 bits Hors de portée Même en débordant sur la mémoire vive, il n'y a pas la place. Il faudrait une carte plus grande, ou un modèle plus petit. LLM Texte avec LM Studio ou Ollama Ouvert vérifiez la licence exacte du modèle avant de vendre
Nemotron 3 Super NVIDIA indice 13
Où le téléchargerLe dépôt officiel sur Hugging FaceLe poids du fichier est la mémoire qu'il réclame : une version plus légère tourne sur une plus petite carte.
120 Md dont 12 Md actifs 69 Go en 4 bits Hors de portée Même en débordant sur la mémoire vive, il n'y a pas la place. Il faudrait une carte plus grande, ou un modèle plus petit. LLM Texte avec LM Studio ou Ollama Ouvert vérifiez la licence exacte du modèle avant de vendre
Nemotron 3.5 Lightning NVIDIA indice 13
Où le téléchargerLe dépôt officiel sur Hugging FaceLe poids du fichier est la mémoire qu'il réclame : une version plus légère tourne sur une plus petite carte.
30 Md dont 3 Md actifs 17,3 Go en 4 bits Hors de portée Même en débordant sur la mémoire vive, il n'y a pas la place. Il faudrait une carte plus grande, ou un modèle plus petit. LLM Texte avec LM Studio ou Ollama Ouvert vérifiez la licence exacte du modèle avant de vendre
Même gabarit que le Nano 3 : 30 milliards dont 3 actifs. C'est ce qui explique sa vitesse.
gpt-oss 120B OpenAI indice 12
Où le téléchargerLe dépôt officiel sur Hugging FaceLe poids du fichier est la mémoire qu'il réclame : une version plus légère tourne sur une plus petite carte.
120 Md 69 Go en 4 bits Hors de portée Même en débordant sur la mémoire vive, il n'y a pas la place. Il faudrait une carte plus grande, ou un modèle plus petit. LLM Texte avec LM Studio ou Ollama Ouvert vérifiez la licence exacte du modèle avant de vendre
Mélange d'experts : il occupe la mémoire de ses 120 milliards, mais il calcule beaucoup plus vite que sa taille ne le laisse croire. Le nombre exact de paramètres actifs n'est pas repris ici tant qu'il n'est pas relevé chez l'éditeur.
DeepSeek R1 DeepSeek indice 11
Où le téléchargerLe dépôt officiel sur Hugging FaceLe poids du fichier est la mémoire qu'il réclame : une version plus légère tourne sur une plus petite carte.
685 Md 393,9 Go en 4 bits Hors de portée Même en débordant sur la mémoire vive, il n'y a pas la place. Il faudrait une carte plus grande, ou un modèle plus petit. Raisonnement avec LM Studio ou Ollama Ouvert vérifiez la licence exacte du modèle avant de vendre
Mistral Small 4 Mistral indice 11
Où le téléchargerLe dépôt officiel sur Hugging FaceLe poids du fichier est la mémoire qu'il réclame : une version plus légère tourne sur une plus petite carte.
119 Md 68,4 Go en 4 bits Hors de portée Même en débordant sur la mémoire vive, il n'y a pas la place. Il faudrait une carte plus grande, ou un modèle plus petit. LLM Texte avec LM Studio ou Ollama Ouvert vérifiez la licence exacte du modèle avant de vendre
Dépôt mistralai/Mistral-Small-4-119B. « Small » est un nom de gamme, plus une taille : 119 milliards, ça ne tient pas sur une carte grand public.
Llama 4 Maverick Meta indice 10
Où le téléchargerLe dépôt officiel sur Hugging FaceLe poids du fichier est la mémoire qu'il réclame : une version plus légère tourne sur une plus petite carte.
402 Md dont 17 Md actifs 231,2 Go en 4 bits Hors de portée Même en débordant sur la mémoire vive, il n'y a pas la place. Il faudrait une carte plus grande, ou un modèle plus petit. LLM Texte avec LM Studio ou Ollama Ouvert vérifiez la licence exacte du modèle avant de vendre
128 experts pour 17 milliards actifs. Hors de portée d'une machine personnelle malgré son étiquette « 17B ».
Nemotron 3 Nano Omni 30B NVIDIA indice 10
Où le téléchargerLe dépôt officiel sur Hugging Face
  • BF16 — 70,97 Go
Le poids du fichier est la mémoire qu'il réclame : une version plus légère tourne sur une plus petite carte.
plancher éditeur 71 Go en 4 bits Hors de portée Même en débordant sur la mémoire vive, il n'y a pas la place. Il faudrait une carte plus grande, ou un modèle plus petit. Multimodal avec LM Studio ou Ollama Ouvert vérifiez la licence exacte du modèle avant de vendre
Qwen3-Coder-30B-A3B-Instruct Alibaba indice 10
Où le téléchargerLe dépôt officiel sur Hugging FaceLe poids du fichier est la mémoire qu'il réclame : une version plus légère tourne sur une plus petite carte.
30,53 Md 17,6 Go en 4 bits Hors de portée Même en débordant sur la mémoire vive, il n'y a pas la place. Il faudrait une carte plus grande, ou un modèle plus petit. LLM Texte avec LM Studio ou Ollama Ouvert vérifiez la licence exacte du modèle avant de vendre
Mistral Large 3 Mistral indice 9
Où le téléchargerLe dépôt officiel sur Hugging FaceLe poids du fichier est la mémoire qu'il réclame : une version plus légère tourne sur une plus petite carte.
675 Md 388,1 Go en 4 bits Hors de portée Même en débordant sur la mémoire vive, il n'y a pas la place. Il faudrait une carte plus grande, ou un modèle plus petit. LLM Texte avec LM Studio ou Ollama Ouvert vérifiez la licence exacte du modèle avant de vendre
Nemotron 3 Nano NVIDIA indice 9
Où le téléchargerLe dépôt officiel sur Hugging FaceLe poids du fichier est la mémoire qu'il réclame : une version plus légère tourne sur une plus petite carte.
30 Md dont 3 Md actifs 17,3 Go en 4 bits Hors de portée Même en débordant sur la mémoire vive, il n'y a pas la place. Il faudrait une carte plus grande, ou un modèle plus petit. LLM Texte avec LM Studio ou Ollama Ouvert vérifiez la licence exacte du modèle avant de vendre
Dépôt nvidia/NVIDIA-Nemotron-3-Nano-30B-A3B. ⚠ NVIDIA publie aussi un « Nano 4B » dense, bien plus petit : si notre fiche visait celui-là, c'est 4 qu'il faut mettre ici.
Un modèle trop gros pour votre carte peut quand même tourner. Il sera juste beaucoup plus lent. Ce qui ne tient pas dans la mémoire vidéo passe sur la mémoire vive, puis sur le disque : la réponse met des minutes au lieu de quelques secondes, mais elle arrive. Les autres sites affichent « compatible » ou « incompatible » ; la réalité est un dégradé. Essayez avant de renoncer — et si l'attente vous convient, elle vous convient.

Pas encore relevés — 22 modèles

Ces modèles sont bien au catalogue et tournent en local, mais nous n'avons pas encore relevé leur taille chez leur éditeur, ou mesuré ce qu'ils demandent réellement. Nous préférons l'écrire plutôt que de vous donner une estimation qui aurait l'air juste. Ils arriveront dans le tableau au fur et à mesure des essais — chaque ligne du tableau vient d'une source ouverte ou d'une mesure faite sur une vraie carte.

Avec quel logiciel ?

Un modèle est un fichier : il lui faut un logiciel pour tourner. Tous ceux-ci sont gratuits et s'installent en quelques minutes.

Notre guide : quel logiciel gratuit pour faire tourner une IA en local

Pourquoi nos chiffres ne sont pas ceux des autres

La plupart des sites qui répondent à cette question calculent un seuil à partir d'une fiche technique. Nous faisons les deux : le calcul de mémoire est expliqué ci-dessous et vous pouvez le refaire vous-même, et les vitesses affichées viennent d'essais réels sur de vraies cartes — pas d'une formule.

Le calcul, en clair. Un modèle occupe son nombre de paramètres multiplié par le poids de chaque paramètre : 2 octets en pleine précision, 1 octet en 8 bits, un demi-octet en 4 bits. Un modèle de 27 milliards en 4 bits demande donc environ 13,5 Go, plus une marge d'environ 15 % pour le contexte et le fonctionnement du logiciel. Quantifier, c'est réduire la précision de chaque paramètre pour tenir dans moins de mémoire : en 4 bits, la perte de qualité est faible et le gain de place énorme. C'est la première chose à essayer.

Et pour les modèles à experts (MoE), la mémoire suit la taille totale, pas les paramètres actifs : tous les experts doivent être chargés, même si quelques-uns seulement travaillent à chaque mot. C'est pourquoi un modèle annoncé « rapide » peut rester impossible à loger chez soi.

Questions fréquentes

Quelle mémoire vidéo faut-il pour faire tourner une IA en local ?
Il n'y a pas de minimum absolu : tout dépend de la taille du modèle. Avec 8 Go on fait tourner confortablement des modèles jusqu'à environ 13 milliards de paramètres en 4 bits. Avec 16 Go on monte vers 27 à 31 milliards. Au-delà de 24 Go, presque tout le catalogue grand public passe. Le formulaire en haut de cette page fait le calcul pour votre carte.
Est-ce que la mémoire vive peut remplacer la mémoire vidéo ?
Non, elle la complète. Quand un modèle dépasse la mémoire de la carte, le surplus bascule sur la mémoire vive : ça continue de fonctionner, mais beaucoup plus lentement, parce que les échanges entre la carte et la mémoire du PC sont bien plus lents que la mémoire de la carte elle-même. Avoir 128 Go de mémoire vive ne compense pas une carte de 8 Go.
Une IA en local est-elle vraiment gratuite et illimitée ?
Oui pour l'usage : aucun abonnement, aucun quota de messages, et vos données ne quittent pas votre ordinateur puisque tout est calculé chez vous. Le coût est ailleurs : la carte graphique, et l'électricité. Attention toutefois à la licence du modèle si vous comptez vendre ce que vous produisez — « ouvert » ne veut pas toujours dire « commercialement libre ».
Faut-il une carte NVIDIA, ou une carte AMD suffit-elle ?
Une carte AMD fait tourner une partie des modèles, et elle le fait honorablement sur le texte. Mais elle n'est pas optimisée comme une NVIDIA : les outils sortent d'abord pour les RTX, beaucoup de modèles n'existent que dans leur format, et il faut souvent bricoler pour démarrer. C'est exactement pour ça qu'une RTX coûte plus cher — vous ne payez pas que de la mémoire, vous payez le fait que tout marche du premier coup. Si vous achetez une carte pour faire de l'IA, et surtout pour générer des images ou des vidéos, prenez une RTX.
Un petit modèle peut-il faire aussi bien qu'un gros ?
Sur une tâche précise, oui. Un petit modèle branché sur vos propres documents (un RAG) ou spécialisé par un LoRA se comporte, dans son domaine, comme un modèle bien plus gros — et il tient sur une carte modeste. C'est la vraie manière de tirer parti d'une machine limitée.
Et sur un Mac ?
Sur les Mac à puce Apple (M1 à M4), il n'y a pas de mémoire vidéo séparée : le graphique partage la mémoire vive. Un Mac de 32 Go se comporte donc à peu près comme une carte de 22 Go — excellent pour le texte, il fait tourner des modèles qu'aucune carte grand public ne loge. En revanche, l'image, la vidéo, la 3D et la musique ne sont pas praticables sur Mac : ces outils sont écrits pour NVIDIA, et ComfyUI n'y est pas utilisable sérieusement. Pour créer des visuels chez vous, il faut une RTX. Choisissez « Mac Apple Silicon » dans le formulaire, le calcul et les avertissements en tiennent compte.
Vous savez ce qui tourne chez vous. Reste à voir ce que valent ces modèles, et ce que coûterait la même chose en ligne.