Quelle IA peut tourner sur mon PC ?
Mis à jour le
Renseignez le champ « Votre mémoire vive » ci-dessus, et cette page vous dira lesquels passent malgré tout. Sur une carte de 4 Go, ça fait la différence entre aucun modèle et sept.
Modèles 1 à 60 sur 598 qui tiennent · page 1 sur 10
| Modèle | Taille | Il faut | Chez vous | Pour quoi faire | Usage commercial |
|---|---|---|---|---|---|
|
Qwen3.8-27B
Alibaba
indice 34
Où le téléchargerLe dépôt officiel sur Hugging Face
|
27 Md | 15,5 Go en 4 bits | Tient largement Il reste de la place pour un contexte long et pour travailler à côté. | Multimodal avec LM Studio ou Ollama | Ouvert vérifiez la licence exacte du modèle avant de vendre |
| Dense 27 milliards, licence Apache 2.0, multimodal (texte, image, vidéo), contexte natif 262 144 jetons. | |||||
|
K2 Horizon MoVA 36B A4B
MBZUAI Institute of Foundation Models
indice 25
Où le téléchargerLe dépôt officiel sur Hugging Face |
37,44 Md dont 4 Md actifs | 21,5 Go en 4 bits | Tient largement Il reste de la place pour un contexte long et pour travailler à côté. | LLM Texte avec LM Studio ou Ollama | Ouvert vérifiez la licence exacte du modèle avant de vendre |
|
Qwen3.5-27B
Alibaba
indice 23
Où le téléchargerLe dépôt officiel sur Hugging Face
|
plancher éditeur | 8,6 Go en 4 bits | Tient largement Il reste de la place pour un contexte long et pour travailler à côté. | LLM Texte avec LM Studio ou Ollama | Ouvert vérifiez la licence exacte du modèle avant de vendre |
|
G9v3-39A5B
AI9Stars
indice 22
Où le téléchargerLe dépôt officiel sur Hugging Face |
38,97 Md dont 5 Md actifs | 22,4 Go en 4 bits | Tient largement Il reste de la place pour un contexte long et pour travailler à côté. | LLM Texte avec LM Studio ou Ollama | Ouvert vérifiez la licence exacte du modèle avant de vendre |
|
K2 Horizon 7B
MBZUAI Institute of Foundation Models
indice 21
Où le téléchargerLe dépôt officiel sur Hugging Face |
9 Md | 20,7 Go en pleine précision | Tient largement Il reste de la place pour un contexte long et pour travailler à côté. | LLM Texte avec LM Studio ou Ollama | Ouvert vérifiez la licence exacte du modèle avant de vendre |
| Annoncé 7 milliards, mais le dépôt IFM/K2-Horizon-7B en compte 9,00 : c'est ce qui occupe la mémoire. | |||||
|
Qwen3.6 27B
Alibaba
indice 21
Où le téléchargerLe dépôt officiel sur Hugging Face
|
27 Md | 15,5 Go en 4 bits | Tient largement Il reste de la place pour un contexte long et pour travailler à côté. | Multimodal avec LM Studio ou Ollama | Ouvert vérifiez la licence exacte du modèle avant de vendre |
|
Gemma 4 31B
Google
indice 19
Où le téléchargerLe dépôt officiel sur Hugging Face
|
31 Md | 17,8 Go en 4 bits | Tient largement Il reste de la place pour un contexte long et pour travailler à côté. | Multimodal avec LM Studio ou Ollama | Ouvert vérifiez la licence exacte du modèle avant de vendre |
| Qwen3.5-35B-A3B Alibaba indice 19 | 36 Md dont 3 Md actifs | 20,7 Go en 4 bits | Tient largement Il reste de la place pour un contexte long et pour travailler à côté. | LLM Texte avec LM Studio ou Ollama | Ouvert vérifiez la licence exacte du modèle avant de vendre |
| Melange d'experts : 36 milliards a loger en memoire, 3 seulement travaillent a chaque jeton. | |||||
|
Qwen3.6-35B-A3B
Alibaba
indice 18
Où le téléchargerLe dépôt officiel sur Hugging Face
|
plancher éditeur | 10,1 Go en 4 bits | Tient largement Il reste de la place pour un contexte long et pour travailler à côté. | LLM Texte avec LM Studio ou Ollama | Ouvert vérifiez la licence exacte du modèle avant de vendre |
|
gemma-4-26B-A4B-it
Google
indice 17
Où le téléchargerLe dépôt officiel sur Hugging FaceLe poids du fichier est la mémoire qu'il réclame : une version plus légère tourne sur une plus petite carte. |
plancher éditeur | 9,9 Go en 4 bits | Tient largement Il reste de la place pour un contexte long et pour travailler à côté. | LLM Texte avec LM Studio ou Ollama | Ouvert vérifiez la licence exacte du modèle avant de vendre |
|
Muse Glimmer
Meta
indice 17
Où le téléchargerLe dépôt officiel sur Hugging Face
|
30 Md | 17,3 Go en 4 bits | Tient largement Il reste de la place pour un contexte long et pour travailler à côté. | Multimodal avec LM Studio ou Ollama | Ouvert vérifiez la licence exacte du modèle avant de vendre |
| Dense 30 milliards, Apache 2.0, agentique. ⚠ Ne tient PAS sur une carte de 16 Go : il faut 24 Go. C'est le cas d'école de cette page — Nicolas possède les 5080 et 5070 Ti, et ni l'une ni l'autre ne le fait tourner en mémoire vidéo. | |||||
|
K2 Horizon 3.7B
MBZUAI Institute of Foundation Models
indice 16
Où le téléchargerLe dépôt officiel sur Hugging Face |
5,06 Md | 11,6 Go en pleine précision | Tient largement Il reste de la place pour un contexte long et pour travailler à côté. | LLM Texte avec LM Studio ou Ollama | Ouvert vérifiez la licence exacte du modèle avant de vendre |
| Annoncé 3,7 milliards, mais le dépôt IFM/K2-Horizon-3.7B en compte 5,06 : c'est ce qui occupe la mémoire. | |||||
|
GLM-4.7-Flash
Z.AI
indice 15
Où le téléchargerLe dépôt officiel sur Hugging FaceLe poids du fichier est la mémoire qu'il réclame : une version plus légère tourne sur une plus petite carte. |
plancher éditeur | 18,2 Go en 4 bits | Tient largement Il reste de la place pour un contexte long et pour travailler à côté. | LLM Texte avec LM Studio ou Ollama | Ouvert vérifiez la licence exacte du modèle avant de vendre |
|
Ling-3.0-tiny
inclusionAI
indice 15
Où le téléchargerLe dépôt officiel sur Hugging Face
|
7,89 Md | 18,1 Go en pleine précision | Tient largement Il reste de la place pour un contexte long et pour travailler à côté. | LLM Texte avec LM Studio ou Ollama | Ouvert vérifiez la licence exacte du modèle avant de vendre |
| Qwen3.5-9B Alibaba indice 14 | plancher éditeur | 3,2 Go en 4 bits | Tient largement Il reste de la place pour un contexte long et pour travailler à côté. | Multimodal avec LM Studio ou Ollama | Ouvert vérifiez la licence exacte du modèle avant de vendre |
|
Nemotron 3.5 Lightning
NVIDIA
indice 13
Où le téléchargerLe dépôt officiel sur Hugging Face
|
30 Md dont 3 Md actifs | 17,3 Go en 4 bits | Tient largement Il reste de la place pour un contexte long et pour travailler à côté. | LLM Texte avec LM Studio ou Ollama | Ouvert vérifiez la licence exacte du modèle avant de vendre |
| Même gabarit que le Nano 3 : 30 milliards dont 3 actifs. C'est ce qui explique sa vitesse. | |||||
|
Qwen3.5-4B
Alibaba
indice 13
Où le téléchargerLe dépôt officiel sur Hugging Face
|
4,66 Md | 10,7 Go en pleine précision | Tient largement Il reste de la place pour un contexte long et pour travailler à côté. | LLM Texte avec LM Studio ou Ollama | Ouvert vérifiez la licence exacte du modèle avant de vendre |
|
MiniCPM5-2B
OpenBMB
indice 12
Où le téléchargerLe dépôt officiel sur Hugging Face |
2,52 Md | 5,8 Go en pleine précision | Tient largement Il reste de la place pour un contexte long et pour travailler à côté. | LLM Texte avec LM Studio ou Ollama | Ouvert vérifiez la licence exacte du modèle avant de vendre |
| Dépôt openbmb/MiniCPM5-2B : 2,52 milliards, un peu plus que les 2 du nom. | |||||
|
G9v3-3B
AI9Stars
indice 11
Où le téléchargerLe dépôt officiel sur Hugging Face |
2,99 Md | 6,9 Go en pleine précision | Tient largement Il reste de la place pour un contexte long et pour travailler à côté. | LLM Texte avec LM Studio ou Ollama | Ouvert vérifiez la licence exacte du modèle avant de vendre |
|
gpt-oss-20b
OpenAI
indice 10
Où le téléchargerLe dépôt officiel sur Hugging Face
|
21,51 Md | 24,7 Go en 8 bits | Tient largement Il reste de la place pour un contexte long et pour travailler à côté. | LLM Texte avec LM Studio ou Ollama | Ouvert vérifiez la licence exacte du modèle avant de vendre |
| Le petit frere du gpt-oss 120B deja au catalogue. | |||||
|
Qwen3-Coder-30B-A3B-Instruct
Alibaba
indice 10
Où le téléchargerLe dépôt officiel sur Hugging Face
|
30,53 Md | 17,6 Go en 4 bits | Tient largement Il reste de la place pour un contexte long et pour travailler à côté. | LLM Texte avec LM Studio ou Ollama | Ouvert vérifiez la licence exacte du modèle avant de vendre |
|
gemma-4-E4B-it
Google
indice 9
Où le téléchargerLe dépôt officiel sur Hugging FaceLe poids du fichier est la mémoire qu'il réclame : une version plus légère tourne sur une plus petite carte. |
8 Md | 18,4 Go en pleine précision | Tient largement Il reste de la place pour un contexte long et pour travailler à côté. | Multimodal avec LM Studio ou Ollama | Ouvert vérifiez la licence exacte du modèle avant de vendre |
|
Granite 4.2 3B
IBM
indice 9
Où le téléchargerLe dépôt officiel sur Hugging Face |
3,66 Md | 8,4 Go en pleine précision | Tient largement Il reste de la place pour un contexte long et pour travailler à côté. | LLM Texte avec LM Studio ou Ollama | Ouvert vérifiez la licence exacte du modèle avant de vendre |
|
MiniCPM5-1B
OpenBMB
indice 9
Où le téléchargerLe dépôt officiel sur Hugging FaceLe poids du fichier est la mémoire qu'il réclame : une version plus légère tourne sur une plus petite carte. |
plancher éditeur | 0,6 Go en 4 bits | Tient largement Il reste de la place pour un contexte long et pour travailler à côté. | Multimodal avec LM Studio ou Ollama | Ouvert vérifiez la licence exacte du modèle avant de vendre |
|
Nemotron 3 Nano
NVIDIA
indice 9
Où le téléchargerLe dépôt officiel sur Hugging Face
|
30 Md dont 3 Md actifs | 17,3 Go en 4 bits | Tient largement Il reste de la place pour un contexte long et pour travailler à côté. | LLM Texte avec LM Studio ou Ollama | Ouvert vérifiez la licence exacte du modèle avant de vendre |
| Dépôt nvidia/NVIDIA-Nemotron-3-Nano-30B-A3B. ⚠ NVIDIA publie aussi un « Nano 4B » dense, bien plus petit : si notre fiche visait celui-là, c'est 4 qu'il faut mettre ici. | |||||
|
Qwen3-Coder-Next
Alibaba
indice 9
Où le téléchargerLe dépôt officiel sur Hugging Face
|
plancher éditeur | 18,9 Go en 4 bits | Tient largement Il reste de la place pour un contexte long et pour travailler à côté. | LLM Texte avec LM Studio ou Ollama | Ouvert vérifiez la licence exacte du modèle avant de vendre |
|
gemma-4-E2B-it
Google
indice 8
Où le téléchargerLe dépôt officiel sur Hugging Face
|
5,12 Md | 11,8 Go en pleine précision | Tient largement Il reste de la place pour un contexte long et pour travailler à côté. | Multimodal avec LM Studio ou Ollama | Ouvert vérifiez la licence exacte du modèle avant de vendre |
|
LFM2.5-2.6B
Liquid AI
indice 8
Où le téléchargerLe dépôt officiel sur Hugging Face |
2,7 Md | 6,2 Go en pleine précision | Tient largement Il reste de la place pour un contexte long et pour travailler à côté. | LLM Texte avec LM Studio ou Ollama | Ouvert vérifiez la licence exacte du modèle avant de vendre |
| Qwen3-VL-32B-Instruct Alibaba indice 8 | plancher éditeur | 8,9 Go en 4 bits | Tient largement Il reste de la place pour un contexte long et pour travailler à côté. | Multimodal avec LM Studio ou Ollama | Ouvert vérifiez la licence exacte du modèle avant de vendre |
| granite-4.1-8b IBM indice 7 | 8,79 Md | 20,2 Go en pleine précision | Tient largement Il reste de la place pour un contexte long et pour travailler à côté. | LLM Texte avec LM Studio ou Ollama | Ouvert vérifiez la licence exacte du modèle avant de vendre |
| Qwen2.5-Coder-32B-Instruct Alibaba indice 7 | 32 Md | 18,4 Go en 4 bits | Tient largement Il reste de la place pour un contexte long et pour travailler à côté. | LLM Texte avec LM Studio ou Ollama | Ouvert vérifiez la licence exacte du modèle avant de vendre |
| Qwen3-VL-8B-Instruct Alibaba indice 7 | plancher éditeur | 2,3 Go en 4 bits | Tient largement Il reste de la place pour un contexte long et pour travailler à côté. | Multimodal avec LM Studio ou Ollama | Ouvert vérifiez la licence exacte du modèle avant de vendre |
|
Phi-4
Microsoft
indice 6
Où le téléchargerLe dépôt officiel sur Hugging Face
|
14 Md | 16,1 Go en 8 bits | Tient largement Il reste de la place pour un contexte long et pour travailler à côté. | LLM Texte avec LM Studio ou Ollama | Ouvert vérifiez la licence exacte du modèle avant de vendre |
| Petit modèle taillé pour le raisonnement et le code. C'est l'exemple type du modèle qu'on spécialise avec un RAG ou un LoRA plutôt que d'aller chercher plus gros. | |||||
|
Phi-4-mini
Microsoft
indice 6
Où le téléchargerLe dépôt officiel sur Hugging Face
|
plancher éditeur | 2,5 Go en 4 bits | Tient largement Il reste de la place pour un contexte long et pour travailler à côté. | LLM Texte avec LM Studio ou Ollama | Ouvert vérifiez la licence exacte du modèle avant de vendre |
|
Qwen2.5-Coder-7B-Instruct
Alibaba
indice 6
Où le téléchargerLe dépôt officiel sur Hugging Face
|
7 Md | 16,1 Go en pleine précision | Tient largement Il reste de la place pour un contexte long et pour travailler à côté. | LLM Texte avec LM Studio ou Ollama | Ouvert vérifiez la licence exacte du modèle avant de vendre |
|
Qwen3-Omni 30B-A3B Instruct
Alibaba
indice 6
Où le téléchargerLe dépôt officiel sur Hugging FaceLe poids du fichier est la mémoire qu'il réclame : une version plus légère tourne sur une plus petite carte. |
plancher éditeur | 18,6 Go en 4 bits | Tient largement Il reste de la place pour un contexte long et pour travailler à côté. | Multimodal avec LM Studio ou Ollama | Ouvert vérifiez la licence exacte du modèle avant de vendre |
| Qwen3-VL-4B-Instruct Alibaba indice 6 | 4,44 Md | 10,2 Go en pleine précision | Tient largement Il reste de la place pour un contexte long et pour travailler à côté. | Multimodal avec LM Studio ou Ollama | Ouvert vérifiez la licence exacte du modèle avant de vendre |
|
Qwen3.5-0.8B
Alibaba
indice 6
Où le téléchargerLe dépôt officiel sur Hugging Face
|
0,8 Md | 1,8 Go en pleine précision | Tient largement Il reste de la place pour un contexte long et pour travailler à côté. | LLM Texte avec LM Studio ou Ollama | Ouvert vérifiez la licence exacte du modèle avant de vendre |
|
Gemma 3 4B
Google
indice 5
Où le téléchargerLe dépôt officiel sur Hugging Face
|
plancher éditeur | 2,5 Go en 4 bits | Tient largement Il reste de la place pour un contexte long et pour travailler à côté. | LLM Texte avec LM Studio ou Ollama | Ouvert vérifiez la licence exacte du modèle avant de vendre |
|
LFM2.5-VL-1.6B
Liquid AI
indice 5
Où le téléchargerLe dépôt officiel sur Hugging Face
|
1,6 Md | 3,7 Go en pleine précision | Tient largement Il reste de la place pour un contexte long et pour travailler à côté. | Multimodal avec LM Studio ou Ollama | Ouvert vérifiez la licence exacte du modèle avant de vendre |
|
2x-AnimeSharpV4
Kim2091
indice 0
Où le téléchargerLe dépôt officiel sur Hugging Face
|
plancher éditeur | 0,1 Go en 4 bits | Tient largement Il reste de la place pour un contexte long et pour travailler à côté. | Generative Image avec ComfyUI | Propriétaire |
|
ABot-World-0-5B-LF
acvlab
indice 0
Où le téléchargerLe dépôt officiel sur Hugging Face
|
plancher éditeur | 23 Go en 4 bits | Tient largement Il reste de la place pour un contexte long et pour travailler à côté. | Generative Video avec ComfyUI | Propriétaire |
|
ACE-Step 1.5
ACE-Step
indice 0
Où le téléchargerLe dépôt officiel sur Hugging Face
|
plancher éditeur | 0,8 Go en 4 bits | Tient largement Il reste de la place pour un contexte long et pour travailler à côté. | Generative Audio avec ComfyUI | Ouvert vérifiez la licence exacte du modèle avant de vendre |
|
Ace-Step-1.5-ScragVAE
scragnog
indice 0
Où le téléchargerLe dépôt officiel sur Hugging Face
|
plancher éditeur | 1 Go en 4 bits | Tient largement Il reste de la place pour un contexte long et pour travailler à côté. | Generative Audio avec ComfyUI | Propriétaire |
|
ACE-Step-v1-3.5B
ACE-Step
indice 0
Où le téléchargerLe dépôt officiel sur Hugging Face
|
plancher éditeur | 7,7 Go en 4 bits | Tient largement Il reste de la place pour un contexte long et pour travailler à côté. | Generative Audio avec ComfyUI | Propriétaire |
|
ACE-Step-v1-chinese-rap-LoRA
ACE-Step
indice 0
Où le téléchargerLe dépôt officiel sur Hugging Face
|
plancher éditeur | 0,5 Go en 4 bits | Tient largement Il reste de la place pour un contexte long et pour travailler à côté. | Generative Audio avec ComfyUI | Propriétaire |
|
Ace-Step1.5-XL-DF11-ComfyUI
mingyi456
indice 0
Où le téléchargerLe dépôt officiel sur Hugging Face
|
plancher éditeur | 19 Go en 4 bits | Tient largement Il reste de la place pour un contexte long et pour travailler à côté. | Generative Audio avec ComfyUI | Propriétaire |
|
acestep-5Hz-lm-0.6B
ACE-Step
indice 0
Où le téléchargerLe dépôt officiel sur Hugging Face
|
plancher éditeur | 1,2 Go en 4 bits | Tient largement Il reste de la place pour un contexte long et pour travailler à côté. | Generative Audio avec ComfyUI | Propriétaire |
|
acestep-5Hz-lm-4B
ACE-Step
indice 0
Où le téléchargerLe dépôt officiel sur Hugging Face
|
plancher éditeur | 7,8 Go en 4 bits | Tient largement Il reste de la place pour un contexte long et pour travailler à côté. | Generative Audio avec ComfyUI | Propriétaire |
|
acestep-captioner
ACE-Step
indice 0
Où le téléchargerLe dépôt officiel sur Hugging Face
|
plancher éditeur | 20,8 Go en 4 bits | Tient largement Il reste de la place pour un contexte long et pour travailler à côté. | Generative Audio avec ComfyUI | Propriétaire |
|
acestep-v15-base
ACE-Step
indice 0
Où le téléchargerLe dépôt officiel sur Hugging Face
|
plancher éditeur | 4,5 Go en 4 bits | Tient largement Il reste de la place pour un contexte long et pour travailler à côté. | Generative Audio avec ComfyUI | Propriétaire |
|
acestep-v15-sft
ACE-Step
indice 0
Où le téléchargerLe dépôt officiel sur Hugging Face
|
plancher éditeur | 4,5 Go en 4 bits | Tient largement Il reste de la place pour un contexte long et pour travailler à côté. | Generative Audio avec ComfyUI | Propriétaire |
|
acestep-v15-xl-base
ACE-Step
indice 0
Où le téléchargerLe dépôt officiel sur Hugging Face
|
plancher éditeur | 18,6 Go en 4 bits | Tient largement Il reste de la place pour un contexte long et pour travailler à côté. | Generative Audio avec ComfyUI | Propriétaire |
|
acestep-v15-xl-sft
ACE-Step
indice 0
Où le téléchargerLe dépôt officiel sur Hugging Face
|
plancher éditeur | 18,6 Go en 4 bits | Tient largement Il reste de la place pour un contexte long et pour travailler à côté. | Generative Audio avec ComfyUI | Propriétaire |
|
acestep-v15-xl-turbo-diffusers
ACE-Step
indice 0
Où le téléchargerLe dépôt officiel sur Hugging Face
|
plancher éditeur | 10,3 Go en 4 bits | Tient largement Il reste de la place pour un contexte long et pour travailler à côté. | Generative Audio avec ComfyUI | Propriétaire |
|
ActionMesh
facebook
indice 0
Où le téléchargerLe dépôt officiel sur Hugging Face
|
plancher éditeur | 6,2 Go en 4 bits | Tient largement Il reste de la place pour un contexte long et pour travailler à côté. | Generative 3D avec LM Studio ou Ollama | Propriétaire |
|
AlayaWorld
AlayaLab
indice 0
Où le téléchargerLe dépôt officiel sur Hugging Face
|
plancher éditeur | 31,3 Go en 4 bits | Tient, mais juste Ça entre. Réduisez le contexte si vous voyez des ralentissements, et fermez les jeux et navigateurs qui mangent de la mémoire vidéo. | Generative Video avec ComfyUI | Propriétaire |
|
amanatsu-illustrious-v11-sdxl
John6666
indice 0
Où le téléchargerLe dépôt officiel sur Hugging Face
|
plancher éditeur | 6,9 Go en 4 bits | Tient largement Il reste de la place pour un contexte long et pour travailler à côté. | Generative Image avec ComfyUI | Propriétaire |
| Anima 2.9B Gazingstars123 indice 0 | 2,9 Md | 6,7 Go en pleine précision | Tient largement Il reste de la place pour un contexte long et pour travailler à côté. | Generative Image avec ComfyUI | Ouvert vérifiez la licence exacte du modèle avant de vendre |
|
animagine-xl-3.0
cagliostrolab
indice 0
Où le téléchargerLe dépôt officiel sur Hugging Face
|
plancher éditeur | 12,9 Go en 4 bits | Tient largement Il reste de la place pour un contexte long et pour travailler à côté. | Generative Image avec ComfyUI | Propriétaire |
127 modèles ne tiennent pas sur cette machine, même en débordant — les voir quand même
Ils sont là pour situer la frontière : au-delà, c'est le cloud,
quelle que soit la carte qu'on achète. Rien n'est caché, c'est juste rangé.
On en montre 30 sur 127 :
les plus proches de votre machine. Les suivants s'en éloignent sans rien
vous apprendre de plus, et les afficher tous alourdirait la page de
plusieurs centaines de kilo-octets.
| Modèle | Taille | Il faut | Chez vous | Pour quoi faire | Usage commercial |
|---|---|---|---|---|---|
|
MiMo-V2.6-Pro
XiaomiMiMo
indice 46
Où le téléchargerLe dépôt officiel sur Hugging Face |
1024 Md | 588,8 Go en 4 bits | Hors de portée Même en débordant sur la mémoire vive, il n'y a pas la place. Il faudrait une carte plus grande, ou un modèle plus petit. | Multimodal avec LM Studio ou Ollama | Ouvert vérifiez la licence exacte du modèle avant de vendre |
| Dépôt XiaomiMiMo/MiMo-V2.6-Pro-RL : plus de mille milliards de paramètres. Ouvert, mais hors de portée de tout matériel personnel. | |||||
| Kimi K3 (poids ouverts) Moonshot AI indice 44 | plancher éditeur | 509 Go en 4 bits | Hors de portée Même en débordant sur la mémoire vive, il n'y a pas la place. Il faudrait une carte plus grande, ou un modèle plus petit. | LLM Texte avec LM Studio ou Ollama | Propriétaire |
|
Qwen3.8 2.4T A95B
Alibaba
indice 40
Où le téléchargerLe dépôt officiel sur Hugging Face
|
2400 Md dont 95 Md actifs | 1380 Go en 4 bits | Hors de portée Même en débordant sur la mémoire vive, il n'y a pas la place. Il faudrait une carte plus grande, ou un modèle plus petit. | LLM Texte avec LM Studio ou Ollama | Ouvert vérifiez la licence exacte du modèle avant de vendre |
| Le « A95B » du nom désigne les paramètres ACTIFS. Hors de portée d'une machine personnelle : il faut loger les 2 400 milliards en mémoire, même si seuls 95 travaillent à chaque jeton. | |||||
|
Qwen3.8-Flash-Next
Alibaba
indice 40
Où le téléchargerLe dépôt officiel sur Hugging Face |
180 Md | 103,5 Go en 4 bits | Hors de portée Même en débordant sur la mémoire vive, il n'y a pas la place. Il faudrait une carte plus grande, ou un modèle plus petit. | Multimodal avec LM Studio ou Ollama | Ouvert vérifiez la licence exacte du modèle avant de vendre |
|
GLM-5.2
Z.AI
indice 34
Où le téléchargerLe dépôt officiel sur Hugging Face
|
753 Md | 433 Go en 4 bits | Hors de portée Même en débordant sur la mémoire vive, il n'y a pas la place. Il faudrait une carte plus grande, ou un modèle plus petit. | LLM Texte avec LM Studio ou Ollama | Ouvert vérifiez la licence exacte du modèle avant de vendre |
|
Motif 3
Motif Technologies
indice 34
Où le téléchargerLe dépôt officiel sur Hugging Face |
314,84 Md | 181 Go en 4 bits | Hors de portée Même en débordant sur la mémoire vive, il n'y a pas la place. Il faudrait une carte plus grande, ou un modèle plus petit. | LLM Texte avec LM Studio ou Ollama | Ouvert vérifiez la licence exacte du modèle avant de vendre |
|
MiniMax-M3
MiniMax
indice 29
Où le téléchargerLe dépôt officiel sur Hugging Face
|
427 Md | 245,5 Go en 4 bits | Hors de portée Même en débordant sur la mémoire vive, il n'y a pas la place. Il faudrait une carte plus grande, ou un modèle plus petit. | Multimodal avec LM Studio ou Ollama | Ouvert vérifiez la licence exacte du modèle avant de vendre |
|
Kimi K2.6
Moonshot AI
indice 27
Où le téléchargerLe dépôt officiel sur Hugging Face
|
1000 Md | 575 Go en 4 bits | Hors de portée Même en débordant sur la mémoire vive, il n'y a pas la place. Il faudrait une carte plus grande, ou un modèle plus petit. | Multimodal avec LM Studio ou Ollama | Ouvert vérifiez la licence exacte du modèle avant de vendre |
| Mille milliards de paramètres. Ouvert, téléchargeable… et hors de portée de tout matériel personnel. C'est utile de le voir écrit. | |||||
|
Ling 3.0 Flash
inclusionAI
indice 25
Où le téléchargerLe dépôt officiel sur Hugging Face |
127,49 Md | 73,3 Go en 4 bits | Hors de portée Même en débordant sur la mémoire vive, il n'y a pas la place. Il faudrait une carte plus grande, ou un modèle plus petit. | LLM Texte avec LM Studio ou Ollama | Ouvert vérifiez la licence exacte du modèle avant de vendre |
|
Nemotron 3 Ultra
NVIDIA
indice 23
Où le téléchargerLe dépôt officiel sur Hugging Face
|
550 Md dont 55 Md actifs | 316,3 Go en 4 bits | Hors de portée Même en débordant sur la mémoire vive, il n'y a pas la place. Il faudrait une carte plus grande, ou un modèle plus petit. | LLM Texte avec LM Studio ou Ollama | Ouvert vérifiez la licence exacte du modèle avant de vendre |
|
Qwen3.5-122B-A10B
Alibaba
indice 18
Où le téléchargerLe dépôt officiel sur Hugging Face
|
plancher éditeur | 36,7 Go en 4 bits | Hors de portée Même en débordant sur la mémoire vive, il n'y a pas la place. Il faudrait une carte plus grande, ou un modèle plus petit. | LLM Texte avec LM Studio ou Ollama | Ouvert vérifiez la licence exacte du modèle avant de vendre |
|
Mistral Medium 3.5
Mistral
indice 14
Où le téléchargerLe dépôt officiel sur Hugging Face
|
128 Md | 73,6 Go en 4 bits | Hors de portée Même en débordant sur la mémoire vive, il n'y a pas la place. Il faudrait une carte plus grande, ou un modèle plus petit. | LLM Texte avec LM Studio ou Ollama | Ouvert vérifiez la licence exacte du modèle avant de vendre |
|
Nemotron 3 Super
NVIDIA
indice 13
Où le téléchargerLe dépôt officiel sur Hugging Face
|
120 Md dont 12 Md actifs | 69 Go en 4 bits | Hors de portée Même en débordant sur la mémoire vive, il n'y a pas la place. Il faudrait une carte plus grande, ou un modèle plus petit. | LLM Texte avec LM Studio ou Ollama | Ouvert vérifiez la licence exacte du modèle avant de vendre |
|
gpt-oss 120B
OpenAI
indice 12
Où le téléchargerLe dépôt officiel sur Hugging Face
|
120 Md | 69 Go en 4 bits | Hors de portée Même en débordant sur la mémoire vive, il n'y a pas la place. Il faudrait une carte plus grande, ou un modèle plus petit. | LLM Texte avec LM Studio ou Ollama | Ouvert vérifiez la licence exacte du modèle avant de vendre |
| Mélange d'experts : il occupe la mémoire de ses 120 milliards, mais il calcule beaucoup plus vite que sa taille ne le laisse croire. Le nombre exact de paramètres actifs n'est pas repris ici tant qu'il n'est pas relevé chez l'éditeur. | |||||
|
DeepSeek R1
DeepSeek
indice 11
Où le téléchargerLe dépôt officiel sur Hugging Face
|
685 Md | 393,9 Go en 4 bits | Hors de portée Même en débordant sur la mémoire vive, il n'y a pas la place. Il faudrait une carte plus grande, ou un modèle plus petit. | Raisonnement avec LM Studio ou Ollama | Ouvert vérifiez la licence exacte du modèle avant de vendre |
|
Mistral Small 4
Mistral
indice 11
Où le téléchargerLe dépôt officiel sur Hugging Face
|
119 Md | 68,4 Go en 4 bits | Hors de portée Même en débordant sur la mémoire vive, il n'y a pas la place. Il faudrait une carte plus grande, ou un modèle plus petit. | LLM Texte avec LM Studio ou Ollama | Ouvert vérifiez la licence exacte du modèle avant de vendre |
| Dépôt mistralai/Mistral-Small-4-119B. « Small » est un nom de gamme, plus une taille : 119 milliards, ça ne tient pas sur une carte grand public. | |||||
|
Llama 4 Maverick
Meta
indice 10
Où le téléchargerLe dépôt officiel sur Hugging Face
|
402 Md dont 17 Md actifs | 231,2 Go en 4 bits | Hors de portée Même en débordant sur la mémoire vive, il n'y a pas la place. Il faudrait une carte plus grande, ou un modèle plus petit. | LLM Texte avec LM Studio ou Ollama | Ouvert vérifiez la licence exacte du modèle avant de vendre |
| 128 experts pour 17 milliards actifs. Hors de portée d'une machine personnelle malgré son étiquette « 17B ». | |||||
|
Nemotron 3 Nano Omni 30B
NVIDIA
indice 10
Où le téléchargerLe dépôt officiel sur Hugging Face
|
plancher éditeur | 71 Go en 4 bits | Hors de portée Même en débordant sur la mémoire vive, il n'y a pas la place. Il faudrait une carte plus grande, ou un modèle plus petit. | Multimodal avec LM Studio ou Ollama | Ouvert vérifiez la licence exacte du modèle avant de vendre |
|
Mistral Large 3
Mistral
indice 9
Où le téléchargerLe dépôt officiel sur Hugging Face
|
675 Md | 388,1 Go en 4 bits | Hors de portée Même en débordant sur la mémoire vive, il n'y a pas la place. Il faudrait une carte plus grande, ou un modèle plus petit. | LLM Texte avec LM Studio ou Ollama | Ouvert vérifiez la licence exacte du modèle avant de vendre |
|
Llama 4 Scout
Meta
indice 8
Où le téléchargerLe dépôt officiel sur Hugging Face
|
109 Md dont 17 Md actifs | 62,7 Go en 4 bits | Hors de portée Même en débordant sur la mémoire vive, il n'y a pas la place. Il faudrait une carte plus grande, ou un modèle plus petit. | LLM Texte avec LM Studio ou Ollama | Ouvert vérifiez la licence exacte du modèle avant de vendre |
| 16 experts. Annoncé « 17B » un peu partout, mais ce sont les paramètres ACTIFS : il faut loger les 109 milliards en mémoire. | |||||
|
Qwen3-Omni 30B-A3B Thinking
Alibaba
indice 8
Où le téléchargerLe dépôt officiel sur Hugging Face
|
plancher éditeur | 63,4 Go en 4 bits | Hors de portée Même en débordant sur la mémoire vive, il n'y a pas la place. Il faudrait une carte plus grande, ou un modèle plus petit. | Multimodal avec LM Studio ou Ollama | Ouvert vérifiez la licence exacte du modèle avant de vendre |
|
A.X-K2-Raon-Speech-21B-A3B
KRAFTON
indice 0
Où le téléchargerLe dépôt officiel sur Hugging Face
|
plancher éditeur | 39,5 Go en 4 bits | Hors de portée Même en débordant sur la mémoire vive, il n'y a pas la place. Il faudrait une carte plus grande, ou un modèle plus petit. | Multimodal avec LM Studio ou Ollama | Propriétaire |
|
AnimeGen-T2V
aidealab
indice 0
Où le téléchargerLe dépôt officiel sur Hugging Face
|
plancher éditeur | 53,2 Go en 4 bits | Hors de portée Même en débordant sur la mémoire vive, il n'y a pas la place. Il faudrait une carte plus grande, ou un modèle plus petit. | Generative Video avec ComfyUI | Propriétaire |
|
Bernini-Diffusers
ByteDance
indice 0
Où le téléchargerLe dépôt officiel sur Hugging Face
|
plancher éditeur | 179 Go en 4 bits | Hors de portée Même en débordant sur la mémoire vive, il n'y a pas la place. Il faudrait une carte plus grande, ou un modèle plus petit. | Generative Video avec ComfyUI | Propriétaire |
|
Bernini-R
ByteDance
indice 0
Où le téléchargerLe dépôt officiel sur Hugging Face
|
plancher éditeur | 157 Go en 4 bits | Hors de portée Même en débordant sur la mémoire vive, il n'y a pas la place. Il faudrait une carte plus grande, ou un modèle plus petit. | Generative Video avec ComfyUI | Propriétaire |
|
Chroma1-Base
lodestones
indice 0
Où le téléchargerLe dépôt officiel sur Hugging Face
|
plancher éditeur | 42,2 Go en 4 bits | Hors de portée Même en débordant sur la mémoire vive, il n'y a pas la place. Il faudrait une carte plus grande, ou un modèle plus petit. | Generative Image avec ComfyUI | Propriétaire |
|
Chroma1-Flash
lodestones
indice 0
Où le téléchargerLe dépôt officiel sur Hugging Face
|
plancher éditeur | 58,8 Go en 4 bits | Hors de portée Même en débordant sur la mémoire vive, il n'y a pas la place. Il faudrait une carte plus grande, ou un modèle plus petit. | Generative Image avec ComfyUI | Propriétaire |
|
Chroma1-HD
lodestones
indice 0
Où le téléchargerLe dépôt officiel sur Hugging Face
|
plancher éditeur | 42,2 Go en 4 bits | Hors de portée Même en débordant sur la mémoire vive, il n'y a pas la place. Il faudrait une carte plus grande, ou un modèle plus petit. | Generative Image avec ComfyUI | Propriétaire |
|
ComfyUI-Starter-Packs
MaxedOut
indice 0
Où le téléchargerLe dépôt officiel sur Hugging Face
|
plancher éditeur | 542 Go en 4 bits | Hors de portée Même en débordant sur la mémoire vive, il n'y a pas la place. Il faudrait une carte plus grande, ou un modèle plus petit. | Generative Image avec ComfyUI | Propriétaire |
|
Cosmos-1.0-Diffusion-7B-Text2World
nvidia
indice 0
Où le téléchargerLe dépôt officiel sur Hugging Face
|
plancher éditeur | 36,5 Go en 4 bits | Hors de portée Même en débordant sur la mémoire vive, il n'y a pas la place. Il faudrait une carte plus grande, ou un modèle plus petit. | Generative Video avec ComfyUI | Propriétaire |
Pas encore relevés — 22 modèles
Ces modèles sont bien au catalogue et tournent en local, mais nous n'avons pas encore relevé leur taille chez leur éditeur, ou mesuré ce qu'ils demandent réellement. Nous préférons l'écrire plutôt que de vous donner une estimation qui aurait l'air juste. Ils arriveront dans le tableau au fur et à mesure des essais — chaque ligne du tableau vient d'une source ouverte ou d'une mesure faite sur une vraie carte.
- GLM-5.3
Z AI · LLM Texte
Où le téléchargerLe dépôt officiel sur Hugging Face
- GLM-5.3-Flash
Z AI · LLM Texte
Où le téléchargerLe dépôt officiel sur Hugging Face
- DeepSeek V4.1 Flash
DeepSeek · LLM Texte
Où le téléchargerLe dépôt officiel sur Hugging Face
- K2 Horizon 375B A23B
MBZUAI Institute of Foundation Models · LLM Texte
Où le téléchargerLe dépôt officiel sur Hugging Face
- Inkling
Thinking Machines · LLM Texte
Où le téléchargerLe dépôt officiel sur Hugging Face
- comfy-MiniMax-H3-workflows
javawock7618 · Generative Audio
Où le téléchargerLe dépôt officiel sur Hugging Face
- DeepFilterNet3-CoreML
aufklarer · Generative Audio
Où le téléchargerLe dépôt officiel sur Hugging FaceLe poids du fichier est la mémoire qu'il réclame : une version plus légère tourne sur une plus petite carte.
- flux-ip-adapter-v2
XLabs-AI · Generative Image
Où le téléchargerLe dépôt officiel sur Hugging FaceLe poids du fichier est la mémoire qu'il réclame : une version plus légère tourne sur une plus petite carte.
- H3_Character_Sheet_Generator
PoopMan333 · Generative Image
Où le téléchargerLe dépôt officiel sur Hugging Face
- krea2filterbypass3.safetensors
uzumix · Generative Image
Où le téléchargerLe dépôt officiel sur Hugging Face
- Krea2OstrisEdit
ostris · Generative Image
Où le téléchargerLe dépôt officiel sur Hugging Face
- LTX-2.3-2.5-Workflows
RuneXX · Generative Video
Où le téléchargerLe dépôt officiel sur Hugging Face
- MiniMax-H3-Multishot-Workflow
joeygambino · Generative Video
Où le téléchargerLe dépôt officiel sur Hugging Face
- OmniNeural-4B
NexaAI · Multimodal
Où le téléchargerLe dépôt officiel sur Hugging Face
- Real-ESRGAN-x4plus
qualcomm · Generative Image
Où le téléchargerLe dépôt officiel sur Hugging Face
- rvc-v2-models
sxndypz · Generative Audio
Où le téléchargerLe dépôt officiel sur Hugging Face
- TIGER-speech
JusperLee · Generative Audio
Où le téléchargerLe dépôt officiel sur Hugging FaceLe poids du fichier est la mémoire qu'il réclame : une version plus légère tourne sur une plus petite carte.
- tiny-random-flux.2-klein
optimum-intel-internal-testing · Generative Image
Où le téléchargerLe dépôt officiel sur Hugging FaceLe poids du fichier est la mémoire qu'il réclame : une version plus légère tourne sur une plus petite carte.
- tiny-random-latent-consistency
optimum-intel-internal-testing · Generative Image
Où le téléchargerLe dépôt officiel sur Hugging Face
- Z-Image-Turbo-LiteRT
litert-community · Generative Image
Où le téléchargerLe dépôt officiel sur Hugging Face
- FLUX.2 [klein] Black Forest Labs · Generative Image
- Krea 2 Krea · Generative Image
Avec quel logiciel ?
Un modèle est un fichier : il lui faut un logiciel pour tourner. Tous ceux-ci sont gratuits et s'installent en quelques minutes.
Notre guide : quel logiciel gratuit pour faire tourner une IA en local
Pourquoi nos chiffres ne sont pas ceux des autres
La plupart des sites qui répondent à cette question calculent un seuil à partir d'une fiche technique. Nous faisons les deux : le calcul de mémoire est expliqué ci-dessous et vous pouvez le refaire vous-même, et les vitesses affichées viennent d'essais réels sur de vraies cartes — pas d'une formule.
Le calcul, en clair. Un modèle occupe son nombre de paramètres multiplié par le poids de chaque paramètre : 2 octets en pleine précision, 1 octet en 8 bits, un demi-octet en 4 bits. Un modèle de 27 milliards en 4 bits demande donc environ 13,5 Go, plus une marge d'environ 15 % pour le contexte et le fonctionnement du logiciel. Quantifier, c'est réduire la précision de chaque paramètre pour tenir dans moins de mémoire : en 4 bits, la perte de qualité est faible et le gain de place énorme. C'est la première chose à essayer.
Et pour les modèles à experts (MoE), la mémoire suit la taille totale, pas les paramètres actifs : tous les experts doivent être chargés, même si quelques-uns seulement travaillent à chaque mot. C'est pourquoi un modèle annoncé « rapide » peut rester impossible à loger chez soi.