Accueil / Sous-catégories

Carte graphique pour LLM en local

Faire tourner Llama, Qwen, Mistral en local (Ollama, LM Studio) dépend surtout de la VRAM : 16 Go pour des modèles ~13B, 24 Go pour 24-32B, 32 Go pour les gros. Notre sélection classée par VRAM.

Notre sélection

Prix Amazon indicatifs · liens affiliés Amazon Partenaires.

Questions fréquentes

Combien de VRAM pour un LLM en local ?
8-12 Go pour un 7B quantifié, 16 Go pour du 13B, 24 Go pour 24-32B (zone de confort), 48 Go+ pour un 70B.
La RTX 3090 d'occasion est-elle un bon choix ?
Oui : 24 Go de VRAM au meilleur rapport mémoire/prix pour l'IA locale, perf proche d'une RTX 5070.
Quelle carte pour les gros modèles ?
La RTX 5090 32 Go pour le grand public ; sinon deux RTX 3090 24 Go (48 Go cumulés) en multi-GPU.