Matériel et IAMis à jour le 31 août 202640 min de lecture

Meilleure carte graphique pour l'IA locale en 2026 : 7 GPU comparées par VRAM, et ce qui rentre vraiment en mémoire

Meilleure carte graphique pour l'IA locale en 2026, les modèles comparés

Sept cartes classées sur la seule chose qui décide en IA locale : la mémoire. Combien de VRAM demande chaque modèle en Q4, Q8 et FP16, quelle carte l'accepte et laquelle ne l'accepte pas, avec l'arithmétique posée au lieu de débits que nous n'avons pas mesurés. Plus la consommation annuelle en kilowattheures et ce que la garantie légale française couvre sur une carte d'occasion.

Ce guide contient des liens affiliés. En tant que Partenaire Amazon, m8d.io réalise un bénéfice sur les achats remplissant les conditions requises, sans surcoût pour vous.

La meilleure carte graphique pour l'IA locale dépend d'une seule chose : la taille du modèle que vous voulez faire tourner. Pour un modèle de 70 milliards de paramètres en Q4_K_M, il faut environ 39 Go, et la GIGABYTE Radeon AI Pro R9700 (32 Go) est la seule de cette page à s'en approcher sur une seule carte. Pour Stable Diffusion XL et les modèles jusqu'à 13B, la RX 9060 XT 16G suffit. Et si la machine doit tourner en continu sans bruit, la RTX Pro 2000 Blackwell annonce 70 W.

Mis à jour le 31 août 2026 En tant que Partenaire Amazon, m8d.io réalise un bénéfice sur les achats remplissant les conditions requises.
Les points qui décident
  • La VRAM est le plafond, pas la vitesse : une carte ne peut pas faire tourner un modèle qui ne rentre pas dans sa mémoire. En 2026, aucun modèle sérieux ne tient sous 16 Go. Huit gigaoctets ne servent qu'à un modèle 7B en Q4 sans contexte long.
  • CUDA garde l'avantage pour la recherche (PyTorch, transformers, vLLM, xformers, fine-tuning). ROCm est aujourd'hui utilisable pour l'inférence avec llama.cpp et ollama.
  • La zone confortable en 2026 : 16 à 24 Go couvrent la grande majorité des usages réels, modèles jusqu'à 30B en Q4 plus Stable Diffusion XL avec LoRA.
  • La gamme Pro Blackwell annonce 70 W de TDP dans des formats compacts : c'est ce qui rend possible une station silencieuse qui tourne jour et nuit.
  • Une seule carte de cette page dépasse les 32 Go de mémoire, et c'est ce qui permet de charger un modèle 70B en Q4_K_M sans passer au multi-GPU.
  • En France, l'occasion reste protégée : vendue par un professionnel, une carte d'occasion garde la garantie légale de conformité, avec douze mois de présomption au lieu de vingt-quatre (article L217-7 du code de la consommation).

Pourquoi la carte graphique est le goulot d'étranglement de l'IA locale

Faire tourner des modèles génératifs chez soi n'a plus rien d'exotique : Llama, Qwen, Gemma et Mistral publient des poids ouverts chaque trimestre, et des outils comme llama.cpp, ollama, exllamav2 et vLLM montent un point d'accès local en quelques minutes. Mais un composant décide si votre installation fonctionne ou étouffe : la mémoire de la carte graphique. Un modèle de 13 milliards de paramètres en FP16 occupe 26 Go. Le même en Q4 tombe à 7 Go. La carte n'est pas une option, c'est le plafond de ce que vous pouvez faire tourner.

Et une remarque avant d'entrer dans le détail, parce qu'elle évite une erreur de budget classique : une carte de ce niveau se met dans une machine, et le reste du poste compte. La sortie vidéo finit sur un moniteur, où la question n'est pas la même que pour du jeu, et notre guide de l'écran PC de 27 pouces explique la règle des watts en USB-C qui décide si un seul câble suffira. Et si l'idée derrière l'IA locale est de ne pas dépendre du nuage, la question se pose aussi sur les appareils du quotidien : c'est le sujet de notre guide de la tablette au meilleur rapport qualité-prix, où la mémoire vive joue exactement le même rôle de plafond.

0
Go
VRAM maximale de la page
0
TOPS
Annoncés sur la RTX Pro 2000
0
Go
Un modèle 70B en Q4_K_M
0
W
TDP annoncé le plus bas
// Comment nous avons évalué

Chaque carte est jugée sur cinq critères vérifiables : la VRAM totale (le plafond de modèle), la largeur du bus mémoire (ce qui décide du débit quand le contexte s'allonge), le type de mémoire (GDDR6, GDDR6 ECC ou GDDR7), l'écosystème logiciel (CUDA, ROCm, et la stabilité des pilotes) et le TDP annoncé, qui décide du bruit, de l'alimentation et de la consommation.

Nous n'avons pas eu ces sept cartes entre les mains et nous ne publions aucune mesure de débit maison : ni jetons par seconde, ni temps de génération, ni consommation au wattmètre. Ce serait invérifiable et ce n'est pas notre métier ici. Ce que nous faisons à la place est de l'arithmétique sur des chiffres publiés : la taille des poids quantifiés d'un côté, la VRAM déclarée par le constructeur de l'autre. Le résultat est le tableau « ce qui rentre » plus bas, et il se refait à la main en deux minutes.

Les tailles de modèles proviennent des poids ouverts publiés et de la documentation de llama.cpp et de Hugging Face, deux références internationales. Le catalogue produit est celui d'Amazon Espagne, relu le 31 août 2026 : la disponibilité et les références varient d'un pays à l'autre, vérifiez sur la fiche qui s'ouvre.

Comparatif technique : les 7 cartes face à face

Avant toute appréciation, les chiffres bruts. L'écart entre une carte de 8 Go et une de 32 Go n'est pas de vingt pour cent de performance : c'est quatre fois plus de modèles qui rentrent, ou pas. C'est ce qui décide.

Carte VRAM Type Bus TDP annoncé Écosystème Le modèle le plus lourd qui rentre
GIGABYTE Radeon AI Pro R9700 32 GoGDDR6256 bits300 W ROCm 70B en Q4_K_M, sur une seule carte
ASUS Turbo AI Pro R9700 32 GoGDDR6256 bits300 W ROCm Idem, et empilable en multi-GPU
PNY RTX Pro 4000 SFF Blackwell 24 GoGDDR7192 bits70 W CUDA complet 33B en Q4, avec de la marge de contexte
PNY RTX Pro 2000 Blackwell 16 GoGDDR7128 bits70 W CUDA complet 14B en Q8, ou 33B en Q3
PNY RTX 2000 Ada Generation 16 GoGDDR6 ECC128 bits70 W CUDA complet 14B en Q8, avec correction d'erreurs
GIGABYTE RX 9060 XT Gaming 16G 16 GoGDDR6128 bits180 W ROCm Stable Diffusion XL avec LoRA, et 13B en Q8
MSI RTX 5060 Ti 8G Ventus 8 GoGDDR7128 bits180 W CUDA complet 8B en Q4, sans contexte long

Lecture honnête : les 8 Go de la RTX 5060 Ti la sortent de tout usage sérieux de modèles de langage. Sa place est chez quelqu'un qui veut juste essayer la génération d'images sans y mettre le budget d'une carte professionnelle. À partir de 16 Go le paysage s'ouvre ; à partir de 24 Go on entre dans le territoire professionnel.

Un mot sur la PNY RTX Pro 4000 SFF Blackwell, qui reste dans ce tableau et pas dans notre trio de tête. C'est le meilleur rapport mémoire/consommation de la page, 24 Go pour 70 W annoncés dans un format qui entre en mini-ITX, et sur le papier c'est la carte la plus élégante de la sélection. Sa disponibilité est en revanche irrégulière selon les pays et les périodes, ce qui n'en fait pas une recommandation par défaut : nous préférons mettre en avant une carte que vous pourrez recevoir. Si vous la trouvez chez vous, c'est un excellent choix pour une station compacte ; sinon, la RTX Pro 2000 Blackwell tient la même promesse d'efficacité avec 16 Go.

Combien de VRAM selon le modèle que vous voulez faire tourner

Avant d'acheter, définissez les modèles que vous allez utiliser. Ce tableau donne la place occupée par les poids des modèles ouverts les plus courants, dans leurs trois quantifications habituelles. Ce sont des tailles de fichiers publiés, pas des mesures de notre part. Elles n'incluent pas le cache de contexte, qui ajoute facilement 4 à 8 Go selon la fenêtre.

Modèle FP16 (complet) Q8 (haute qualité) Q4_K_M (standard) Q3 (dégradé)
Llama 3 8B16 Go8,5 Go4,7 Go3,5 Go
Qwen 2.5 14B28 Go15 Go8,2 Go6,1 Go
Llama 3 70B140 Go70 Go39 Go29 Go
Mixtral 8x7B87 Go47 Go26 Go19 Go
DeepSeek-Coder 33B66 Go35 Go19 Go14 Go
Stable Diffusion XL9 Gon/d5,5 Gon/d
FLUX.1 [dev]23 Go16 Go12 Gon/d
Calculatrice de VRAM : est-ce que ça rentre ?
Choisissez un modèle et une quantification pour voir la place occupée et les cartes de cette page qui l'acceptent.
39 Go de VRAM nécessaires
plus 4 à 8 Go de cache de contexte selon la fenêtre

Assistant : trouvez votre carte en 3 questions

Si vous hésitez, ce sélecteur croise vos trois variables décisives (usage principal, taille de modèle visée, enveloppe) et renvoie la carte la plus alignée sur votre besoin réel, pas la plus chère.

Quelle carte pour votre installation ?
1. Quel est votre usage principal ?
2. Quelle taille de modèle maximale visez-vous ?
3. Quelle enveloppe vous donnez-vous ?
Votre recommandation
·
·
Voir sur Amazon

Analyse détaillée : chaque carte au microscope

On passe du résumé au détail. Chaque carte est jugée dans son contexte réel : quels flux de travail elle accélère, quelles limites elle a, et quel acheteur la justifie. Sans emphase.

GIGABYTE Radeon AI Pro R9700 32 Go GDDR6 pour modèles de langage locaux
Le choix m8d · La plus de mémoire

GIGABYTE Radeon AI Pro R9700 AI Top 32G

Amazon
32 Go GDDR6 256 bits 2 920 MHz 300 W TDP PCIe 5.0 Ventilateur turbo

La seule carte de cette page qui charge un modèle 70B en Q4_K_M (environ 39 Go) avec de la marge pour le cache de contexte, sans passer au multi-GPU. GIGABYTE la positionne explicitement sur les charges d'IA et d'apprentissage automatique, avec un pâte thermique et un ventilateur turbo à double roulement prévus pour un fonctionnement continu. L'argument d'AMD ici est simple : c'est le plus grand nombre de gigaoctets de mémoire par euro de la page, et en IA locale la mémoire est le plafond.

Ce que ça change concrètement ROCm est aujourd'hui utilisable en inférence : llama.cpp et ollama fonctionnent sans bricolage, vLLM a un support AMD officiel. Mais attention : xformers, l'autotuning de Triton et beaucoup de scripts de fine-tuning de Hugging Face supposent encore CUDA. Si votre usage est essentiellement de l'inférence, cette carte est la bonne réponse. Si c'est du fine-tuning sérieux, NVIDIA garde l'avantage.
Voir sur Amazon
GIGABYTE Radeon RX 9060 XT Gaming OC 16 Go, meilleur rapport qualité-prix IA locale
Le meilleur rapport qualité-prix

GIGABYTE Radeon RX 9060 XT Gaming OC 16G

Amazon
16 Go GDDR6 128 bits 3 320 MHz PCIe 5.0 WINDFORCE 180 W TDP

La porte d'entrée honnête vers l'IA locale. Seize gigaoctets couvrent Stable Diffusion XL au maximum avec entraînement de LoRA, un modèle 13B en Q8 et un 30B en Q3. Pour quelqu'un qui démarre, cette carte évite l'erreur classique : mettre son budget dans 8 Go qui seront trop justes dans six mois, alors que la mémoire d'une carte graphique ne s'ajoute jamais après coup.

Ce que ça change concrètement Le bus mémoire de 128 bits limite le débit dès que vous allongez le contexte au-delà de quelques dizaines de milliers de jetons. Pour de la génération d'images pure, cela ne se voit pas. Pour du RAG avec de très longs prompts, regardez plutôt une carte à bus 192 ou 256 bits, ou montez sur la Radeon AI Pro. L'éclairage RGB se désactive par logiciel si vous montez une machine discrète.
Voir sur Amazon
PNY NVIDIA RTX Pro 2000 Blackwell, carte compacte pour station IA silencieuse
Station compacte et silencieuse

PNY NVIDIA RTX Pro 2000 Blackwell

Amazon
16 Go GDDR7 4 352 CUDA 128 bits 288 Go/s 70 W TDP 545 TOPS annoncés

La petite soeur de la RTX Pro 4000 : même architecture Blackwell et même sobriété annoncée de 70 W, avec 16 Go et la moitié des coeurs CUDA. Les 545 TOPS annoncés pour l'IA sont un chiffre constructeur, et il est fort pour cette enveloppe thermique. Format double slot compact : elle entre dans un boîtier mini-ITX.

Ce que ça change concrètement C'est la carte de celui qui monte un serveur maison qui tourne jour et nuit dans une pièce à vivre : 70 W annoncés, donc pas de ventilation de châssis bruyante, et une consommation annuelle d'environ 82 kWh à quatre heures d'usage intensif par jour. La GDDR7 lui donne un avantage de bande passante réel sur la GDDR6 à bus égal. Mais 16 Go est un plafond : si vous pensez vouloir des modèles 30B en Q4 dans dix-huit mois, prenez plus de mémoire maintenant.
Voir sur Amazon
ASUS Turbo AI Pro R9700 32 Go, format blower pour multi-GPU
Multi-GPU dense

ASUS Turbo AI Pro R9700 32G

Amazon
32 Go GDDR6 256 bits 2 920 MHz 300 W PCIe 5.0 Blower 2 slots

Même puce R9700 que la GIGABYTE, avec un refroidissement à ventilateur centrifuge (blower) au lieu d'un refroidissement ouvert. L'inconvénient : c'est plus bruyant à pleine charge. L'avantage : elle est conçue pour être empilée. Quatre de ces cartes dans un châssis à double alimentation donnent 128 Go de VRAM cumulés, ce qui ouvre la porte au 70B en FP16.

Ce que ça change concrètement Un refroidissement blower expulse l'air chaud par l'arrière du boîtier au lieu de le recycler à l'intérieur. C'est exactement ce qu'il faut quand plusieurs cartes sont collées les unes aux autres et s'étouffent mutuellement. Si vous n'en montez qu'une seule, la GIGABYTE Radeon AI Pro est le meilleur achat parce qu'elle est plus silencieuse. Si vous prévoyez d'en ajouter d'autres, c'est celle-ci qui est le choix rationnel.
Voir sur Amazon
PNY NVIDIA RTX 2000 Ada Generation 16 Go ECC, format low profile
Mémoire ECC et low profile

PNY NVIDIA RTX 2000 Ada Generation

Amazon
16 Go GDDR6 ECC 2 816 CUDA 88 Tensor 70 W TDP Ada Lovelace Low profile

Génération précédente (Ada Lovelace), mais la seule de cette page à mémoire ECC. L'ECC corrige les erreurs de bit en temps réel, ce qui compte si votre charge est une simulation scientifique ou un entraînement long où une inversion de bit ruine douze heures de calcul. Le format low profile permet de la loger dans un châssis 2U ou dans un boîtier très compact.

Ce que ça change concrètement Pour un usage non critique, discuter avec un modèle ou générer des images en amateur, l'ECC n'apporte rien d'utile : prenez plutôt la RTX Pro 2000 Blackwell, plus récente et en GDDR7. Si vous travaillez en recherche académique, en finance ou dans un domaine où l'intégrité du calcul compte, c'est l'entrée professionnelle la plus accessible de cette sélection.
Voir sur Amazon
MSI GeForce RTX 5060 Ti 8 Go Ventus, carte d'entrée de gamme
Entrée de gamme assumée

MSI GeForce RTX 5060 Ti 8G Ventus 2X OC Plus

Amazon
8 Go GDDR7 2,6 GHz 128 bits PCIe 5.0 Blackwell DLSS 4

La Blackwell la plus abordable. Avec 8 Go de GDDR7 annoncée à 28 Gbit/s, elle sert de point d'entrée à qui veut essayer l'IA locale sans investir. Stable Diffusion XL en usage basique fonctionne, un modèle 8B en Q4 tient. Écosystème CUDA complet, plus DLSS 4 si la machine sert aussi à jouer.

Ce que ça change concrètement Le piège des 8 Go : en 2026 il existe déjà des modèles 7B dont les poids en Q4 frôlent les 5 Go, et avec une fenêtre de contexte de 8 000 jetons vous êtes à la limite. Pour du LoRA sur Stable Diffusion XL, la taille de lot devient trop juste. Notre conseil honnête : si votre enveloppe permet de passer à la RX 9060 XT 16G, faites-le. Celle-ci ne se justifie que si Blackwell et DLSS 4 sont des exigences non négociables.
Voir sur Amazon

Ce qui rentre et ce qui ne rentre pas : le seul classement qui ne se discute pas

Vous ne trouverez pas ici de jetons par seconde. Nous n'avons pas ces cartes entre les mains, et publier un débit que nous n'avons pas mesuré serait exactement le genre de chiffre que cette page vous apprend à ne pas croire. Ce que nous pouvons faire, et que personne ne fait, c'est l'arithmétique : la VRAM déclarée par chaque constructeur, face au poids publié du modèle quantifié, plus une marge de 4 Go pour le cache de contexte. Une carte qui n'a pas la place ne fait pas tourner le modèle plus lentement : elle ne le fait pas tourner du tout.

VRAM déclarée par carte, face au modèle choisi
Arithmétique sur des chiffres publiés, pas une mesure de notre part

Consommation : ce que coûte une carte qui tourne en continu

Une carte professionnelle sobre peut revenir moins cher sur dix-huit mois qu'une carte grand public à mémoire équivalente, et ce n'est pas une figure de style : c'est le TDP annoncé multiplié par des heures. En prenant quatre heures d'usage intensif par jour à 80 pour cent du TDP annoncé, voici la consommation annuelle. Aucun tarif d'électricité ici : les kilowattheures se convertissent en euros avec votre propre contrat, et la comparaison entre cartes ne dépend pas de ce tarif.

CarteTDP annoncéPuissance retenuekWh par anRapport à la plus sobre
PNY RTX Pro 4000 SFF70 W56 W82 kWhréférence
PNY RTX Pro 2000 Blackwell70 W56 W82 kWhréférence
PNY RTX 2000 Ada70 W56 W82 kWhréférence
MSI RTX 5060 Ti 8G180 W144 W210 kWh2,6 fois plus
GIGABYTE RX 9060 XT 16G180 W144 W210 kWh2,6 fois plus
GIGABYTE Radeon AI Pro R9700300 W240 W351 kWh4,3 fois plus
ASUS Turbo AI Pro R9700300 W240 W351 kWh4,3 fois plus

La règle, et elle se vérifie avec une calculatrice : la différence de consommation entre la carte la plus sobre et la plus gourmande de cette page est d'environ 269 kWh par an. C'est la seule comparaison de coût de cette page, elle est en kilowattheures et pas en euros, et c'est volontaire : le prix du kilowattheure change d'un contrat à l'autre, la physique non.

La liste à passer avant d'acheter
Calculez votre VRAM minimale : taille du modèle quantifié + 4 à 8 Go de cache de contexte + 1 à 2 Go pour le système. Ajoutez 20 pour cent de marge.
Tranchez entre CUDA et ROCm : fine-tuning, xformers, Triton ou recherche, c'est NVIDIA. Inférence pure et génération d'images, AMD tient la comparaison et donne plus de mémoire pour la même somme.
Vérifiez le TDP face à votre alimentation : une carte de 300 W avec un processeur gourmand sur une alimentation de 650 W, c'est trop juste. Comptez 100 W de marge.
Regardez le format physique : double slot, triple slot, low profile. Les Pro Blackwell SFF entrent en mini-ITX, les Radeon AI Pro demandent une tour ATX complète.
Confirmez un port PCIe x16 libre : certaines cartes professionnelles sont en x8. Sur une carte mère en PCIe 4.0, un x8 peut brider les transferts massifs vers la mémoire.
L'occasion se regarde sérieusement, surtout sur les générations précédentes à grande mémoire. Voyez le point juridique juste en dessous avant de vous décider.

Acheter d'occasion en France : ce que la garantie légale couvre vraiment

C'est la question qui revient sur tous les forums français dès qu'on parle d'IA locale, parce que les cartes à grande mémoire des générations précédentes sont le meilleur rapport mémoire/somme dépensée. Et c'est une question à laquelle presque aucun comparatif ne répond, alors que la réponse est écrite dans le code de la consommation.

Trois articles, et ils changent la décision
Article L217-3 : le vendeur répond des défauts de conformité qui apparaissent dans un délai de deux ans à compter de la délivrance du bien.
Article L217-7 : les défauts qui apparaissent dans les vingt-quatre mois sont présumés exister depuis la livraison. Pour un bien d'occasion, ce délai est de douze mois. C'est le point qui décide : sur une carte d'occasion achetée à un professionnel, pendant un an, c'est au vendeur de prouver que le défaut n'existait pas.
Article L217-13 : « Tout bien réparé dans le cadre de la garantie légale de conformité bénéficie d'une extension de cette garantie de six mois. » Deux réparations et votre couverture dépasse d'un an celle du départ.

La règle, vérifiable en dix secondes : une carte graphique d'occasion vendue par un professionnel reste couverte par la garantie légale de conformité, avec douze mois de présomption. Vendue par un particulier, cette garantie ne s'applique pas : il ne vous reste que la garantie des vices cachés, beaucoup plus difficile à faire jouer. La différence entre les deux ne se voit pas sur l'annonce, elle se voit sur le statut du vendeur. Regardez-le avant de payer, pas après.

Questions fréquentes sur les cartes graphiques pour l'IA locale

En quantification Q4_K_M, un modèle de 70 milliards de paramètres pèse environ 39 Go ; en Q8 environ 70 Go et en FP16 environ 140 Go. Il faut donc au minimum une carte de 32 Go, comme la Radeon AI Pro R9700, ou deux cartes de 24 Go en multi-GPU. Sur 16 Go, seule la quantification Q3 rentre, avec une perte de qualité visible.
CUDA reste le standard de fait : PyTorch, transformers, vLLM et exllamav2 le supposent. ROCm est aujourd'hui utilisable pour l'inférence avec llama.cpp et ollama, mais beaucoup de scripts de fine-tuning de Hugging Face supposent encore CUDA. Pour la recherche : NVIDIA. Pour de l'inférence avec le maximum de mémoire : AMD donne plus de gigaoctets pour la même somme.
C'est le minimum absolu et cela limite sérieusement : un modèle 8B en Q4 pèse environ 4,7 Go, sans compter le cache de contexte. Stable Diffusion XL fonctionne en usage basique, mais sans marge pour xformers ni pour un lot correct. Pour un usage sérieux, 16 Go est le plancher réaliste et 24 à 32 Go la zone confortable.
Oui, si elle est vendue par un professionnel. La garantie légale de conformité s'applique, et l'article L217-7 du code de la consommation ramène à douze mois, au lieu de vingt-quatre pour un bien neuf, la période pendant laquelle le défaut est présumé exister depuis la livraison. Entre particuliers, cette garantie ne joue pas : il ne reste que la garantie des vices cachés.
Pour de la génération d'images seule, la GIGABYTE RX 9060 XT 16G est le meilleur compromis : 16 Go suffisent largement pour des lots raisonnables et ROCm est stable sur cet usage. Si vous avez besoin de xformers ou d'un graphe ComfyUI lourd, CUDA reprend l'avantage et la PNY RTX 2000 Ada avec ses 16 Go ECC devient plus pertinente.
Cela se calcule sans deviner : à quatre heures d'inférence par jour à 80 pour cent du TDP annoncé, une carte de 70 W consomme environ 82 kWh par an, une carte de 180 W environ 210 kWh, et une carte de 300 W environ 351 kWh. Le rapport entre la plus sobre et la plus gourmande de cette page dépasse quatre. C'est de l'arithmétique à partir du TDP déclaré, pas une mesure au wattmètre.
Ce sont des niveaux de quantification : la précision avec laquelle les poids du modèle sont stockés. FP16 conserve la précision d'origine et occupe environ deux octets par paramètre. Q8 divise la taille par deux, Q4_K_M par environ quatre, au prix d'une dégradation faible sur la plupart des usages. En pratique, Q4_K_M est le réglage standard pour faire tourner un modèle chez soi, et c'est lui qui décide de la carte dont vous avez besoin.
D'où vient chaque chiffre de cette page
VRAM, type de mémoire, largeur de bus, coeurs CUDA, TOPS et TDP : fiches techniques des constructeurs (GIGABYTE, PNY, ASUS, MSI), relues le 31 août 2026. Ce sont des données déclarées, pas des mesures.
Tailles des modèles quantifiés : poids ouverts publiés et documentation de llama.cpp et de Hugging Face, deux références internationales qui valent pour tous les marchés.
Consommation annuelle : calcul direct à partir du TDP annoncé, avec l'hypothèse écrite au-dessus du tableau. Refaisable à la main.
Articles L217-3, L217-7 et L217-13 du code de la consommation : lus sur Légifrance le 31 août 2026.
Catalogue produit : Amazon Espagne, relu le 31 août 2026. La disponibilité et les références varient d'un pays à l'autre.

Partager

WhatsAppXLinkedInE-mail

Commentaires

Soyez le premier

Sans inscription : juste un nom. Tous les commentaires sont relus avant publication.