IA d’images locale ou en ligne : que choisir en 2026 ?
Commencez en ligne si vous générez occasionnellement, utilisez un portable ou un téléphone, ou souhaitez retoucher par conversation. Le local devient intéressant si vous possédez déjà un GPU adapté et réutilisez les mêmes modèles, LoRA et processus. Acheter une carte graphique coûteuse uniquement pour économiser un abonnement mensuel demande souvent des années d’amortissement.
« Local » indique où s’exécute le modèle. Cela ne signifie pas automatiquement meilleure qualité, moindre compréhension des consignes, droits illimités sur les contenus ou coût nul. Un même modèle téléchargeable peut tourner sur votre PC et via une API hébergée payante. Les poids, la précision, les réglages et la modération comptent davantage que le seul lieu d’exécution.
| Critère | Inférence locale | Génération en ligne |
|---|---|---|
| Investissement initial | GPU ou ordinateur adapté existant ; stockage et temps de configuration | Généralement sans achat de GPU ; essais gratuits, abonnements ou crédits API |
| Qualité d’image | Dépend du modèle, du processus et de la mémoire disponible | Accès aux modèles hébergés et fermés ; le fournisseur choisit le traitement |
| Texte et consignes | Les modèles récents comprennent le langage naturel ; certains modèles anciens ou spécialisés préfèrent les tags | Le dialogue facilite les retouches ; les caractères générés restent à vérifier |
| NSFW | Selon le modèle, la licence et l’application ; aucune autorisation universelle | Selon le service : certains sont strictement SFW, d’autres traitent davantage de contenus sensibles |
| Vitesse et limites | Matériel, résolution et taille des lots ; aucun quota de fournisseur si tout est local | File d’attente, formule, crédits, limites de requêtes et mode de qualité |
| Anime / réalisme | Modèles spécialisés et LoRA compatibles offrent du contrôle | Les services anime et les modèles généralistes ont des atouts différents |
| Entretien / confidentialité | Vous gérez dépendances, fichiers et sauvegardes ; un processus hors ligne peut conserver les entrées sur le PC | Peu de configuration ; traitement des données et visibilité selon le service |
Ce guide d’achat repose sur des sources vérifiées le 8 septembre 2026, et non sur un benchmark contrôlé de tous les modèles. Les temps annoncés par les fabricants sont identifiés comme tels, et les calculs exposent leurs hypothèses. Le matériel est présenté aux prix affichés en France, en euros. Les abonnements précisent le canal d’achat ; les services tarifés en dollars conservent leur prix d’origine avec une conversion indicative datée en euros.
Une méthode pratique : générer, puis finaliser
1. Choisissez l’environnement d’inférence. ComfyUI est une interface de processus et un moteur d’inférence open source, pas un modèle d’images. Il permet d’enchaîner génération, retouche et autres traitements. Une installation locale peut inclure des nœuds d’API distantes payantes : vérifiez-les avant de supposer que les images restent sur votre ordinateur.

2. Finalisez uniquement l’image retenue. Si le résultat est correct mais trop petit, l’Agrandisseur d’image IA d’AirMore est un outil facultatif dans le navigateur pour augmenter ses dimensions en pixels. Il agrandit une image sans remplacer le générateur. Il ne corrige pas fiablement les fautes et ne garantit pas l’exactitude des détails reconstruits. Pour des fichiers sensibles ou confidentiels, choisissez une finition conforme à vos exigences de traitement des données.

Séparer génération et finition évite de dépenser des crédits haute résolution sur des dizaines d’idées avant d’avoir choisi une composition. Vérifiez d’abord le petit brouillon, puis consacrez temps et calcul au résultat sélectionné.
Comparatif des prix : GPU, abonnement ou API ?
En local, budgétez tout le système : mémoire graphique, RAM, SSD, alimentation compatible et refroidissement. Les téléchargements de modèles occupent parfois beaucoup de stockage. Comme point de départ indicatif, 16 Go de VRAM et 32 Go de RAM offrent plus de souplesse qu’un petit GPU d’entrée de gamme, sans garantir que tous les processus lourds tiendront. Certains modèles exigent davantage de mémoire ou un déport vers le CPU, plus lent.
| Modèle vendu en France | Mémoire graphique | Prix affiché en euros | Vendeur / conditions |
|---|---|---|---|
| Gainward RTX 5060 Ti Ghost OC | 16 Go | 899,95 € | Prix affiché par LDLC |
| Gainward RTX 5070 Ti Phoenix-S | 16 Go | 1 349,95 € | Prix affiché par LDLC |
| Gainward RTX 5090 Phantom | 32 Go | 5 399,95 € | Prix affiché par LDLC |
Relevé du 8 septembre 2026 sur LDLC pour ces références précises : ce ne sont ni les prix minimums du marché ni les tarifs de lancement NVIDIA. Vérifiez disponibilité, TVA, livraison et total avant commande. Deux cartes de 16 Go peuvent avoir des vitesses différentes ; 32 Go permettent des traitements plus volumineux, avec un budget d’alimentation et de refroidissement à prévoir.
| Solution en ligne | Prix et repère en euros | Ce que vous achetez |
|---|---|---|
| ChatGPT Plus | 22,99 € (exemple de prix affiché sur l’App Store français) | Accès à ChatGPT avec limites de génération d’images ; API facturée séparément |
| Midjourney | Paiement mensuel : Basic 10 USD (≈ 8,60 €) ; Standard 30 USD (≈ 25,81 €) ; Pro 60 USD (≈ 51,63 €) ; Mega 120 USD (≈ 103,25 €) | Heures GPU Fast selon la formule ; images Relax à partir de Standard |
| NovelAI | Paiement mensuel : Tablet 10 USD (≈ 8,60 €) ; Scroll 15 USD (≈ 12,91 €) ; Opus 25 USD (≈ 21,51 €) | Anlas et avantages de la formule ; quota renouvelable pour les générations gratuites V5 Opus |
| API FLUX.2 klein 4B | À partir de 0,014 USD par image de 1 MP (≈ 0,012 €) | Paiement par image ; les grandes sorties et les retouches peuvent coûter plus cher |
| API GPT Image 2 | Par million de tokens d’image : entrée 8 USD (≈ 6,88 €), sortie 30 USD (≈ 25,81 €) ; texte en entrée : 5 USD par million (≈ 4,30 €) | Tarif standard par tokens ; qualité, dimensions et images d’entrée influencent le total |
Le prix de ChatGPT Plus est un exemple affiché pour iOS : vérifiez la période facturée sur l’écran d’achat. Il ne garantit pas le même tarif sur le Web. OpenAI indique que les abonnements Web peuvent être facturés en EUR, que les achats dans l’application passent par les boutiques et que les crédits API restent achetés en USD.
Sources : ChatGPT Plus, formules Midjourney, abonnements NovelAI, tarifs BFL et tarifs de l’API OpenAI. Les entrées en cache et les traitements par lots ont d’autres tarifs. Facturation mensuelle et annuelle ne se confondent pas ; des taxes peuvent s’ajouter. Un abonnement web n’inclut pas automatiquement des crédits API.
Conversion indicative : parités de la Banque de France du 7 septembre 2026, 1 EUR = 1,1622 USD, soit 1 USD ≈ 0,860437 EUR, avec arrondi. Les équivalents Midjourney, NovelAI et API ne sont pas des prix fixes français et excluent taxes éventuelles et frais de change de la carte. Midjourney précise que des taxes peuvent être ajoutées au paiement selon l’adresse de facturation.
Amortissement, avec des montants hypothétiques : 800 € de matériel supplémentaire, un abonnement résilié à 30 €/mois et 5 €/mois de frais locaux donnent 800 ÷ (30 − 5) = 32 mois. Un PC supposé coûter 1 500 € demande 60 mois. Ce calcul indépendant ne reprend pas les devis GPU ni un abonnement précis du tableau. Si vous conservez l’abonnement, cette économie disparaît. Revente, réparations et temps de configuration sont exclus.
Exemple de coût électrique : une puissance supposée de 0,35 kW pour le PC entier × 30 heures × un tarif hypothétique de 0,25 €/kWh = 2,625 €, soit environ 2,63 €. Ce n’est ni une mesure de GPU ni un tarif national de l’électricité. Utilisez votre contrat et vos mesures. Le temps consacré à l’installation et aux pannes compte aussi.
Pour un usage occasionnel, le paiement à l’usage peut coûter moins cher qu’un abonnement ou du matériel neuf. Avec un GPU déjà possédé et de gros volumes, le local devient plus intéressant. Comparez le coût par image retenue : une tentative hypothétique à 0,03 € revient à 0,12 € par image exploitable si vous en acceptez 25 %, avant retouche.
Capacités des modèles locaux : choisir selon le travail
FLUX.2 [klein] 4B est un candidat compact pour générer et retoucher en local. Les poids 4B sont sous Apache 2.0 ; les poids 9B relèvent d’une autre licence, non commerciale sauf accord distinct. Ne supposez pas que tous les téléchargements FLUX ont les mêmes conditions commerciales. Guide officiel d’utilisation locale et de licence.

BFL annonce environ 8,4 Go et 1,2 seconde pour l’inférence du 4B distillé sur RTX 5090, tandis que son guide plus complet évoque environ 13 Go. Ces chiffres couvrent des périmètres différents et ne garantissent rien sur une carte de 8 Go. Gardez de la marge pour les encodeurs, le décodage et les entrées de retouche. Le temps de la 5090 ne s’applique pas à la 5060 Ti. Tableau de performances du fabricant ; guide du processus.
Qwen-Image-2512 est un modèle téléchargeable d’environ 20 milliards de paramètres à tester pour les sujets réalistes et les compositions contenant du texte. Sa fiche officielle souligne des progrès en réalisme et en lettrage anglais et chinois. Sa taille est importante : quantification et déport vers le CPU peuvent aider, mais modifier vitesse et résultats. Nous utilisons cette version téléchargeable précise comme référence, sans affirmer qu’elle est le dernier produit de toute la famille Qwen. Fiche officielle et licence Apache 2.0.

Z-Image-Turbo est un modèle distillé de 6 milliards de paramètres conçu pour l’efficacité. Son développeur indique 8 évaluations de fonction, du photoréalisme, du texte anglais et chinois et une compatibilité avec des appareils grand public de 16 Go. La latence annoncée inférieure à une seconde concerne une H800 d’entreprise, pas un GPU domestique courant. Fiche officielle du modèle.

Pour l’anime, un modèle spécialisé ou un LoRA compatible peut compter davantage que le plus gros modèle généraliste. Un LoRA est une petite adaptation liée à une famille de modèles, pas un module de style universel. Commencez par un exemple fonctionnel correspondant à la version de base exacte. Notre guide de téléchargement des modèles et LoRA, en anglais, explique comment vérifier sources et compatibilité.
Modèles en ligne : retouche, esthétique et spécialisation anime
Accès web officiel : ChatGPT · Midjourney · NovelAI.
ChatGPT Images 2.0 / GPT Image 2 est l’option conversationnelle de ce comparatif. Vous décrivez une scène, puis demandez des changements ciblés en vous appuyant sur l’image précédente. C’est un point de départ accessible pour les concepts marketing et les compositions dont le brief évolue au fil des échanges. Le modèle API possède une documentation distincte du produit ChatGPT. Annonce officielle d’Images 2.0 ; documentation API de GPT Image 2.

Midjourney V8.2 est devenu la version par défaut le 24 juillet 2026, selon sa documentation. Il met en avant esthétique et personnalisation, avec un nouvel Edit Model. Pour l’anime, le service propose Niji 7. C’est un candidat si la direction visuelle constitue le principal défi ; cela ne prouve pas sa supériorité pour les étiquettes exactes de produits ou les consignes complexes. Versions actuelles et différences entre modèles.

NovelAI Diffusion V5 associe génération anime, consignes en langage naturel, prise en charge du japonais, commandes pour plusieurs personnages et lettrage amélioré. Full couvre un entraînement plus large ; Curated vise à réduire les sorties sensibles indésirables. Ces fonctions sont particulièrement pertinentes pour les scènes de personnages et la bande dessinée. Informations officielles sur V5.

Il s’agit de méthodes de travail différentes, pas d’un classement universel. Privilégiez la retouche conversationnelle pour un brief mouvant, un système de styles pour explorer une direction artistique et des commandes explicites de personnages pour les scènes récurrentes. Testez vos cas difficiles avant de payer un an.
Comprendre les consignes et dessiner du texte : deux compétences
Comprendre les consignes, c’est attribuer correctement objets, couleurs, positions et actions. Rendre le texte, c’est dessiner fidèlement les caractères demandés dans l’image. Un modèle peut créer une belle affiche avec un titre mal orthographié, ou écrire correctement tout en se trompant sur la personne qui tient le produit.
| Test | Demande | Points à vérifier |
|---|---|---|
| Relations | Tasse rouge à gauche d’un livre bleu ; plante verte derrière les deux | Nombre d’objets, placement gauche/droite et attribution des couleurs |
| Texte exact | Titre court entre guillemets et prix séparé | Lettres manquantes, chiffres modifiés, mots supplémentaires et alignement |
| Typographie multilingue | Phrase française avec accents, ç et œ ; en japonais, kanji, kana et chiffres | Diacritiques, ponctuation et espaces ; en japonais, petits kana et marques de voyelle longue |
| Retouche | Modifier uniquement le fond, conserver emballage et étiquette | Redessin éventuel de détails censés rester identiques |
Commencez simplement : « Crée une affiche carrée pour un café fictif. Place une tasse bleue à gauche et le titre “Mélange du matin” en haut. Laisse le tiers inférieur dégagé. » Corrigez ensuite un point à la fois. C’est généralement plus facile à diagnostiquer qu’un paragraphe d’adjectifs stylistiques contradictoires.
Les modèles locaux récents acceptent aussi la prose. Un modèle anime entraîné avec des tags peut mieux répondre aux tags et pondérations documentés ; un service conversationnel reformule l’intention par le dialogue. La difficulté vient du modèle et des commandes, pas simplement de l’exécution locale. Ne recopiez pas une ancienne recette de consignes négatives dans chaque nouveau modèle.
Pour une création française, testez accents, ligatures et ponctuation : une démonstration anglaise ne suffit pas. De même, des exemples anglais ou chinois ne prouvent pas la qualité du japonais. Faites un petit test dans la langue cible et relisez au format final. Pour les prix, mentions légales, coordonnées et paragraphes denses, générez l’illustration puis ajoutez du texte modifiable dans un outil de design ; les corrections coûteront moins cher.
Vitesse et quotas : comparez les images terminées par heure
Le chronomètre doit partir à l’envoi de la demande et s’arrêter quand le fichier est acceptable. Incluez chargement du modèle, transfert, attente, aperçus, nouvelles tentatives, agrandissement et correction manuelle. La seconde d’inférence annoncée par un fabricant n’est qu’une étape.
| Environnement | Limite pertinente | Conséquence pratique |
|---|---|---|
| Entièrement local | Mémoire graphique, calcul, température et stockage | Aucun quota de service, mais un gros lot peut saturer la mémoire ; le déport peut ralentir |
| ChatGPT | Limites du forfait et complexité de la demande | Les générations complexes prennent parfois des minutes ; ne supposez pas un quota quotidien fixe pour tous |
| Midjourney | Heures GPU Fast et files Relax | Basic : 3,3 heures Fast ; Standard : 15 ; Pro : 30 ; Mega : 60. Relax dès Standard échange de l’attente contre du volume |
| NovelAI V5 Opus | Quota gratuit renouvelable et Anlas | Les générations gratuites éligibles sont limitées ; ensuite, utilisez des Anlas ou attendez |
| API hébergée | Limites de requêtes, crédits et simultanéité | Automatisation pratique, mais budget et gestion des tentatives restent nécessaires |
Sources : aide sur les images ChatGPT, tableau des formules Midjourney et FAQ des limites NovelAI Opus. NovelAI indique que le quota V5 se reconstitue continuellement et demande environ une semaine pour revenir au maximum après épuisement. Les anciens modèles éligibles conservent d’autres règles de génération illimitée. Ne présentez pas simplement V5 comme « illimité ».
Pour un essai équitable, utilisez les dix mêmes briefs avec des dimensions comparables. Notez tentatives, images retenues, durée et dépense totale. Séparez les résultats du modèle local déjà chargé en mémoire de ceux d’un démarrage à froid. Ce petit test est plus utile que des vidéos de vitesse sans conditions communes sur les réseaux.
Anime, personnes réalistes et cohérence des personnages
Anime et manga : essayez NovelAI ou Niji de Midjourney pour commencer avec un service hébergé ; étudiez un modèle anime et des LoRA compatibles pour maîtriser localement un style reproductible. Découpage des cases, mains, nombre de personnages et cohérence entre pages doivent être évalués séparément de la beauté d’un portrait.
Personnes et produits photoréalistes : comparez les modèles généralistes cités sur la peau, les tissus, les reflets, la géométrie et la fidélité aux références. Un visage convaincant ne garantit ni logo correct, ni bonne taille d’emballage, ni bonne posture des mains. Les promesses de réalisme de Qwen et Z-Image invitent à les tester ; elles ne prouvent pas indépendamment leur supériorité sur tous les concurrents hébergés.
Personnages récurrents : choisissez un processus compatible avec les références ou adaptations nécessaires. Conservez version du modèle, consignes, graine aléatoire si disponible et réglages de retouche. Une graine ne garantit pas la même personne après changement de modèle ou de traitement. En production, mesurez l’effort pour maintenir un personnage sur dix scènes plutôt que de juger une image chanceuse.
NSFW : contrôle local ne signifie pas autorisation sans limites
NSFW peut désigner nudité artistique, contenu sexuel explicite ou violence graphique. Ce sont des catégories distinctes dans les règles des services. Le tableau résume capacités générales et restrictions documentées ; ce guide n’a testé ni génération explicite ni contournement de filtres.
| Solution | Position sur le NSFW | Limite importante |
|---|---|---|
| Modèles locaux téléchargeables | Selon les poids, l’entraînement et l’application | Retirer l’hébergement ne supprime pas les conditions du modèle et ne rend pas toute sortie légale |
| ChatGPT Images / GPT Image 2 | Restreint ; pas un service adulte sans filtrage | Les filtres concernent consignes et images ; les deepfakes sexuels font l’objet de restrictions spécifiques |
| Midjourney / Niji | SFW uniquement | Contenu adulte et gore interdit, y compris sur serveurs privés et en mode Stealth |
| NovelAI V5 | Full et Curated diffèrent sur les contenus sensibles | Curated vise à limiter les images sensibles indésirables ; ce n’est pas une autorisation générale pour tout usage adulte |
| Modèles ouverts hébergés | Règles propres à l’hébergeur | Une API peut imposer des restrictions différentes d’une installation locale |
Sources : rapport de sécurité OpenAI Images 2.0, règles communautaires Midjourney, différences entre modèles NovelAI, conditions NovelAI et politique d’utilisation BFL. La documentation NovelAI citée ne définit pas une liste universelle autorisant chaque scénario explicite ; l’appellation « Full » n’apporte pas cette garantie.
Avant de souscrire pour un projet adulte, distinguez capacité technique et permission contractuelle. Utilisez uniquement des sujets adultes légaux et consentis ; évitez les contenus sexuels impliquant des mineurs ou des représentations intimes non consenties. L’exécution locale ne justifie aucun de ces usages. Stockage privé et autorisation de générer une catégorie sont également deux questions différentes.
Confidentialité, licences et choix d’achat
Un processus entièrement local peut garder les images sources sur votre machine après installation. Vérifiez nœuds distants et extensions avant de le qualifier de hors ligne. Les services diffèrent : les créations Midjourney sont publiques par défaut, et Stealth est réservé à Pro et Mega. Les contrôles des données de ChatGPT grand public constituent un réglage distinct ; un abonnement payant ne crée pas automatiquement un espace hors ligne ou confidentiel.
Pour un usage commercial, vérifiez les licences exactes du modèle et de ses adaptations, la formule et les droits des références. Des poids téléchargeables ne signifient pas un usage commercial sans restriction. La licence du fournisseur ne garantit pas non plus l’autorisation de chaque logo ou ressemblance générés.
- Images occasionnelles, sans GPU adapté : commencez par un essai ou un mois en ligne. Le seul abonnement économisé justifie rarement l’achat de matériel.
- GPU existant, lots reproductibles : testez un modèle local et un processus stable. Suivez les sorties retenues et le temps d’entretien avant d’élargir.
- Affiches françaises ou japonaises, briefs changeants : privilégiez tests linguistiques, retouches ciblées et typographie finale modifiable.
- Production anime : comparez commandes de personnages, ressources stylistiques compatibles et limites réelles de V5 et des formules.
- Travail mixte : gardez les tâches courantes validées en local et utilisez un modèle hébergé là où sa retouche ou son résultat économise assez de temps.
Un processus hybride est souvent pertinent, mais conserver les deux représente une dépense de service supplémentaire. Consultez notre guide des générateurs d’images IA pour d’autres points de départ.
Questions fréquentes
La génération d’images IA en local est-elle gratuite ?
Le logiciel et certains poids sont téléchargeables gratuitement. Matériel, électricité, stockage, entretien et temps restent payants. Posséder déjà un ordinateur adapté rend le local plus facile à justifier.
8 Go de VRAM suffisent-ils ?
Pour certains processus petits ou quantifiés, oui. Ce n’est pas une cible fiable pour tous les modèles. Vérifiez toute la chaîne, les dimensions et les entrées de retouche : le chiffre du modèle seul exclut les autres composants.
Davantage de VRAM améliore-t-il la qualité ?
Cela permet de loger des modèles ou processus plus grands et de réduire le déport. Cela n’améliore pas automatiquement un modèle identique avec les mêmes réglages. Vitesse de calcul et capacité mémoire répondent à des problèmes différents.
L’IA en ligne peut-elle générer des images NSFW ?
Il n’existe pas de réponse unique. Midjourney est strictement SFW, OpenAI applique des restrictions de sécurité et d’autres services distinguent variantes et contenus sensibles. Vérifiez à la fois le modèle actuel et la politique de l’hébergeur.
Quelle solution écrit le mieux en français ou en japonais ?
Choisissez selon les essais du modèle avec votre texte exact, pas selon l’opposition local/en ligne. Vérifiez accents, ligatures, ponctuation, chiffres et kana japonais. Gardez le texte final important modifiable au lieu de dépendre entièrement du lettrage généré.
Faut-il acheter un GPU pour remplacer l’abonnement ?
Seulement après avoir testé le processus local et calculé l’économie des abonnements réellement résiliés. Incluez devis matériel réel, frais récurrents et proportion d’images exploitables. Un achat cher peut repousser l’amortissement au-delà d’un cycle raisonnable de renouvellement.
Notre avis
La génération en ligne est le premier achat le plus simple pour la majorité sans matériel adapté. Le local devient convaincant si vous avez déjà le GPU, recherchez un contrôle reproductible et pouvez entretenir le processus. Aucun lieu d’exécution ne garantit le meilleur anime, les meilleurs visages réalistes ou le texte le plus exact.
Choisissez le modèle selon la tâche, vérifiez ses limites NSFW et commerciales, puis comparez coût et temps par image réellement utilisable. En 2026, ces différences pratiques comptent plus que « le local est gratuit » ou « le cloud est toujours meilleur ».