Glossaire Midjourney & IA visuelle de A à Z

Glossaire Midjourney & IA visuelle — 124 définitions

--ar (aspect ratio)
Paramètre définissant le format de l'image (16:9, 9:16, 1:1, 4:5…) ; à choisir dès la génération.
--chaos (--c)
Diversité entre les 4 propositions : 0 = très similaires, valeur haute = directions très différentes.
--cref (référence de personnage)
Image de référence permettant de conserver le même visage/personnage d'une génération à l'autre.
--cw (character weight)
Poids réglant l'intensité de la ressemblance au personnage de référence.
--seed
Graine aléatoire ; la fixer rend le résultat reproductible et permet d'isoler l'effet d'une modification.
--sref (référence de style)
Image de référence transmettant la signature visuelle (palette, texture, traitement).
--stylize (--s)
Intensité du style propre à Midjourney : bas = fidèle au prompt, haut = plus esthétique mais plus libre.
--weird (--w)
Dose d'étrangeté/originalité pour sortir des rendus attendus ; expérimental à forte valeur.
A/B testing visuel
Comparaison de plusieurs versions d'un visuel auprès de vraies audiences pour trancher par les données.
Adobe Firefly
IA générative d'Adobe intégrée à Photoshop (remplissage génératif), orientée production pro et sécurité commerciale.
Ancrage photographique
Termes de medium et de technique (photograph, 35mm film, film grain, marque de pellicule) orientant vers un rendu photo.
Angle de prise de vue
Position de la caméra : eye level, low angle (contre-plongée), high angle (plongée), top-down, dutch angle.
Application web Midjourney
Interface officielle en ligne (saisie, galerie, édition) plus accessible que Discord pour débuter.
Automatic1111 (A1111)
Interface web classique par onglets et formulaires ; la plus accessible pour débuter en local.
Avatar / présentateur virtuel
Personnage synthétique présentant un contenu ; usage pédagogique et interne courant.
Biais du modèle
Stéréotypes reproduits par le modèle (genre, origine, corps) ; à corriger activement dans le prompt et la sélection.
Bing Image Creator / Copilot
Accès gratuit à DALL·E 3 via les services Microsoft, avec quotas.
C2PA / Content Credentials
Standard de métadonnées de provenance signées : historique de création et de modification d'un contenu.
Cadre d'usage interne
Règles définissant ce qui est autorisé, vérifié et signalé lors de l'usage d'images IA en entreprise.
Certifier l'authentique
Logique du standard : prouver l'origine d'un contenu vrai plutôt que tenter de détecter tous les faux.
Charte visuelle IA
Document fixant comment la marque génère ses images (piliers, prompts types, paramètres, références, interdits).
Cohérence de série
Fait d'obtenir plusieurs images partageant le même style ou le même personnage (voir sections 3.5 et 5.1).
Cohérence temporelle
Stabilité des objets, personnages et lumière d'une image à l'autre ; difficulté centrale de la vidéo générative.
ComfyUI
Interface en nœuds reliant visuellement les étapes ; plus exigeante mais très reproductible et puissante.
Compétence transférable
Savoir-faire (prompt, lumière, cadrage) valable quel que soit l'outil utilisé.
Conditions d'utilisation (CGU)
Contrat de l'outil qui définit vos droits sur les images générées ; à lire, elles diffèrent d'un service à l'autre.
Consentement documenté
Accord explicite et tracé d'une personne avant toute utilisation de son visage ou de sa voix. Non négociable.
ControlNet
Extension imposant une structure à l'image depuis une image de contrôle (pose, contours, profondeur, segmentation).
Coût d'essai
Coût de production d'une variante ; sa baisse permet de tester au lieu de deviner.
Crédits génératifs
Unités consommées à chaque génération dans certains services (ex. Adobe Firefly).
DALL·E 3
Modèle d'OpenAI intégré à ChatGPT/Copilot ; fort en compréhension du langage naturel et en texte dans l'image.
Débruitage (denoising)
Processus itératif de retrait du bruit qui fait apparaître progressivement l'image.
Déclinaison
Adaptation d'un visuel en plusieurs formats, variantes ou messages (voir section 5.4).
Déclinaison multi-format
Adaptation d'un concept à tous les formats et messages, à générer directement au bon ratio.
Deepfake
Représentation synthétique trompeuse d'une personne réelle ; usage à proscrire hors cadre explicite et consenti.
Discord
Plateforme de messagerie où Midjourney a d'abord fonctionné : on dialogue avec un bot via des commandes.
Documentation de chaîne
Formalisation de l'enchaînement qui fonctionne, pour gagner du temps, être cohérent et pouvoir déléguer.
Droit à l'image
Droit d'une personne sur la représentation de son visage ; générer une personne identifiable sans accord est risqué.
Droit d'auteur
Protection des œuvres originales ; son application aux images générées varie selon les pays et reste en évolution.
Embedding
Représentation mathématique du texte qui permet au modèle d'orienter la génération.
Exemples refusés
Visuels non conformes documentés dans la charte ; très pédagogiques pour cadrer la production.
Exploration vs affinage
Deux phases : explorer (chaos/weird élevés, seed libre) puis converger (chaos bas, seed figé).
Filtre qualité/conformité
Contrôle avant diffusion : défauts, biais, éléments protégés, mention du caractère IA.
Flat design / vector
Style graphique aux aplats de couleur, sans texture ni ombre réaliste ; très reproductible en série.
Focale (objectif)
35 mm (large/naturel), 50 mm (vision humaine), 85 mm (portrait), téléobjectif (isole), grand-angle (exagère).
Génération probabiliste
Caractère aléatoire du résultat : un même prompt donne des images différentes à chaque essai.
Golden hour / blue hour
Lumière chaude et rasante en début/fin de journée ; lueur bleutée du crépuscule.
Grille de 4
Les quatre propositions générées à partir d'un même prompt, parmi lesquelles vous choisissez.
Illustration vs documentation
Illustrer une idée (usage adapté à l'IA) ≠ documenter une réalité (photo réelle nécessaire).
Image-to-video
Animation d'une image existante ; approche la plus maîtrisable car cadre et style sont déjà fixés.
img2vid (animation d'image)
Animation d'un portrait fixe pour lui donner des micro-mouvements naturels et le rendre vivant.
Inpainting
Regénération d'une ZONE sélectionnée de l'image, raccordée au reste ; dans Midjourney : Vary (Region).
IP-Adapter
Transfert du contenu visuel d'une image de référence (visage, style, ambiance) vers de nouvelles générations.
IP-Adapter / LoRA
Équivalents côté Stable Diffusion : transfert de visage/style, ou entraînement d'un personnage ou style (section 4.3).
Isométrique
Vue en projection sans perspective, utilisée pour les schémas, scènes techniques et illustrations produit.
Itération
Méthode de travail : partir simple, puis ajouter un élément à la fois pour mesurer son effet.
Lip sync
Synchronisation des mouvements de la bouche avec une piste audio.
LoRA
Petit fichier d'entraînement additionnel apprenant un concept précis (personnage, style, produit) à un modèle.
Low key / high key
Image majoritairement sombre et dramatique vs image claire et peu contrastée.
Maquette / concept
Visuel provisoire servant à valider une idée avant la production réelle.
Medium
Technique visuelle nommée (aquarelle, encre, gouache, rendu 3D, vectoriel…) qui détermine le rendu.
Midjourney
Outil payant réputé pour la qualité esthétique de ses rendus ; accessible via Discord ou son application web.
Mode fast
Génération prioritaire et rapide, décomptée en heures incluses dans l'abonnement.
Mode furtif (stealth)
Option des plans élevés permettant que vos générations ne soient pas visibles publiquement.
Mode relax
Génération illimitée mais en file d'attente (donc plus lente), disponible sur les plans supérieurs.
Modèle communautaire (checkpoint)
Modèle spécialisé partagé par la communauté ; vérifier sa provenance ET sa licence d'usage.
Modèle de diffusion
Modèle qui apprend à retirer du bruit étape par étape ; il part d'un bruit aléatoire pour faire émerger une image.
Modèle ouvert / propriétaire
Ouvert : poids téléchargeables et exécutables chez soi. Propriétaire : accessible seulement via le service de l'éditeur.
Mood-board
Planche d'ambiance rassemblant des visuels de référence pour fixer une direction artistique.
Mots-clés obsolètes
Termes comme « 8K, ultra realistic, high quality » hérités d'anciens modèles, souvent inutiles voire nuisibles aujourd'hui.
Mouvement de caméra
Indication du déplacement (travelling, panoramique, zoom lent) demandée dans le prompt vidéo.
Open source (Stable Diffusion)
Modèle librement téléchargeable et exécutable, sans abonnement ni limite d'usage technique.
OpenPose / Canny / Depth
Types de contrôle : squelette de pose, détection de contours, carte de profondeur.
Ordre de finition
Corriger les défauts d'abord, agrandir ensuite, puis appliquer les réglages colorimétriques.
Outpainting
Extension de l'image au-delà du cadre existant : le modèle invente ce qui se trouve autour.
Palette contrainte
Nombre limité de couleurs imposé dans le prompt ; clé de la cohérence d'une série et d'une charte.
Pan
Extension de l'image dans une direction précise (gauche, droite, haut, bas).
Paramètre --no
Paramètre de négation de Midjourney servant à exclure un élément (plus fiable qu'écrire « pas de… »).
Paramètres figés
Version de modèle, stylize et formats verrouillés pour éviter les dérives entre productions.
Personnalisation
Variation des visuels par segment d'audience, saison ou région.
Personnalisation (style perso)
Mécanisme par lequel le modèle apprend vos préférences esthétiques à partir de vos choix.
Phase de composition
Assemblage avec logo, typographie et éléments de marque dans un outil graphique ou de mise en page.
Phase de création
Génération de la base visuelle (composition, lumière, ambiance) avec l'outil le plus fort esthétiquement.
Photoréalisme
Rendu indiscernable d'une photographie ; s'obtient en ajoutant des imperfections réalistes, pas en demandant « ultra réaliste ».
Pipeline combiné
Usage simultané de plusieurs extensions (LoRA + ControlNet + IP-Adapter) dans un même workflow professionnel.
Pondération / ordre des mots
Les termes placés en début de prompt pèsent généralement davantage sur le résultat.
Profondeur de champ
Zone de netteté limitée (shallow depth of field) ; marqueur fort du réalisme photographique.
Prompt
Description textuelle envoyée au modèle ; elle guide la génération de l'image.
Prompt descriptif
Description de ce qui doit être VU (éléments visuels concrets) plutôt que d'une émotion abstraite.
Prompt type
Formule standardisée avec variables, réutilisable par tous pour garantir la cohérence.
Quota gratuit
Nombre limité de générations offertes par période (jour/mois) dans les offres sans abonnement.
Re-roll
Relance complète du prompt pour obtenir quatre nouvelles propositions sans lien avec les précédentes.
Référence de marque
Image de style, identifiant de style ou LoRA maison incarnant l'identité visuelle.
Référence de personnage (--cref)
Image de référence servant à conserver le même personnage d'une image à l'autre.
Référence de style (--sref)
Image fournie en référence pour transmettre une signature visuelle d'une génération à l'autre.
Règles de composition
Rule of thirds, composition centrée, leading lines, framing, negative space (espace libre pour du texte).
Remplissage génératif
Fonction de Photoshop (via Firefly) permettant de regénérer ou supprimer une zone sélectionnée.
Rendu 3D (3D render, low poly, clay)
Familles de rendus tridimensionnels, du photoréaliste au stylisé (low poly, pâte à modeler).
Retouche manuelle
Correction par outils classiques (tampon, correcteur, densité) là où l'IA ne raccorde pas correctement.
Retouche par petites touches
Méthode consistant à enchaîner plusieurs corrections locales ciblées plutôt qu'une grosse regénération.
Rim light / backlight
Liseré lumineux détourant le sujet ; éclairage venant de derrière (contre-jour).
Runway / Pika / Sora / Veo
Principaux services de vidéo générative ; écosystème très mouvant, à vérifier régulièrement.
Soft light / hard light
Lumière douce aux ombres progressives (flatteuse) vs lumière dure aux ombres nettes (contrastée).
Stable Diffusion
Modèle ouvert, installable en local ; gratuit et très personnalisable (ControlNet, LoRA), mais plus technique.
Stable Diffusion local
Exécution du modèle sur votre machine : gratuit, illimité, confidentiel et totalement paramétrable.
Structure de prompt
Trame : sujet + action + contexte + style + lumière + cadrage + paramètres ; chaque bloc réduit l'aléatoire.
Synthèse vocale
Génération d'une voix à partir d'un texte (ex. ElevenLabs), avec contrôle du ton, du rythme et de la langue.
Taille de plan
Distance apparente au sujet : close-up, medium shot, full body, wide shot / establishing shot.
Text-to-video
Génération d'une séquence à partir d'une description textuelle ; souple mais peu contrôlable.
Texture de peau (skin texture)
Demande explicite de pores et d'irrégularités ; casse l'effet « plastique » des visages générés.
Traçabilité interne
Conservation de vos prompts, versions et fichiers sources comme preuve de votre démarche.
Travail non destructif
Conservation des originaux, calques et versions pour pouvoir corriger et décliner plus tard.
Upscale (U1-U4)
Agrandissement en haute définition de l'image choisie ; produit la version finale exploitable.
Upscaler
Outil d'agrandissement qui reconstruit du détail (Topaz Gigapixel, Magnific, upscalers Stable Diffusion).
Upscaler créatif
Upscaler qui invente du détail : résultat spectaculaire mais pouvant modifier l'image — à surveiller.
Variations (V1-V4)
Nouvelles propositions inspirées d'une image retenue : même esprit, détails différents.
Vary subtle / strong
Intensité des variations : légère (ajustement final) ou forte (exploration d'une même direction).
Version de modèle (--v)
Génération du modèle Midjourney utilisée ; chaque version modifie sensiblement les rendus.
Volumetric light (god rays)
Rayons de lumière rendus visibles par la brume ou la poussière.
VRAM
Mémoire de la carte graphique ; facteur limitant principal pour générer en local.
Watermark invisible
Signature imperceptible intégrée aux pixels, détectable par des outils dédiés ; fragile aux modifications.
Watermark visible
Mention apparente signalant une image générée ; lisible mais dégradante et facile à recadrer.
Workflow combiné
Chaîne d'outils où chacun intervient sur ce qu'il fait le mieux : créer, corriger, composer, finaliser.
Zoom Out
Dézoom qui élargit le champ ; transforme un gros plan en scène plus large et récupère de la marge.