Midjourney étend V8.2 à l’édition guidée par texte et références

Le nouveau modèle d’édition V8.2 modifie une image par instruction, combine quatre références et prend en charge l’inpainting et l’outpainting.

Midjourney a ouvert à l’ensemble de ses utilisateurs le test de son premier modèle d’édition associé à V8.2. Cette version réunit dans un même environnement la modification par instruction, le remplacement d’une zone, l’extension du cadre et la génération à partir de plusieurs images.

Le modèle accepte jusqu’à quatre références simultanées. Midjourney présente cette fonction comme la relève d’Omni Reference, limité à une seule image avec V7. Les références peuvent représenter des personnages, des objets, des vêtements, des environnements ou d’autres éléments que l’utilisateur souhaite retrouver dans une nouvelle composition.

L’édition guidée par texte consiste à importer une image puis à décrire les changements attendus. L’utilisateur peut agir sur l’ensemble de la scène ou sélectionner une zone au pinceau pour remplacer un détail précis. L’outpainting élargit quant à lui le cadre initial, en générant le contenu manquant autour de l’image.

Le modèle fonctionne également avec la personnalisation du compte, les moodboards et les références de style `--sref`. Midjourney recommande toutefois d’accompagner ces éléments d’indications textuelles supplémentaires, signe que leur interprétation reste encore instable dans cette première version.

Plusieurs chemins donnent accès au modèle. Une image peut être déposée dans la barre de prompt avec l’option « Attach to prompt », ouverte avec le bouton « Edit » depuis la galerie, ou importée dans l’onglet dédié du site. Sur Discord, la commande `--edit` suivie de l’adresse de l’image lance le même processus.

Les interfaces de midjourney.com et d’alpha.midjourney.com ont été adaptées pour accompagner ce nouveau fonctionnement. La version Alpha doit servir de terrain d’expérimentation pour de nouvelles méthodes de sélection, de composition et de contrôle des références.

Le lancement reste présenté comme un test communautaire plutôt qu’une version stabilisée. Midjourney demande aux utilisateurs de signaler les générations incorrectes depuis la galerie et de transmettre l’identifiant des tâches problématiques. L’entreprise cherche autant à identifier les situations où le modèle échoue qu’à recueillir des avis sur l’organisation de l’interface.

Moins de vingt-quatre heures après l’ouverture du test, Midjourney a d’ailleurs publié une première mise à jour consacrée à la qualité d’image. L’entreprise invite les personnes ayant rencontré des problèmes lors du lancement à relancer leurs demandes. Aucun détail technique n’a été communiqué sur la nature des corrections.

Ce démarrage rapide illustre l’intérêt de la nouvelle architecture, mais aussi son état encore expérimental. La prise en charge de quatre références rapproche Midjourney des outils de composition contrôlée, tandis que l’inpainting et l’outpainting existaient déjà dans son éditeur sous différentes formes. La principale évolution tient donc à leur réunion au sein d’un modèle V8.2 capable de recevoir plusieurs sources et une instruction commune.

Midjourney n’a pas encore détaillé le coût en temps de calcul de ces opérations, leur compatibilité avec tous les paramètres de V8.2 ni les différences exactes entre les résultats produits sur le site et sur Discord. De nouvelles corrections sont annoncées à court terme.