GPT-Image 2.0
OpenAI lance GPT-Image 2.0 sur ChatGPT, un modèle d'IA générant du texte fiable et des images 4K grâce à un système de raisonnement et d'édition par API.
OpenAI lance GPT-Image 2.0, son nouveau modèle de génération et d'édition d'images intégré directement à ChatGPT. La principale rupture concerne le rendu du texte dans l'image, désormais quasi fiable, y compris pour des paragraphes, des interfaces ou des supports multilingues. Le modèle améliore aussi nettement le photoréalisme (peau, lumière, matériaux), le respect des instructions complexes et l'édition image-to-image, avec une capacité à modifier des éléments tout en conservant cohérence visuelle et éclairage. GPT-Image 2.0 introduit également un mode de raisonnement en amont de la génération, permettant d'analyser la demande, planifier la composition et itérer avant de produire l'image finale. Cette logique rapproche l'outil d'un système de production plutôt que d'un simple générateur. Le modèle prend en charge des sorties jusqu'à la 4K et s'intègre via API (gpt-image-2) ainsi que sur des plateformes tierces. La communauté souligne un gain net en productivité, malgré une esthétique parfois jugée plus “propre” et légèrement moins expressive. J'ai effectué mes premiers tests hier en fin d'après-midi, et je vais continuer ces prochaines heures mais voici : un récap : Le modèle tient ses promesses sur la cohérence (personnages, poses, composition) et le respect du texte, avec un vrai cap franchi sur les mockups et les usages éditoriaux. En test sur des demandes retail, la fidélité reste partielle sur les produits complexes. En cosmétique, des artefacts visuels persistent (lignes parasites) sur certaines générations notamment sur le visage des mannequins. Le rendu global manque encore de netteté en sortie directe, avec une sensation de qualité bridée, à voir côté API. En l'état, performant pour structurer et itérer, en préservant le worflow habituel en post-prod pour atteindre un niveau final exploitable. À voir ici les premiers tests de mon côté.