Ce soir, ChatGPT Images 2.0 a été lancé officiellement en grande pompe, devenant ainsi la première IA “ pensante ” spécialisée dans l’image. Altman a même déclaré que cela ressemblait à un bond en avant, passant directement de GPT-3 à GPT-5. Non seulement elle comprend avec précision les instructions en chinois et rend des interfaces utilisateur complexes, mais elle est même capable de graver du texte sur un grain de riz.

OpenAI, que tout le monde connaît bien, est de retour.
Tôt ce matin, Altman a animé lui-même une diffusion en direct de 20 minutes, mettant ainsi fin à plusieurs jours de silence.
OpenAI a enfin dévoilé le très attendu ChatGPT Images 2.0, marquant ainsi officiellement le début d'une toute nouvelle ère dans le domaine de la génération d'images.
Qu'est-ce que ChatGPT Images 2.0 exactement (et pourquoi on dit qu'il “ réfléchit ”) ?
ChatGPT Images 2.0 représente un véritable bond en avant sur le plan qualitatif. Il a permis de réaliser d'énormes progrès en matière de compréhension précise des consignes longues, de disposition exacte des objets et de clarification des relations entre eux, ainsi que de rendu de textes denses.
Mais surtout, ChatGPT Images 2.0 est le premier modèle d'images doté d'une “ capacité de réflexion ”. Il est capable de rechercher des informations en temps réel sur Internet et d'effectuer des vérifications automatiques.
Il peut également générer huit images au style homogène en une seule fois, avec une résolution ultra-haute pouvant atteindre 2K.
Pour faire simple, l'arrivée de ChatGPT Images 2.0 redéfinit les règles du jeu en matière de génération d'images —
Précision au pixel près : les petits textes, les icônes, les éléments d'interface utilisateur et autres détails complexes peuvent être générés en une seule fois, avec une prise en charge complète des rapports d'aspect allant de 3:1 à 1:3 ;
Transformation multilingue : le chinois, le japonais, le coréen et d’autres écritures non latines sont restitués avec précision — non seulement les caractères sont corrects, mais les phrases sont fluides et cohérentes ;
Styles aboutis : photoréalisme, images tirées de films, pixel art, bande dessinée… tous les langages visuels sont maîtrisés avec aisance ;
Capacité de raisonnement : ChatGPT Images 2.0 intègre une fonctionnalité de raisonnement, capable d'effectuer des recherches en ligne et de vérifier ses propres résultats, avec des connaissances mises à jour jusqu'en décembre 2025.
Dans le dernier classement d'Arena, ChatGPT Images 2.0 se détache largement, s'adjugeant la première place mondiale dans le domaine de la génération d'images par IA. Il devance Google Nano Banana 2/Pro de 242 points.

Dans les sept catégories de conversion de texte en image, il occupe la première place.

Fonctionnalités principales de ChatGPT Images 2.0 : quatre avancées majeures
| Fonctionnalité | Description | Pourquoi est-ce important ? |
|---|---|---|
| Précision au niveau du pixel | Affiche avec précision les petits textes, les icônes, les éléments d'interface utilisateur et les mises en page complexes, avec un niveau de détail élevé ; prend en charge des rapports d'aspect flexibles allant de 3:1 à 1:3 | Cela permet de l'utiliser pour des tâches concrètes telles que la conception d'interfaces utilisateur, la création d'affiches et la réalisation de visuels comportant beaucoup de texte |
| Affichage multilingue | Génère correctement du chinois, du japonais, du coréen et d'autres écritures non latines, avec une orthographe correcte et une formulation naturelle | Élimine une limitation majeure des modèles précédents, permettant ainsi la création de contenu à la fois global et localisé |
| Styles visuels aboutis | Permet de créer des images photoréalistes, des scènes cinématiques, du pixel art, des bandes dessinées et bien plus encore, tout en garantissant une grande cohérence stylistique | Permet aux créateurs de l'utiliser dans différents contextes créatifs et commerciaux |
| Capacité de réflexion | Comprend parfaitement les instructions, fait preuve de raisonnement, est capable de rechercher des informations en temps réel et vérifie lui-même ses résultats | Améliore la précision et la fiabilité, en particulier pour les tâches complexes de génération d'images comportant plusieurs étapes |

ChatGPT Images 2.0 permet désormais de générer des images au niveau du pixel
Ce qui frappe le plus, c'est sa capacité à générer des images au niveau du pixel.
Au cours de la diffusion en direct, une image représentant un tas de riz a été générée. Sur un seul grain de riz, les mots “ GPT image 2 ” étaient gravés.

Altman a également présenté d'autres images de bandes dessinées générées par GPU, en collaboration avec Gabriel Goh, responsable de la création d'images.
Les utilisateurs l'ont rapidement testé et ont une nouvelle fois été impressionnés par les capacités de ChatGPT Images 2.0.
Certains sont même allés jusqu’à dire : “ OpenAI reprend enfin la tête dans le domaine de la génération d’images ! ”
ChatGPT Images 2.0 fait une percée dans le rendu en chinois
OpenAI a même plaisanté : “ On finira bien par t'attraper ”
Auparavant, les modèles d'image donnaient des résultats satisfaisants en anglais et dans les langues dérivées du latin, mais dès qu'ils étaient confrontés au chinois, au japonais ou au coréen, ils se transformaient en “ gribouillis ”.”
Cette fois-ci, la démo officielle chinoise a connu un succès fulgurant, suscitant un vif intérêt sur le marché asiatique, à l'image de l'engouement qui avait accompagné HappyOyster d'Alibaba Lancement d'outils d'IA.
Chen Boyuan, chercheur chez OpenAI, est intervenu en personne (et a probablement rédigé lui-même la consigne) pour générer une bande dessinée en couleur d'une page entière en chinois. Celle-ci raconte comment il a optimisé le rendu du texte chinois pour ChatGPT Images 2.0 chez OpenAI.
Cette image démontre trois choses à la fois : un bond en avant qualitatif dans le rendu du texte chinois, un contrôle précis même avec des tailles de police extrêmement petites, et la capacité de ChatGPT Images 2.0 à générer d'un seul coup des bandes dessinées complexes composées de plusieurs cases.

La bande dessinée comporte cinq cases. Dans la première, Chen travaille devant son ordinateur, avec un thé aux perles en arrière-plan et une banane collée au mur avec du ruban adhésif (un clin d'œil à une célèbre scène artistique).
La deuxième ligne le montre en train de créer une affiche infographique multilingue dessinée à la main pour sa ville natale, Wuxi, regorgeant de texte chinois très dense — le tout correctement affiché.
La troisième rangée montre l'équipe en train de célébrer avec enthousiasme après avoir pris connaissance des résultats.
La quatrième ligne marque un changement de ton : Chen se détend avec son téléphone et reçoit un message de félicitations traduit, envoyé par Altman.
Et c'est là que ça devient passionnant.
À la cinquième ligne, Chen aperçoit l'image de félicitations créée par Altman, sur laquelle la phrase “ je te rattraperai sans faillir ” est inscrite bien en évidence au centre.
Ceux qui savent, savent.
Dans les conversations en chinois, GPT dit souvent des choses comme “ Je vais progressivement te rattraper ” ou “ Tes sentiments sont légitimes ”, ce qui fait l'objet de plaisanteries de la part de nombreux utilisateurs chinois depuis des mois, car cela ressemble à un discours de thérapie à l'américaine, jugé trop sincère.
Dans la bande dessinée, Chen s'effondre aussitôt, s'écriant avec une rage comique : “ Oh non ! Ça a réappris à ‘attraper’ ! ” Ses coéquipiers, à proximité, transpirent nerveusement et répondent : “ On fait tout notre possible pour régler le problème ! ”
Cet humour autodérisoire mérite une note maximale.
Outre le chinois, ChatGPT Images 2.0 a également présenté une bande dessinée d'aventure japonaise, une librairie indienne proposant des couvertures de livres en neuf langues, dont l'hindi, le bengali et le télougou, ainsi qu'une publicité pour un hébergement coréen de style hanok.
La langue n'est plus reléguée au second plan dans la génération d'images.
ChatGPT Images 2.0 : du GPT-3 au GPT-5, un bond en avant
On peut considérer ChatGPT Images 2.0 comme la prochaine étape majeure dans le domaine de la génération d'images chez OpenAI.
Au cours de la diffusion en direct, Altman a décrit ChatGPT Images 2.0 comme “ donnant l'impression de passer directement de GPT-3 à GPT-5 ”.”
Il suffit de télécharger une photo de groupe de quatre personnes pour que ChatGPT Images 2.0 génère directement une couverture de magazine, avec une mise en page et une typographie soignées.
L'affiche regorge de détails : le traitement des petits caractères, la cohérence des traits du visage, le tout créant une forte ambiance “ boys band ”.
En termes de détails, ChatGPT Images 2.0 atteint un véritable réalisme “ de qualité photographique ”, à tel point qu’il est difficile de deviner qu’il s’agit d’une image générée par l’IA.
Par exemple, une image reproduit l'année 2015, année de la création d'OpenAI. L'éclairage de l'amphithéâtre et le texte de la présentation PowerPoint sont d'un réalisme saisissant.
L'exemple le plus époustouflant était une image panoramique à 360° de l'alunissage.
Une fois importées dans un visualiseur de panoramas, la position du soleil, l'orientation des ombres et les moindres détails apparaissent clairement, démontrant une intelligence spatiale qui n'a rien à envier à celle des logiciels spécialisés Lingbot Map : cartographie en 3D systèmes.
Une autre démo officielle montre une capture d'écran d'un navigateur sous macOS avec ChatGPT ouvert. Superposition des fenêtres, terminal en arrière-plan, bureau en désordre… Autant de détails visuels qui font que cette image semble presque identique à une véritable capture d'écran.
À ce niveau de précision de rendu, ChatGPT Images 2.0 démontre que le contrôle exercé par le modèle sur chaque pixel a franchi un seuil critique.
ChatGPT Images 2.0 atteint le photoréalisme
Le réalisme constitue un autre progrès majeur.
Auparavant, les images générées par l'IA avaient toujours un certain “ aspect IA ” : une peau trop lisse, un éclairage trop uniforme, une composition trop parfaite.
ChatGPT Images 2.0 prend le contre-pied de cette approche et apprend à accepter “ l’imperfection ”.”
Dans les bandes-annonces officielles, des clichés pris sur le vif montrent la texture d'un film 35 mm, un grain visible, une composition légèrement décentrée, ainsi que des vêtements et des cheveux qui flottent au vent.
Si on ne vous l'avait pas dit, vous auriez cru qu'il s'agissait d'un photographe qui appuyait distraitement sur le déclencheur au bord de la route.

Une autre série imite les photos prises avec des appareils jetables dans les salles informatiques des lycées américains au début des années 2000.
Une surexposition due au flash, un léger flou de mouvement et un horodatage orange “ 02 18 04 ” dans un coin : toutes les imperfections de l'ère de la pellicule sont reproduites avec précision.
En matière de diversité stylistique, ChatGPT Images 2.0 se démarque également.
Les formats d'image prennent désormais en charge des proportions allant jusqu'à 3:1 en largeur et 1:3 en hauteur. OpenAI a même présenté un rouleau horizontal représentant un paysage traditionnel chinois, avec un effet de diffusion de l'encre et des espaces vides très convaincants.
Des affiches de films de la Nouvelle Vague française des années 1960 aux marque-pages Art déco en passant par les fiches de personnages d'anime, ChatGPT Images 2.0 garantit une grande cohérence stylistique — et pas seulement un résultat “ plus ou moins similaire ”.”
ChatGPT Images 2.0 lance le « mode réflexion »
Au cours de la diffusion en direct, Gabriel Goh, responsable de la division Images, a déclaré que ChatGPT Images 2.0 serait lancé avec deux modes :
Mode instantané
Mode de réflexion
La mise à jour la plus révolutionnaire réside dans “Mode de réflexion.”
Une fois sélectionné dans ChatGPT, ChatGPT Images 2.0 n'est plus seulement un outil de rendu du type “ vous demandez, je dessine ” : il devient un partenaire de réflexion visuelle.
Il consacre davantage de temps à comprendre votre intention, à rechercher des informations en temps réel sur Internet, à analyser la structure des images, puis à générer le contenu.
Mieux encore, en mode « réflexion », ChatGPT Images 2.0 est capable de générer d'un seul coup jusqu'à huit images présentant une cohérence stylistique et une cohérence des personnages, tout en évoluant progressivement.

Téléchargez un portrait, et ChatGPT Images 2.0 vous proposera instantanément huit combinaisons de tenues estivales. Choisissez-en une, et l'outil générera d'autres angles de vue et des détails supplémentaires sur les vêtements.
Dans cette tâche, ChatGPT Images 2.0 utilise deux types d“” intelligence visuelle » :
Tout d'abord, la compréhension visuelle : il faut véritablement “ voir ” la photo, saisir l'apparence d'une personne et imaginer des combinaisons de tenues adaptées.
Le deuxième aspect concerne la génération visuelle : il s'agit de transformer la mise en page prévue en images cohérentes et structurées.
Auparavant, la création de contenus pour les réseaux sociaux nécessitait de générer des images une par une, puis de les assembler manuellement. Désormais, une seule instruction donnée à ChatGPT Images 2.0 permet de générer simultanément des contenus adaptés aux formats Twitter, Instagram Stories, fil d’actualité Instagram et LinkedIn, avec un ton et une composition harmonisés.
Une démo officielle a présenté des supports publicitaires pour “ kizuki ”, une boutique de matcha de Brooklyn : un matcha glacé à la fraise sous les rayons du soleil, alliant l'esthétique streetwear au minimalisme japonais, le tout réalisé en une seule étape.

Une autre démonstration présente une affiche universitaire : il suffit de télécharger un fichier PDF pour que ChatGPT Images 2.0 en extraie les graphiques, les données et la structure essentiels, puis les organise sous la forme d'une affiche horizontale.
Il convient notamment de noter qu'en mode « réflexion », ChatGPT Images 2.0 peut également effectuer des recherches directement sur Internet.
L'équipe a révélé que le modèle “ DuckTape ”, issu du test à l'aveugle mené par Arena il y a quelques jours, était en réalité ChatGPT Images 2.0.
Ils l'ont même configuré pour recueillir les commentaires des utilisateurs en ligne et les transformer en image — et il a généré un code QR scannable.
Alors… Est-ce vraiment meilleur que Midjourney ou Stable Diffusion ?
C'est la question que la plupart des gens se poseront, même s'ils ne la formulent pas directement.
Pour se faire une idée, en gros :
- Affichage du texte : ChatGPT Images 2.0 a une longueur d'avance
- Multilingue : ainsi qu'à l'avenir (notamment en Chine)
- Facilité d'utilisation : un obstacle bien moins important
- Commande : mais pas encore aussi polyvalent que Stable Diffusion
- Un “ style artistique ” à l'état pur : Midjourney conserve son avantage
Donc, si votre travail consiste à contenus concrets (interface utilisateur, affiches, publicités, visuels comportant beaucoup de texte), Images 2.0 semble désormais bien plus proche d'être utilisable.
Si vous réalisez des œuvres très stylisées ou si vous recherchez un contrôle extrême, les anciens modèles ont encore leur place.
Réalisme digne d'une photo : les images générées par l'IA ne ressemblent enfin plus à des images générées par l'IA
Le réalisme constitue un autre progrès majeur.
Les images générées par l'IA par le passé avaient souvent cet étrange “ aspect ” IA » » : trop lisses, trop parfaites, légèrement décalées.
Images 2.0 prend le contre-pied de cette approche et commence à “ apprendre ” l’« imperfection ».”
Dans les bandes-annonces officielles, des clichés pris sur le vif montrent la texture d'un film 35 mm, un grain visible, une composition légèrement décentrée, ainsi que des vêtements et des cheveux qui flottent au vent.
Une autre série imite les photos prises avec des appareils jetables dans les salles informatiques des lycées américains au début des années 2000.
Surexposition due au flash, flou de mouvement, horodatage dans le coin… Tous ces détails désordonnés et imparfaits sont bien là.
Si vous ne le saviez pas, vous penseriez sans doute qu’elles ont été prises par un être humain.
Comment s'en servir concrètement (sans trop y réfléchir)
Pour commencer, rien de plus simple :
- Ouvrir ChatGPT
- Choisir la génération d'images
- Choisissez le mode « Instantané » ou « Réflexion »
- Décrivez ce que vous souhaitez (sans trop en faire)
- Répétez l'opération plusieurs fois
Un petit conseil :
Si votre mission consiste à mise en page, texte ou plusieurs éléments, passez directement en mode « Réflexion ». C'est plus lent, mais ça évite les nouvelles tentatives.
Les consignes restent plus importantes que vous ne le pensez
Même avec toutes ces améliorations, les messages d'invite restent importants.
Une méthode simple qui fonctionne la plupart du temps :
Sujet + style + détails + contexte
Par exemple :
- “ une affiche ” → trop vague
- “ Une affiche minimaliste de style japonais représentant un matcha glacé à la fraise, une lumière douce, une ambiance de photographie de rue et une typographie épurée ” → c'est bien mieux

Par ailleurs, si vous souhaitez ajouter du texte à l'image, il suffit de le préciser clairement. Le modèle est enfin suffisamment performant pour qu'on puisse l'essayer.
ChatGPT Images 2.0 est désormais disponible sur ChatGPT et Codex
À partir d'aujourd'hui, tous les utilisateurs de ChatGPT et de Codex peuvent utiliser ChatGPT Images 2.0.
La fonctionnalité de génération d’images “ réfléchies ” est désormais disponible pour les utilisateurs de ChatGPT Plus, Pro et Business, avec des niveaux d’accès clairement définis, ce qui évite la confusion observée lorsque les utilisateurs se demandaient : “Anthropic a-t-il retiré Claude Code de Pro ?? ” Le modèle sous-jacent, gpt-image-2, est également disponible via l'API.
En termes de tarification, ChatGPT Images 2.0 est plus performant, tandis que les coûts liés aux entrées et sorties de jetons restent inchangés, ce qui lui confère un avantage concurrentiel par rapport à Prix de l'Opus Claude 4.7.

Pour les utilisateurs lambda, la création de visuels de présentation, d'affiches pour les réseaux sociaux et de fiches produits — des tâches qui nécessitaient autrefois des heures de travail dans Photoshop — peut désormais être réalisée à l'aide d'une simple commande grâce à ChatGPT Images 2.0.
Pour les développeurs et les entreprises, la création d'annonces localisées, d'infographies multilingues, de contenus pédagogiques et d'outils de conception peut désormais être automatisée à grande échelle via une API.
Dans Codex, ChatGPT Images 2.0 intègre la génération d'images dans l'espace de travail, ajoutant ainsi une dimension visuelle intéressante au projet en cours ChatGPT Codex contre Claude Code débat. Les équipes de conception peuvent créer des concepts d'interface utilisateur, comparer les différentes options et passer à la phase de développement du produit, le tout sans changer d'outil.
Tarification, accès et implications concrètes
ChatGPT Images 2.0 est désormais disponible dans ChatGPT (Plus, Pro, Business) et via l'API (gpt-image-2).
À première vue, les prix n'ont pas beaucoup changé, mais le valeur par sortie est nettement plus élevé.
Concrètement, cela signifie :
- Les raisons pour lesquelles vous ouvriez Photoshop autrefois — ce n'est peut-être plus le cas aujourd'hui, ce qui reflète une évolution plus générale du secteur du « vibe coding » au « wish coding » où l'IA se charge du gros du travail.
- Les équipes peuvent générer des lots d'éléments visuels sans avoir à effectuer un travail manuel fastidieux
- Les développeurs peuvent intégrer directement la génération d'images dans leurs flux de travail
Il ne s'agit pas tant d“” images bon marché » que de éliminer les obstacles dans la production visuelle.
ChatGPT Images 2.0 marque-t-il un tournant décisif dans la génération d'images par IA, à l'instar de l'iPhone ?
Avec le recul — de DALL·E à Midjourney en passant par Stable Diffusion —, la génération d'images par IA est restée longtemps à un stade où elle était “ utilisable, mais pas encore tout à fait au point ”.”
Les problèmes d'affichage du texte, la prise en charge multilingue insuffisante, les styles répétitifs et les compositions manifestement générées par l'IA : autant d'éléments qui décourageaient une utilisation sérieuse dans des situations réelles.
ChatGPT Images 2.0 corrige d'un seul coup toutes ces lacunes et ajoute une capacité de réflexion ainsi que la génération de plusieurs images.
Ce n'est pas encore parfait, mais ChatGPT Images 2.0 pourrait bien être le premier modèle d'images qui donne aux designers, aux spécialistes du marketing et aux créateurs de contenu l'impression de pouvoir “ vraiment l'utiliser dans leur travail quotidien ”.”
Aujourd’hui, les designers pourraient devoir repenser ce qui constitue véritablement leur avantage concurrentiel, d’autant plus que l’IA redéfinit le paysage créatif parallèlement aux progrès réalisés dans le domaine de Claude design.


