GPT-Image

Le Guide complet du générateur d’image d’OpenAI (v1, Mini, 1.5 et GPT Image 2)

Created Time
modele IMG
modele IMG
GPT Image est la famille de modèles de génération et d'édition d'images d'OpenAI, successeur de DALL·E.
Nativement multimodaux, ces modèles comprennent à la fois le texte et les images pour produire des visuels de qualité professionnelle.
Depuis le lancement du premier GPT-Image en mars 2025, ils ont redéfini les standards de la création visuelle par IA. La génération actuelle, ChatGPT Images 2.5, sortie le 8 septembre 2026, se décline en deux moteurs API complémentaires : Flare pour la vitesse, Sunburst pour la précision.
notion image
Dernière mise à jour : 11/09/2026
⭐

GPT Image

Qu’est-ce que GPT-Image ?De DALL·E à GPT Image Une architecture communeComparatif complet des modèles GPT ImageQuels modèles GPT Image ferment, et quand ?Comment utiliser GPT Image ?Où utiliser GPT Image ?Via ChatGPT (grand public)Les nouveautés d'interface de la version 2.5Via les plateformes partenairesVia l'API OpenAI (développeurs)Les paramètres à connaîtreLes alternatives à l'API directeComment prompter GPT Image ?Images générées avec GPT ImageTous les modèles GPT-ImageGPT Image 2.5 - La version actuelleUn nom produit, deux modèlesLes 5 améliorations de ChatGPT Images 2.5Deux nouveaux paliers de qualitéFlare ou Sunburst : lequel choisir ?Disponibilité et accès (au 8 septembre 2026)Points forts de GPT Image 2.5Limites de GPT Image 2.5SécuritéGPT Image 2 - La génération précédenteLe nom officiel : ChatGPT Images 2.0Les 5 grandes améliorations de ChatGPT Images 2.0Disponibilité et accès (au 21 avril 2026)Ce qui change radicalement avec GPT Image 2Réactions de la communautéGPT Image 1.5 - La version précédenteLes 4 améliorations clés de GPT Image 1.5GPT Image 1.5 et la concurrencePoints forts de GPT Image 1.5Limites de GPT Image 1.5GPT Image 1 Mini - La version économiqueQuand choisir GPT Image 1 Mini ?Tarifs GPT Image 1 Mini (API)GPT Image 1 - Le modèle fondateurCe qui l'a distingué à sa sortiePoints forts de GPT Image 1Limites de GPT Image 1Combien coûte GPT Image ?Tarifs au token (API OpenAI)Coût par image générée (1024×1024)Quelle qualité choisir ?Et en 2K / 4K ?Estimation mensuelle selon l'usageGPT Image vs la concurrenceQui est derrière GPT Image ?FAQ GPT ImageArticles et Tutoriel GPT Image
🗞️

L’actualité GPT Image

notion image

GPT-Image 2.5 et là

08/09/26 - OpenAI lance ChatGPT Images 2.5 et deux nouveaux modèles API : Flare et Sunburst.
notion image

Sortie de GPT Image 2

21/04/26 - OpenAI révèle son nouveau champion de la génération d’images.
notion image

Leak de GPT Image 2

07/04/26 - Un leak révèle le nouveau générateur d’images d’OpenAI.
notion image

Le nouveau GPT Image 1.5 est là

17/12/25 - OpenAI annonce GPT-Image 1.5 avec des capacités d’édition avancées (et une meilleure qualité)
 
 
 

Qu’est-ce que GPT-Image ?

GPT-Image est le nom de la famille de modèles d'intelligence artificielle intégrée à ChatGPT pour générer des images à partir de prompts textuels, avec une précision remarquable dans le respect des consignes.
Côté grand public, OpenAI parle de ChatGPT Images (version 2.5 depuis septembre 2026). Côté développeurs, chaque version correspond à un ou plusieurs identifiants API.
La famille compte aujourd'hui, par ordre d'ancienneté :
  • GPT Image 1 — le modèle fondateur (avril 2025) — fermeture le 23 octobre 2026
  • GPT Image 1 Mini — la version économique pour développeurs (octobre 2025) — fermeture le 1er décembre 2026
  • GPT Image 1.5 — la première version « édition préservative » (décembre 2025) — fermeture le 1er décembre 2026
  • GPT Image 2 — la génération précédente (avril 2026), toujours disponible en API
  • GPT Image 2.5 Flare — le modèle rapide, recommandé par défaut (septembre 2026) ✅
  • GPT Image 2.5 Sunburst — le modèle haut de gamme, pour l'édition de précision (septembre 2026) ✅
À noter : DALL·E 2 et DALL·E 3 ont été définitivement fermés le 12 mai 2026. OpenAI concentre désormais toute son offre image sur la branche GPT Image.

De DALL·E à GPT Image

Avant GPT Image, OpenAI proposait DALL·E 2 et DALL·E 3, des modèles de diffusion dédiés à la génération d'images. Ces modèles fonctionnaient de manière séparée du reste de l'écosystème GPT : ils recevaient un texte, produisaient une image, sans vraiment "comprendre" le contexte.
GPT Image change de paradigme. Il s'agit d'un modèle nativement multimodal basé sur une architecture de transformer (la même famille technologique que les grands modèles de langage comme ChatGPT). Concrètement, cela signifie que le modèle traite le texte et l'image comme un seul flux d'information, ce qui lui confère une compréhension du monde et des instructions très supérieure à ses prédécesseurs.
Contrairement à DALL·E 3 qui "traduisait" un texte en image via deux systèmes distincts, GPT Image raisonne directement sur le contenu visuel : il peut ainsi modifier une image existante de façon chirurgicale, intégrer du texte lisible dans une scène, comprendre des références culturelles implicites.

Une architecture commune

Tous les modèles GPT Image partagent les mêmes principes architecturaux (transformer multimodal, inférence auto-régressive sur des tokens visuels) et la même API. Ce qui change entre les versions, c'est la puissance du modèle sous-jacent, les optimisations de vitesse, les capacités d'édition.

Comparatif complet des modèles GPT Image

Critère
GPT Image 1.5
GPT Image 2
GPT Image 2.5 Flare
GPT Image 2.5 Sunburst
Sortie
Décembre 2025
21 avril 2026
8 septembre 2026
8 septembre 2026
Statut
⚠️ Fermeture 01/12/26
Disponible
Recommandé par défaut ✅
Qualité maximale ✅
Positionnement
Génération + édition
Modèle unique
Petit modèle, orienté vitesse
Modèle de base, orienté qualité
Vitesse (1024², qualité high)
~10-15 s
~3-4 min
~20 s
~40 s
Qualité vs GPT Image 2
Inférieure
Référence
Supérieure
La plus élevée
Rendu de texte
Très bon
Quasi-parfait
Quasi-parfait +
Quasi-parfait +
Édition préservative
✅
✅
✅ Améliorée
✅ La plus fiable
Cohérence multi-tours
Limitée
Correcte
Améliorée
La meilleure
Paliers de qualité
low / medium / high
+ auto
+ xhigh / max
+ xhigh / max
Résolution max
1 536 px
3 840 px
3 840 × 2 160
3 840 × 2 160
Ratios
1:1, portrait, paysage
3:1 à 1:3
3:1 à 1:3
3:1 à 1:3
Fond transparent
✅
✅
✅ Amélioré
✅ Amélioré
Prix (1024², high)
~0,17 $
~0,211 $
~0,053 $
~0,053 $
Accès
API (jusqu'au 01/12)
API
API + ChatGPT + Codex
API + ChatGPT + Codex
Identifiant API
gpt-image-1.5
gpt-image-2
gpt-image-2.5-flare
gpt-image-2.5-sunburst
⚠️ Attention au piège de migration : les paliers de qualité ont été recalibrés en 2.5. Le palier high de GPT Image 2.5 consomme environ quatre fois moins de tokens que le high de GPT Image 2 — il correspond en réalité à l'ancien medium. Pour retrouver le budget et le niveau de détail de l'ancien high, il faut passer max. Ce n'est pas une baisse de qualité, c'est une échelle plus fine avec deux crans supplémentaires.

Quels modèles GPT Image ferment, et quand ?

OpenAI consolide son offre image autour d'un seul modèle par génération. Si vous appelez encore un ancien identifiant dans vos scripts ou vos automatisations, voici les dates à retenir :
Modèle
Date de fermeture
Remplacement recommandé
dall-e-2 / dall-e-3
Fermés le 12 mai 2026
gpt-image-2.5-flare
gpt-image-1
23 octobre 2026
gpt-image-2.5-flare
gpt-image-1-mini
1er décembre 2026
gpt-image-2.5-flare
gpt-image-1.5
1er décembre 2026
gpt-image-2.5-flare
chatgpt-image-latest
1er décembre 2026
gpt-image-2.5-flare
Concrètement : après le 1er décembre 2026, seuls gpt-image-2 et les deux modèles 2.5 répondront encore. Migrer coûte une ligne de code (le nom du modèle) mais pensez à retirer input_fidelity (rejeté depuis la v2) et response_format (hérité de DALL·E, rejeté également).

Comment utiliser GPT Image ?

Où utiliser GPT Image ?

Via ChatGPT (grand public)

La méthode la plus accessible. ChatGPT dispose d'une interface dédiée à la création visuelle, accessible à l'adresse chatgpt.com/images ou depuis le menu latéral « Images ». Elle propose des styles prédéfinis, une zone de génération et un historique complet des visuels créés.
Le modèle actif dans ChatGPT est ChatGPT Images 2.5 depuis le 8 septembre 2026. Il est déployé pour tous les utilisateurs — ChatGPT, ChatGPT Work et Codex — sur ordinateur, mobile et web. Les comptes gratuits restent soumis à des quotas quotidiens et à des files d'attente en période de forte demande ; les plans payants bénéficient de volumes plus généreux et d'un accès prioritaire.

Les nouveautés d'interface de la version 2.5

Le passage à la 2.5 ne concerne pas que le modèle : OpenAI a ajouté quatre fonctionnalités produit qui changent la façon de travailler.
  • Sketch — vous dessinez directement dans ChatGPT et le modèle utilise ce croquis comme référence visuelle. Utile pour poser un plan de pièce, la silhouette d'un vêtement ou une composition, sans avoir à la décrire en mots. Tapez @Sketch dans la conversation pour l'activer.
  • Templates — des points de départ pour les formats les plus courants (affiche, merch, flyer, photo produit). Vous complétez les informations à faire passer et les éléments de style plutôt que de partir d'une page blanche.
  • Commentaires sur l'image — vous pouvez poser une annotation à un endroit précis de l'image pour demander une correction ciblée, au lieu de tout décrire dans le prompt.
  • Partage de prompt — en partageant une image, vous pouvez inclure le prompt qui l'a produite. La personne en face peut le rejouer avec ses propres photos et ses propres détails.

Via les plateformes partenaires

Plusieurs plateformes intègrent GPT Image sans nécessiter de code.
Des sites comme getimg AI, ImagineArt ou Freepik intègrent par exemple GPT-Image à leur suite d’outils créatifs pour générer images et visuels.
Ces plateformes présentent l'avantage d'offrir une interface unifiée pour tester différents modèles sans changer d'outil. Certaines proposent également des crédits gratuits pour débuter, des tarifs alternatifs qui peuvent être plus avantageux pour certains usages, ou des fonctionnalités spécialisées ou des workflows automatisés.
notion image

Via l'API OpenAI (développeurs)

Pour les développeurs et les entreprises qui intègrent la génération d'images dans leurs applications, GPT Image 2.5 est disponible via plusieurs sources.
Choisir entre Flare et Sunburst
C'est la vraie nouveauté de cette génération : il n'y a plus un modèle, mais deux, au même tarif au token et avec les mêmes paramètres. Le choix se fait sur l'arbitrage vitesse / précision.
gpt-image-2.5-flare est le choix par défaut pour la majorité des applications. OpenAI le décrit comme produisant une meilleure qualité que GPT Image 2 avec une latence réduite de moitié. Il convient au contenu créateur et social, aux visuels produits, à la recherche visuelle, au prototypage rapide et à la génération en volume.
gpt-image-2.5-sunburst est le modèle le plus capable d'OpenAI en génération et en édition. Il vise les workflows premium où le contrôle sur une série de retouches prime : création de campagne prête à diffuser, imagerie produit finalisée, fusion multi-images. Contrepartie : des temps de génération sensiblement plus longs.
La méthode recommandée par OpenAI : si la qualité est votre contrainte, partez sur Sunburst, validez que le résultat passe la barre, puis testez si Flare atteint le même niveau plus vite. Si vous venez de GPT Image 2 et qu'il vous satisfaisait, partez directement sur Flare pour gagner en latence.
Les endpoints
L'API officielle d'OpenAI reste la source principale. Deux voies d'accès :
  • Image API — /v1/images/generations pour générer, /v1/images/edits pour éditer, remplacer une zone via un masque ou fusionner plusieurs références. À privilégier pour une image générée à partir d'un prompt.
  • Responses API — la génération d'images comme outil intégré (image_generation) dans une conversation. À privilégier pour construire une expérience conversationnelle où l'utilisateur affine son image au fil des échanges. Le paramètre action (auto / generate / edit) permet de forcer la création ou l'édition.
En production, épinglez les snapshots datés gpt-image-2.5-flare-2026-09-08 et gpt-image-2.5-sunburst-2026-09-08 pour qu'un changement d'alias ne modifie jamais le comportement de votre application sans prévenir.

Les paramètres à connaître

  • quality : low, medium, high, xhigh, max ou auto. Les deux derniers paliers, xhigh et max, sont exclusifs à la 2.5. Évitez auto en production : le modèle choisit un palier à la volée, et la facture varie du simple au triple pour un même prompt.
  • size : largeur × hauteur, les deux multiples de 16 px, ratio compris entre 1:3 et 3:1, bord maximal de 3 840 px (soit 3840×2160 en 4K). Les résolutions au-delà de 2560×1440 sont marquées expérimentales.
  • background: "transparent" : fond transparent natif, avec png ou webp uniquement. Précisez dans le prompt que vous voulez un sujet isolé, sinon le modèle peindra le décor décrit et le paramètre ne le rattrapera pas.
  • Images de référence : jusqu'à 16 sur l'endpoint d'édition, référencées dans le prompt par leur ordre d'envoi (« image 1 », « image 2 »).
  • Streaming : stream: true avec partial_images entre 0 et 3 pour afficher des aperçus progressifs.
  • Paramètres à ne plus envoyer : input_fidelity (la haute fidélité est forcée sur les références) et response_format (la sortie est toujours du base64). Les deux renvoient une erreur 400.

Les alternatives à l'API directe

OpenAI met à disposition un Playground pour tester le modèle avant d'écrire une ligne de code, ainsi qu'une documentation complète avec un guide de prompting dédié.
Adobe Firefly, Runway, Manus et Higgsfield AI ont intégré les modèles 2.5 dès le lancement. Fal.ai et Replicate déploient traditionnellement les modèles OpenAI sur leur infrastructure dans les jours qui suivent, avec des endpoints simplifiés, la gestion de file d'attente et des webhooks. Microsoft Foundry (Azure AI) propose de son côté un environnement cloud avec contrôles d'accès, journaux d'audit et conformité réglementaire.
Ces alternatives peuvent présenter des avantages en infrastructure, en tarification ou en fonctionnalités additionnelles, comme l'accès à plusieurs modèles via un seul endpoint.

Comment prompter GPT Image ?

La puissance de GPT Image vient de sa compréhension fine du langage. Mais même avec le meilleur modèle, la qualité du prompt reste déterminante.
La clarté prime sur la longueur. Un prompt efficace décrit précisément ce que vous voulez voir sans noyer le modèle sous des détails superflus. "Bureau moderne, lumière naturelle, plantes, mobilier ergonomique, photoréaliste" fonctionne mieux et demande moins de token moins cher que "Je voudrais que tu crées une magnifique et époustouflante image photoréaliste d'un espace de travail de bureau moderne avec un éclairage naturel, des plantes, du mobilier ergonomique et une atmosphère productive qui conviendrait pour l'en-tête du site web d'une entreprise technologique."
notion image
Pour les scènes photoréalistes, mentionnez des détails techniques quand ils comptent : le type d'appareil photo (smartphone, DSLR), les caractéristiques de la lumière (douce, dramatique, dorée), la profondeur de champ, le grain du film si vous visez un style vintage. Pour les styles artistiques, nommez directement le mouvement ou l'artiste de référence : "style Studio Ghibli", "aquarelle impressionniste", "illustration vectorielle moderne".
Le modèle comprend les références culturelles et historiques. Plutôt que de décrire laborieusement une époque, vous pouvez dire "New York années 1970" ou "village médiéval français" et le modèle reconstituera l'atmosphère appropriée. Cette connaissance contextuelle s'étend aux événements historiques, aux lieux célèbres et aux styles artistiques reconnus.
Pour l'édition d'images, soyez spécifique sur ce qui doit changer et ce qui doit rester intact. "Change uniquement la couleur de la chemise en rouge, garde tout le reste identique" donne de meilleurs résultats que "mets une chemise rouge". Vous pouvez aussi définir des contraintes : "même éclairage", "même composition", "même expression du visage".
Quand vous travaillez avec plusieurs images de référence, numérotez-les et référencez-les clairement : "Applique le style de l'image 1 au sujet de l'image 2" ou "Combine les éléments de l'image 1 et 2 dans une seule composition avec l'arrière-plan de l'image 3."
Pour les tâches nécessitant du texte lisible (infographies, logos, maquettes UI), spécifiez exactement le texte souhaité et son placement. Le modèle respecte mieux les instructions quand elles sont explicites. Si le texte est complexe ou multilingue, prévoyez peut-être quelques itérations pour affiner le résultat.
Le paramètre de qualité impacte à la fois le rendu, la vitesse et le coût, et l'échelle s'est affinée avec la 2.5. low convient à l'exploration rapide, aux brouillons et à la génération en masse. medium est le bon compromis quotidien. high devient le palier de référence pour les visuels publiés. xhigh et max, nouveaux en 2.5, sont à réserver aux cas où les petits caractères doivent rester lisibles : étiquettes, mentions légales, infographies denses, affiches destinées à l'impression. L'écart de prix entre low et max atteint un facteur 35, et l'écart de temps de génération un facteur 4 à 10 selon le modèle.
Avec la 2.5, l'édition itérative devient une vraie méthode de travail. Le modèle conserve mieux les modifications déjà appliquées au fil d'une longue conversation : vous pouvez enchaîner « change la couleur du mur », puis « ajoute une plante à gauche », puis « passe en lumière de fin de journée » sans que les deux premières consignes se dégradent. Plutôt que d'écrire un prompt monstre, décomposez en retouches successives et vérifiez à chaque étape.
🔗
Pour apprendre et maitriser la génération d’images, consultez aussi notre Guide complet des prompts ChatGPT Images

Images générées avec GPT Image

https://x.com/john_my07/status/2001220645087273090/photo/1
https://x.com/369labsx/status/2001428766921208194/photo/1
https://x.com/HBCoop_/status/2001686458940228068/photo/4
https://x.com/_b_1_4_n_k_/status/2001960001108333004/photo/1
https://x.com/AllaAisling/status/2001386979544408248/photo/4
https://x.com/HBCoop_/status/2001686458940228068/photo/3
https://x.com/AllaAisling/status/2001386979544408248/photo/1
https://x.com/HBCoop_/status/2001686458940228068/photo/1
https://x.com/john_my07/status/2001300881837584714/photo/1
https://x.com/HBCoop_/status/2001686458940228068/photo/2
https://x.com/fabioricotta/status/2001004322801516772/photo/1
https://x.com/AllaAisling/status/2001386979544408248/photo/3
https://x.com/HiSohan/status/2001934400590954686
 

Tous les modèles GPT-Image

GPT Image 2.5 - La version actuelle

Un nom produit, deux modèles

Comme pour les générations précédentes, OpenAI ne communique pas sur « GPT Image 2.5 » auprès du grand public : le nom produit officiel est ChatGPT Images 2.5. Mais pour la première fois, une génération de GPT Image se décline en deux modèles API distincts : gpt-image-2.5-flare et gpt-image-2.5-sunburst.
Ce n'est pas un découpage tarifaire : les deux coûtent exactement le même prix au token et acceptent les mêmes paramètres. C'est un arbitrage vitesse contre précision, que le développeur choisit selon son cas d'usage.
Le contexte donne la mesure de l'enjeu : OpenAI annonce plus de 3 milliards d'images générées par semaine sur l'ensemble de ChatGPT Images et des modèles GPT Image en API.

Les 5 améliorations de ChatGPT Images 2.5

  • Fidélité aux photos de référence. C'est le point mis en avant par OpenAI. Les sujets d'une photo de référence restent reconnaissables lorsqu'on les transpose dans un autre décor, un autre style ou une autre composition. Les visages gardent leurs traits distinctifs, la lumière et les textures paraissent plus naturelles. Pour les équipes qui construisent sur l'API, cela rend les workflows pilotés par référence nettement plus fiables : les déclinaisons restent ancrées à la source.
  • Édition de précision. Le modèle modifie ce que vous avez demandé et laisse le reste tranquille, y compris sur des sujets et des arrière-plans complexes. Changer un produit, un fond ou une ligne de texte n'altère plus le sujet, la composition ni le traitement de marque autour.
  • Cohérence sur plusieurs tours. Dans une conversation longue, les modifications antérieures se maintiennent et chaque nouvelle retouche s'appuie sur les précédentes au lieu de dégrader progressivement l'image. C'était la principale limite pratique des versions antérieures.
  • Vitesse. Jusqu'à 50 % de latence en moins par rapport à Images 2.0. Sur des mesures indépendantes en 1024×1024, Flare génère en une vingtaine de secondes en qualité high là où GPT Image 2 pouvait dépasser trois minutes. Adobe et Manus ont rapporté des gains de 2 à 4× dans leurs évaluations.
  • Intelligence et style. Meilleure compréhension des consignes visuelles complexes, informations du monde réel plus exactes dans les images, gestion de mises en page plus élaborées, fonds transparents plus fiables, et respect plus constant de la direction artistique demandée quand les instructions se précisent.

Deux nouveaux paliers de qualité

xhigh et max viennent s'ajouter au-dessus de high, qui plafonnait la version 2.0. Concrètement, l'échelle compte désormais cinq crans explicites plus un mode automatique, ce qui permet de doser bien plus finement le rapport détail / coût / temps.
Attention toutefois : les paliers ont été recalibrés. Le high de la 2.5 consomme le même nombre de tokens que l'ancien medium de GPT Image 2, et c'est max qui correspond à l'ancien high. Si vous migrez, ne recopiez pas votre valeur de quality telle quelle, vous descendriez d'un cran sans le vouloir.

Flare ou Sunburst : lequel choisir ?

ㅤ
GPT Image 2.5 Flare
GPT Image 2.5 Sunburst
Positionnement
Petit modèle, rapide, par défaut
Modèle de base, le plus capable
Qualité
Supérieure à GPT Image 2
La plus élevée de la gamme
Latence (1024²)
low ~10 s / high ~21 s / max ~45 s
low ~14 s / high ~42 s / max ~142 s
Idéal pour
Contenu social, visuels produits, prototypage, volume
Retouche multi-tours, campagnes, fusion multi-images
Prix
Identique
Identique
Latences mesurées en septembre 2026 sur des générations 1024×1024 ; elles varient selon la charge et la résolution demandée.

Disponibilité et accès (au 8 septembre 2026)

Canal
Accès
ChatGPT (web, iOS, Android, desktop)
✅ Tous les plans, y compris gratuit
ChatGPT Work
✅ Inclus
Codex
✅ Inclus
API OpenAI
✅ gpt-image-2.5-flare et gpt-image-2.5-sunburst (Image API et Responses API)

Points forts de GPT Image 2.5

  • Préservation des visages et des produits issus de photos de référence
  • Retouches ciblées qui n'abîment pas le reste de l'image
  • Stabilité sur de longues séries d'éditions successives
  • Jusqu'à deux fois plus rapide que la génération précédente
  • Deux paliers de qualité supplémentaires pour les détails fins
  • Même tarif au token que GPT Image 2, à qualité supérieure

Limites de GPT Image 2.5

  • Résolution de sortie par défaut modeste dans ChatGPT et Codex : la plupart des générations demandent un passage d'upscaling avant un usage en production
  • Sunburst peut dépasser les deux minutes par image en qualité max
  • Aucun classement Arena public au moment du lancement : les comparaisons avec la concurrence reposent sur des tests individuels
  • Modèle fermé, hébergement cloud uniquement

Sécurité

OpenAI reconnaît dans sa system card que le réalisme accru de la 2.5 pourrait, sans garde-fous, faciliter des deepfakes plus convaincants, y compris politiques ou à caractère sexuel impliquant des personnes réelles. Des protections sont appliquées à la fois au niveau du prompt et au niveau de l'image, et Sunburst embarque plusieurs couches de protection spécifiques. Les images restent porteuses de métadonnées C2PA et d'un filigrane invisible.

GPT Image 2 - La génération précédente

Le nom officiel : ChatGPT Images 2.0

Sorti le 21 avril 2026, GPT Image 2 a été remplacé par la 2.5 en septembre 2026. Le modèle gpt-image-2 reste accessible en API pour les intégrations existantes, mais il n'est plus recommandé pour un nouveau projet : les modèles 2.5 offrent une meilleure qualité au même tarif, avec une latence bien inférieure.
OpenAI n'a jamais communiqué sur « GPT Image 2 » dans ses annonces grand public. Le nom produit officiel était ChatGPT Images 2.0, le modèle API gpt-image-2.

Les 5 grandes améliorations de ChatGPT Images 2.0

  • Précision et contrôle extrêmes : Le modèle peut désormais suivre des instructions très détaillées avec un placement et des relations entre objets quasi-parfaits. Les points les plus remarquables :
    • Rendu de texte dense, d'éléments UI, d'iconographie et de petites compositions (là où les modèles précédents échouaient régulièrement)
    • Résolution native jusqu'à 2K (3 840 px max, multiples de 16 px)
    • OpenAI cite en exemple un zoom sur des grains de riz avec texte ultra-lisible intégré
  • Capacités « Thinking » (nouveauté majeure) : C'est la vraie rupture de cette version : il s'agit de la première fois qu'un modèle d'image OpenAI intègre un raisonnement explicite. Quand le mode "Thinking" est activé dans ChatGPT, le modèle peut :
    • Effectuer une recherche web en temps réel
    • Générer plusieurs images distinctes à partir d'un même prompt
    • Auto-vérifier ses propres outputs
    • Créer des QR codes fonctionnels directement dans l'image
⚠️
Le mode Thinking est réservé aux abonnements ChatGPT Plus, Pro et Business (Enterprise en cours de déploiement).
  • Support multilingue natif : ChatGPT Images 2.0 génère du texte non-anglais cohérent et visuellement intégré — pas seulement translittéré. OpenAI cite notamment le japonais, le coréen, l'hindi et le bengali. Le modèle rend la génération « plus globalement utile » selon l'entreprise.
  • Sophistication stylistique et photoréalisme
    • La teinte jaune/chaude caractéristique des versions GPT Image 1.x est supprimée — les couleurs sont désormais naturelles
    • Meilleure capture des caractéristiques des photos réelles, plans cinématographiques, pixel art, manga, etc.
    • Cohérence accrue en texture, éclairage, composition et détails fins
    • Très utile pour le prototyping de jeux, storyboarding, marketing et assets créatifs
  • Ratios d'aspect flexibles
    • Support natif de 3:1 (très large) à 1:3 (très vertical)
    • Idéal pour bannières, slides, posters et réseaux sociaux sans recadrage post-génération
    • Bien plus large que les ratios 1:1 / 3:2 de GPT Image 1.5

Disponibilité et accès (au 21 avril 2026)

Canal
Accès
ChatGPT (web, iOS, Android)
✅ Immédiat pour tous les plans, y compris gratuit. Mise à jour de l'app mobile requise.
Mode Thinking
🔒 Réservé à ChatGPT Plus, Pro et Business (Enterprise bientôt)
API OpenAI
✅ Modèle gpt-image-2 disponible dès aujourd'hui (Image API et Responses API)
Codex
✅ Accès immédiat
 

Ce qui change radicalement avec GPT Image 2

D'après les tests Arena et les exemples circulant sur X, Reddit et Instagram :
  • Text rendering quasi-parfait. C'est la percée la plus commentée. GPT Image 1.5 atteignait ~95% de précision typographique, avec encore des erreurs sur les textes denses ou les polices complexes. GPT Image 2 monte à ~99%+ selon les testeurs : texte net, lisible, intégré naturellement dans la scène. Les exemples viraux incluent des captures YouTube parfaitement crédibles (barre latérale, compteurs de vues, thumbnails), des interfaces Windows ou Minecraft avec UI in-game exacte, des cartes géographiques avec ombrage d'altitude et légendes précises.
  • Photoréalisme indiscernable. La fameuse "teinte jaune" qui colorait les générations GPT Image 1.x est supprimé. Des selfies de plage à trois personnes avec mains correctes et reflets de lunettes, des intérieurs de magasins de marque (IKEA, Bath & Body Works), des portraits. Plusieurs testeurs affirment n'avoir pas pu distinguer ces images de vraies photographies à première vue.
  • Architecture entièrement nouvelle. Contrairement à GPT Image 1 et 1.5 (basés sur GPT-4o), GPT Image 2 disposerait d'une architecture indépendante, conçue spécifiquement pour la génération d'images. Le shutdown de Sora (modèle vidéo d'OpenAI, arrêté le 24 mars 2026) aurait libéré les ressources computationnelles nécessaires à ce développement.
  • Format 16:9 natif. Là où GPT Image 1.5 est limité à des ratios 1:1 et 3:2, GPT Image 2 supporte nativement le format 16:9. Un changement important pour les créateurs de contenus vidéo, bannières, et visuels pour écrans larges.
  • World knowledge amélioré. Le modèle "simule" le monde à partir de sa connaissance interne plutôt que de scraper des références.

Réactions de la communauté

L'annonce du 21 Avril a généré plus de 120 000 vues en quelques heures sur le thread officiel OpenAI. Les retours sont unanimement enthousiastes :
  • Enthousiasme massif sur le rendu de texte dense — des menus de restaurants directement utilisables, des interfaces UI indiscernables de vraies captures d'écran
  • Surprise positive sur les QR codes fonctionnels et la recherche web en temps réel
  • Des comparaisons immédiates avec la concurrence (Flux, Midjourney V8, Nano Banana 2) : beaucoup estiment qu'OpenAI reprend la tête sur la précision texte/UI et les usages productifs (mockups, design, marketing)
  • Crainte récurrente du « nerf » futur — classique OpenAI

GPT Image 1.5 - La version précédente

Lancé le 16 décembre 2025 sous le nom « ChatGPT Images », GPT Image 1.5 a été le modèle de référence d'OpenAI pendant quatre mois, jusqu'à l'arrivée de GPT Image 2. Il s'appuyait sur GPT-5.2, le modèle de langage annoncé simultanément, ce qui lui conférait un raisonnement contextuel nettement supérieur à la v1.

Les 4 améliorations clés de GPT Image 1.5

  • Vitesse ×4. Ce qui prenait 30 à 45 secondes ne prend plus que 10 à 15 secondes. Cette accélération est en partie due à l'édition partielle : lors d'une modification, le modèle ne régénère que les zones concernées, pas toute l'image.
  • Édition préservative. L'amélioration la plus significative en pratique. GPT Image 1.5 peut modifier la couleur d'une chemise sans toucher au visage, changer l'arrière-plan sans réinterpréter la composition, ou ajouter un élément sans altérer l'atmosphère. Cette stabilité ouvre des workflows créatifs itératifs impossibles avec la v1.
  • Rendu de texte amélioré. Le taux de précision passe de ~85% à ~95%. Des infographies denses, des maquettes d'interface, des affiches avec titre et sous-titre deviennent exploitables directement, sans retouche manuelle systématique.
  • Prix réduit de 20%. Malgré des performances supérieures, GPT Image 1.5 coûte 20% moins cher que GPT Image 1 via l'API, grâce à l'optimisation computationnelle et à la régénération partielle.

GPT Image 1.5 et la concurrence

dès son lancement, GPT Image 1.5 s'est hissé en tête des classements. En pratique, GPT Image 1.5 excelle sur la fidélité aux instructions, la typographie intégrée et la cohérence des éditions itératives. Des performances qui lui permettent d’être toujours parmi les meilleurs générateurs d’images du moment.

Points forts de GPT Image 1.5

  • Édition chirurgicale avec préservation des visages, logos et éclairage
  • Rendu typographique proche du parfait pour les infographies et mockups
  • Génération 4× plus rapide que la v1
  • 20% moins cher que GPT Image 1 à qualité équivalente
  • Disponible dans ChatGPT (tous plans) et via API

Limites de GPT Image 1.5

  • Légère tendance jaune encore présente
  • Performances moindres sur les très petits détails vs Nano Banana Pro
  • Modèle fermé, hébergement cloud uniquement
 
⚠️ gpt-image-1.5 ferme le 1er décembre 2026. Les intégrations existantes doivent migrer vers gpt-image-2.5-flare.

GPT Image 1 Mini - La version économique

Lancé discrètement lors du DevDay 2025 d'OpenAI (6 octobre), GPT Image 1 Mini est la version allégée de GPT Image 1. OpenAI le décrit comme "un modèle de génération d'images plus petit, 80% moins cher que le modèle principal".
Contrairement à la version standard, le Mini est exclusivement accessible via API — il n'est pas directement intégré dans l'interface de ChatGPT. C'est une brique pour développeurs, pensée pour les projets à volume élevé où la maîtrise des coûts prime sur la perfection visuelle.
⚠️ gpt-image-1-mini ferme le 1er décembre 2026. Il n'a pas de successeur « mini » : le remplacement documenté par OpenAI est gpt-image-2.5-flare, dont le palier low revient à environ 0,006 $ l'image — soit un coût comparable au Mini, pour une qualité nettement supérieure.

Quand choisir GPT Image 1 Mini ?

Le Mini est le bon choix quand vous générez des dizaines ou centaines d'images par jour dans des pipelines automatisés : création de contenus pour les réseaux sociaux à grande échelle, génération de visuels e-commerce, prototypage rapide de concepts. La qualité est suffisante pour des usages de production courants, tout en divisant par 4 à 5 le coût par image par rapport au modèle standard.
En revanche, pour des visuels destinés à des supports premium (campagnes publicitaires, couvertures, packagings), GPT Image 1.5 reste préférable.

Tarifs GPT Image 1 Mini (API)

Qualité
Prix estimé / image 1024×1024
Low
~0,005 $
Medium
~0,011 $
High
~0,052 $

GPT Image 1 - Le modèle fondateur

Lancé en avril 2025, GPT Image 1 a été la première bombe de la famille. En une semaine de déploiement dans ChatGPT, plus de 700 millions d'images avaient été générées par 130 millions d'utilisateurs. Sam Altman lui-même avait tweété que les GPU "fondaient" sous la charge.

Ce qui l'a distingué à sa sortie

GPT Image 1 représentait une rupture par rapport à DALL·E 3 sur plusieurs points précis. Sa capacité à suivre des instructions complexes et longues était sans précédent : il pouvait gérer des prompts décrivant dix objets distincts avec des contraintes de couleur, de position et de style, là où DALL·E 3 perdait des éléments en route. Il maîtrisait également l'intégration de texte lisible dans les images (affiches, logos, pancartes) une tâche qui faisait auparavant défaut à la quasi-totalité des générateurs.
Son autre innovation majeure : le support natif de l'édition par masque (inpainting) et de la génération image-vers-image directement via l'API, sans avoir à recourir à des outils tiers.

Points forts de GPT Image 1

  • Suivi d'instructions complexes
  • Texte lisible intégré dans les images
  • Édition et inpainting nativement supportés
  • Large palette stylistique
  • Sécurité intégrée et métadonnées C2PA
⚠️ gpt-image-1 ferme le 23 octobre 2026, première fermeture de la série.

Limites de GPT Image 1

  • Tendance jaune/chaude prononcée dans les tons
  • Édition parfois trop agressive (régénère toute la scène plutôt que la zone modifiée)
  • Fermé le 23 octobre 2026, il est supplanté sur tous les critères par GPT Image 2.5

Combien coûte GPT Image ?

La tarification de GPT Image est basée sur les tokens — texte en entrée, image en entrée, image en sortie. Bonne nouvelle pour la 2.5 : les tarifs au token n'ont pas bougé par rapport à GPT Image 2.

Tarifs au token (API OpenAI)

Poste
Prix par million de tokens
Tokens texte en entrée
5,00 $ (1,25 $ en cache)
Tokens image en entrée
8,00 $ (2,00 $ en cache)
Tokens image en sortie
30,00 $
Les tokens image en sortie représentent l'essentiel de la facture. Leur nombre dépend du couple qualité × taille, la qualité pesant beaucoup plus lourd que la taille.

Coût par image générée (1024×1024)

Palier de qualité
GPT Image 2.5 (Flare et Sunburst)
GPT Image 2
low
~0,006 $
~0,006 $
medium
~0,013 $
~0,053 $
high
~0,053 $
~0,211 $
xhigh
~0,094 $
non disponible
max
~0,211 $
non disponible
Coûts calculés à partir des tokens de sortie mesurés en septembre 2026 sur des générations 1024×1024. Flare et Sunburst consomment le même nombre de tokens à palier égal — seule la latence diffère. Les tokens texte du prompt sont facturés en plus.
Lecture du tableau : à palier nominal identique, la 2.5 paraît quatre fois moins chère. C'est en partie un effet d'échelle — le high de la 2.5 correspond au medium de la v2. Mais le gain est réel, puisque la qualité produite à budget égal est supérieure.

Quelle qualité choisir ?

  • Low : prototypage, tests de prompts, génération en masse de brouillons
  • Medium : le meilleur rapport qualité/prix pour la plupart des usages professionnels courants
  • High : visuels destinés à la publication, texte lisible, textures fines
  • Xhigh : mises en page où les petits caractères doivent rester lisibles — infographies denses, étiquettes, packagings
  • Max : rendus finaux premium, impression, campagnes ; comptez jusqu'à deux minutes par image sur Sunburst

Et en 2K / 4K ?

OpenAI ne publie pas de grille par image au-delà du 1K : la facturation reste au token, donc le coût augmente approximativement avec le nombre de pixels. Un 2048×2048 consomme environ quatre fois plus qu'un 1024×1024 à qualité égale. La seule source fiable reste le champ usage.output_tokens renvoyé par l'API : mesurez sur vos propres prompts avant de dimensionner un budget.

Estimation mensuelle selon l'usage

Scénario
Volume
Modèle / Qualité
Coût mensuel estimé
Social media manager
100 images/mois
Flare Medium
~1,30 $
Agence créative
1 000 images/mois
Flare High
~53 $
Plateforme e-commerce
10 000 images/mois
Flare Medium
~130 $
Studio premium
500 images/mois
Sunburst Max
~105 $
Estimations en 1024×1024, hors tokens texte et hors images de référence. Les requêtes d'édition coûtent sensiblement plus cher en entrée : chaque image de référence en 1024×1024 ajoute environ 0,008 $, et le cumul est linéaire — seize références représentent à elles seules l'équivalent d'une génération en qualité max.

GPT Image vs la concurrence

Critère
GPT Image 2.5
Midjourney v7
Nano Banana 2
Qwen Image
Qualité visuelle
⭐⭐⭐⭐⭐
⭐⭐⭐⭐⭐
⭐⭐⭐⭐⭐
⭐⭐⭐⭐
Suivi des instructions
⭐⭐⭐⭐⭐
⭐⭐⭐⭐
⭐⭐⭐⭐⭐
⭐⭐⭐⭐
Texte dans l'image
⭐⭐⭐⭐⭐
⭐⭐⭐
⭐⭐⭐⭐½
⭐⭐⭐
Édition d'images
⭐⭐⭐⭐⭐
⭐⭐⭐½
⭐⭐⭐⭐½
⭐⭐⭐⭐
Cohérence multi-tours
⭐⭐⭐⭐⭐
⭐⭐
⭐⭐⭐⭐
⭐⭐⭐
Vitesse
⭐⭐⭐⭐ (Flare)
⭐⭐⭐
⭐⭐⭐⭐
⭐⭐⭐⭐⭐ (local)
Prix
💰 (ChatGPT)
💰💰💰 (abonnement)
💰 (Gemini)
💰 (open source)
Accès API
✅ Oui
❌ Non
✅ Oui
✅ Oui (open)
Usage commercial
✅
✅ (selon plan)
✅
✅
Hébergement local
❌ Non
❌ Non
❌ Non
✅ Oui
Quand choisir GPT Image ? Pour les projets qui demandent un suivi précis des instructions, de l'édition itérative, du texte lisible intégré ou une intégration API dans une application. La 2.5 a renforcé ce positionnement sur deux points précis : la préservation d'un sujet issu d'une photo de référence, et la stabilité d'une image retouchée dix fois d'affilée. C'est le meilleur choix pour les workflows marketing et e-commerce automatisés.
Quand choisir Midjourney ? Pour les créations artistiques où l'esthétique prime sur le respect exact des consignes. Midjourney produit des rendus visuellement saisissants mais moins prévisibles.
Quand choisir Nano Banana ? Pour le photoréalisme maximal et la génération de portraits ou de scènes naturelles où la texture et le détail priment.
Quand choisir Qwen ? Pour les projets nécessitant un hébergement local, une personnalisation poussée via LoRA, ou un contrôle total sur les données sans passer par le cloud.

Qui est derrière GPT Image ?

GPT Image est développé par OpenAI, la société californienne fondée en 2015 qui a popularisé ChatGPT et la famille de modèles GPT. Les modèles d'image s'appuient sur les avancées des modèles de langage maison, dont la génération GPT-6, qui apporte des capacités de raisonnement et de compréhension du monde nettement supérieures. Dans l'API, c'est le modèle de langage principal qui pilote l'outil de génération d'images et reformule le prompt avant de le transmettre au moteur visuel.
notion image
notion image
Les dernières versions de GPT Image ont été déployées dans un contexte de concurrence intense avec Google. GPT Image 2 était une réponse directe au succès de [Nano Banana 2](lien existant), le générateur d'images intégré à Gemini, qui avait pris une avance notable sur le marché. Sam Altman avait déclaré un « code red » interne en novembre 2025 après la domination des modèles Google sur plusieurs classements, en texte comme en image. Depuis, les deux entreprises se répondent à un rythme soutenu. La 2.5, sortie moins de cinq mois après la 2, illustre ce tempo : OpenAI n'attend plus un an entre deux générations d'image.
 
Fidji Simo, CEO des applications chez OpenAI, a piloté l'intégration du GPT-Image dans ChatGPT avec une nouvelle interface dédiée à la création visuelle en Novembre 2025. Cette approche reflète la vision d'OpenAI de transformer ChatGPT d'un simple assistant textuel en une plateforme créative multimodale complète. Les fonctionnalités ajoutées avec la 2.5, Sketch, templates, commentaires sur l'image, partage de prompt, prolongent cette logique : faire de ChatGPT un espace de création à part entière plutôt qu'une simple boîte à prompts.

FAQ GPT Image

GPT Image est-il gratuit ?
GPT Image est accessible gratuitement dans ChatGPT, avec des limitations sur le nombre de générations quotidiennes. ChatGPT Images 2.5 est déployé sur tous les plans, y compris gratuit, ainsi que dans ChatGPT Work et Codex. Pour un usage via API, c'est payant : les tarifs de gpt-image-2.5-flare et gpt-image-2.5-sunburst vont d'environ 0,006 $ l'image en qualité low à environ 0,211 $ en qualité max, pour du 1024×1024. Les nouveaux comptes développeur OpenAI reçoivent des crédits gratuits pour démarrer.
Quelle est la différence entre GPT Image 1 et GPT Image 1.5 ?
GPT Image 1.5 est plus rapide (×4), moins cher de 20%, dispose d'une meilleure édition préservative (modification ciblée sans régénérer toute l'image) et d'un meilleur rendu typographique. Pour un usage courant, GPT Image 1.5 est dans tous les cas la meilleure option.
Quelle est la différence entre GPT Image 1 et GPT Image 1 Mini ?
GPT Image 1 Mini offre des performances légèrement inférieures sur les détails fins, mais coûte environ 80% moins cher. Il est accessible uniquement via API et recommandé pour la génération en volume où le budget est prioritaire.
GPT Image 2 est-il disponible ?
Oui, depuis le 8 septembre 2026. OpenAI a lancé ChatGPT Images 2.5, accessible immédiatement à tous les utilisateurs de ChatGPT, ChatGPT Work et Codex, sur ordinateur, mobile et web. Côté API, deux modèles sont proposés : gpt-image-2.5-flare, rapide et recommandé par défaut, et gpt-image-2.5-sunburst, plus lent mais plus précis sur l'édition. Les deux sont au même tarif.
Puis-je utiliser les images GPT Image commercialement ?
Oui. OpenAI accorde les droits d'usage commercial sur toutes les images générées, pour tous les plans (y compris gratuit), sous réserve de respect des conditions d'utilisation. Pas d'obligation légale de mentionner l'origine IA, bien que ce soit recommandé dans les contextes sensibles.
GPT Image génère-t-il des images avec un filigrane ?
Pas de filigrane visible. En revanche, les images intègrent automatiquement des métadonnées C2PA et, depuis la 2.5, un filigrane invisible, permettant à des outils compatibles de détecter qu'une image provient d'un générateur IA.
Comment accéder à GPT Image via l'API ?
Via l'endpoint /v1/images/generations pour la génération, /v1/images/edits pour l'édition, ou l'outil image_generation de la Responses API pour une expérience conversationnelle. Les identifiants disponibles sont gpt-image-2.5-flare et gpt-image-2.5-sunburst (recommandés), ainsi que gpt-image-2. Une vérification d'organisation est requise dans la console développeur OpenAI. Les fournisseurs alternatifs comme Fal.ai et Replicate proposent généralement les mêmes modèles sans vérification.
GPT Image peut-il modifier une photo existante ?
Oui, et c'est devenu son principal point fort. GPT Image 2.5 supporte l'édition image-vers-image en langage naturel : changement de style, d'éléments, d'arrière-plan, de vêtements, d'éclairage. Deux progrès notables sur cette version : le modèle ne modifie que ce que vous avez demandé et laisse le reste intact, et il tient la distance sur une longue série de retouches successives sans que l'image se dégrade. Vous pouvez aussi fournir jusqu'à 16 images de référence, ou un masque pour cibler une zone précise.
Quelle résolution maximale peut générer GPT Image ?
GPT Image 2.5 génère jusqu'à 3 840 × 2 160 px, soit de la 4K. Les dimensions sont libres à trois conditions : les deux côtés doivent être des multiples de 16 px, le ratio doit rester entre 1:3 et 3:1, et le bord le plus long ne doit pas dépasser 3 840 px. Au-delà de 2560×1440, OpenAI considère la sortie comme expérimentale. À noter : dans l'interface ChatGPT, la résolution par défaut est bien plus basse — un passage par un outil d'upscaling comme Magnific ou Topaz reste utile pour un usage en impression.
GPT Image respecte-t-il les droits d'auteur des artistes ?
GPT Image inclut des garde-fous qui limitent l'imitation directe du style d'artistes contemporains identifiés. Pour les références culturelles générales (styles artistiques, mouvements, époques), le modèle s'en inspire librement sans reproduire les œuvres d'origine.
Les anciens modèles GPT Image vont-ils disparaître ?
Oui. gpt-image-1 ferme le 23 octobre 2026 ; gpt-image-1.5, gpt-image-1-mini et chatgpt-image-latest ferment le 1er décembre 2026. DALL·E 2 et DALL·E 3 sont déjà fermés depuis le 12 mai 2026. Dans tous les cas, le remplacement recommandé est gpt-image-2.5-flare.
 

Articles et Tutoriel GPT Image