Un nouveau modèle d'image anonyme est apparu sur Arena le 19 août. C'est le deuxième en dix jours, et tous les indices pointent vers OpenAI. Rien d'officiel pour l'instant, mais on connaît la chanson…

<aside> 📰

Mise à jour du 21 août : Un troisième checkpoint, lina-alpha, est apparu sur Arena dans la nuit. Le nom perd le lisa des deux précédents, mais garde le suffixe -alpha typique des tests OpenAI. Trois modèles en douze jours : c'est un rythme qu'on n'avait plus vu depuis les tape d'avril, deux semaines avant l'annonce de GPT-Image 2.

</aside>

Luna-lisa-alpha

Deux noms de code en 10 jours

Le 9 août, un modèle baptisé mona-lisa-1 débarque dans les duels d'images de LM Arena. Dix jours plus tard, luna-lisa-alpha prend le relais. Même famille, nouveau checkpoint.

OpenAI n'a rien annoncé, mais les indices s'accumulent : les images générées portent la signature de provenance maison, et le modèle s'identifie parfois lui-même comme un GPT.

Le suffixe « -alpha » est aussi exactement celui des trois modèles « tape » (packingtape-alpha et ses cousins) qui avaient tourné sur Arena deux semaines avant la sortie de GPT-Image 2 en avril. La méthode est rodée : OpenAI teste ses modèles à l'aveugle avant de les annoncer, comme il l'avait fait aussi avec Chestnut et Hazelnut juste avant la sortie de GPT-Image 1.5.

Et les retours sur luna-lisa-alpha sont nettement plus enthousiastes que sur son prédécesseur. Le grain qui parasitait les petits détails a quasiment disparu, la cohérence des personnages fait un vrai bond d'une génération à l'autre, et le rendu de texte reste au niveau qu'on connaît. Quelques artefacts subsistent tout de même, notamment sur les feuillages et les nuages.

https://x.com/mirochill/status/2090181179978944551

https://x.com/pankajkumar_dev/status/2090401473675014654

Pourquoi OpenAI se dépêche ?

GPT-Image 2 est sorti le 21 avril. Quatre mois plus tard, OpenAI teste déjà son successeur, alors même qu'il est toujours premier au classement.

Sauf que son avance fond à vue d'œil. Dans notre classement des générateurs d'images, elle était de 221 points en mai, de 119 en juillet, et de seulement 71 la semaine dernière. L’avance a donc été divisée par trois en trois mois.

Et le mois d'août a été particulièrement rude :

C'est probablement ce dernier point qui pique le plus. Tant qu'OpenAI maintenait un écart de qualité conséquent, son tarif se défendait. Mais payer jusqu’à quatre fois plus cher pour 5 % de qualité supplémentaire, l'arbitrage devient beaucoup moins évident. Rester premier ne suffit plus.

https://x.com/mirochill/status/2090181179978944551/photo/2

https://x.com/mirochill/status/2090181179978944551/photo/2

image.png

Un 2.5 ou carrément un 3 ?

À quoi s'attendre, du coup ? Probablement pas à une révolution. Le consensus des testeurs penche pour une itération de la même lignée technique, un GPT-Image 2.5 plutôt qu'un GPT-Image 3.

Les améliorations semblent toujours se concentrer sur le photoréalisme, et en particulier sur ce le fameux rendu « plastique » de la peau, l'un des derniers signes qui trahissent encore et toujours une image générée. Si le gain se confirme, ce sera une excellente nouvelle pour le portrait et la photo produit. Sur le texte et l'infographie, GPT-Image 2 était déjà largement en tête et son successeur devrait donc le rester.