HiDream est une famille de modèles open-source de génération et d'édition d'images développée par HiDream.ai. Lancée en avril 2025 avec HiDream-I1, la famille s'est récemment enrichie avec HiDream-O1-Image (mai 2026), un modèle 8B au design radicalement nouveau qui se hisse directement parmi les meilleurs modèles open-source du marché.

Tous les modèles HiDream sont distribués sous licence MIT, ce qui les rend particulièrement attractifs pour un usage personnel comme commercial.

<a 
  href="<https://huggingface.co/spaces/HiDream-ai/HiDream-O1-Image>"
  class="w-full link !text-primary-500 !opacity-100 !border-primary-500 hover:!opacity-80 feather-button-link inline-flex items-center justify-center bg-primary-500 text-base font-semibold !text-primary-50 rounded-cta-button-radius px-2 py-4 hover:bg-primary-600 hover:text-secondary-100 focus:outline-none focus:outline-2 focus:outline-offset-2 focus:outline-primary-500 active:bg-primary-800 active:text-blue-100"
  data-umami-event="Clicked Link: huggingface.co/spaces/HiDream-ai/HiDream-O1-Image"
  data-umami-href="huggingface.co/spaces/HiDream-ai/HiDream-O1-Image"
  style="font-size: 120%"
  target="_blank"
>
	→ Essayer HiDream-O1
</a>

hidream-image.jpeg

<div style="text-align: right; font-size: 75%; margin-top: -10px; margin-right: 1ex" class="text-secondary-600 text-right small"><em>
Dernière mise à jour : 10/05/2026
</em></div>

<aside> ⭐

HiDream AI

</aside>

<aside> 🗞️

L’Actualités HiDream

image.png

HiDream secoue l’Open Source

09/05/2026 - HiDream AI est de retour avec un nouveau modèle à l’architecture originale.

→ En savoir plus

image.png

HiDream-E1 pour l'édition d'images

24/06/25 - HiDream sort son modèle d’édition d’image comparable à Flux Kontext

→ En savoir plus

image.png

Intégration native dans ComfyUI

22/04/25 - HiDream-I2 est désormais supporté nativement dans les nodes ComfyUI.

→ En savoir plus

</aside>

Qu'est-ce que HiDream ?

HiDream est une famille de modèles open-source de génération et d'édition d'images conçus pour offrir une alternative crédible aux générateurs propriétaires haut de gamme. Ce qui distingue les modèles HiDream, c'est leur capacité à interpréter avec finesse les nuances d'un prompt, à respecter rigoureusement les consignes complexes et à intégrer du texte lisible dans les images, là où beaucoup de modèles open-source peinent encore.

La famille se structure aujourd'hui autour de trois générations de modèles. HiDream-I1 (avril 2025) reste la référence historique pour la génération texte-vers-image, avec une architecture sparse Diffusion Transformer de 17 milliards de paramètres. HiDream-E1 (avril 2025) prolonge cette base pour l'édition d'images par instruction. Et plus récemment, HiDream-O1-Image (mai 2026) marque une rupture architecturale majeure : ce modèle unifié de 8B paramètres abandonne le VAE pour travailler directement sur les pixels, et regroupe en un seul modèle ce qui demandait auparavant deux modèles distincts (génération + édition).

Cette nouvelle génération O1 est aujourd'hui le modèle recommandé par défaut. Plus polyvalent, plus moderne dans son architecture et plus performant sur les benchmarks récents, il représente l'état de l'art de HiDream.ai.

Qui est derrière HiDream ?

Les modèles HiDream sont développés par HiDream.ai, une équipe spécialisée dans les modèles génératifs visuels à haute fidélité, basée en Chine. La structure du projet est résolument open-source, avec une publication complète du code, des poids et de la documentation sur GitHub et Hugging Face.

Les modèles sont en général d'abord exposés via la plateforme Vivago.ai, fruit de la même équipe, qui sert de vitrine officielle pour les démonstrations en ligne. Cette approche permet de tester et d'affiner les modèles en conditions réelles avant leur publication open-source.

Avec O1, HiDream.ai s'impose comme l'un des acteurs les plus innovants de la génération d'images open-source. Là où ses concurrents directs (FLUX.2, Qwen-Image, Z-Image) misent sur des architectures éprouvées, HiDream choisit l'innovation architecturale assumée. Un pari qui semble payant au vu des premiers résultats.

Comment utiliser HiDream ?

HiDream-I1 en ligne

Le moyen le plus simple de tester HiDream-O1 sans rien installer est de passer par le Hugging Face Space officiel : HiDream-O1-Image pour la version Full, ou HiDream-O1-Image-Dev pour la version distillée plus rapide. L'interface est minimaliste (un champ de prompt, quelques options) mais suffit pour se faire une idée des capacités du modèle.

Le modèle étant tout récent (open-sourcé le 8 mai 2026), les intégrations sur les plateformes tierces habituelles (fal.ai, Replicate, Vivago, getimg, ImagineArt, etc.) ne sont pas encore disponibles au moment où nous écrivons ces lignes, mais devraient arriver rapidement vu le rythme habituel d'adoption des nouveaux modèles open-source. Cette page sera mise à jour à mesure que les intégrations se déploient.

Les versions précédentes restent accessibles via leurs propres Spaces (HiDream-I1-Dev, HiDream-E1-Full) et sur Vivago.ai, la plateforme officielle de HiDream.ai.

→ voir la liste des générateurs HiDream en ligne

image.png

HiDream en local

Tous les modèles HiDream peuvent être téléchargés et utilisés en local, sans abonnement ni clé API. Le GitHub officiel de HiDream-O1 fournit les scripts d'inférence Python et les instructions complètes.

Côté configuration, HiDream-O1 demande un GPU avec au moins 24 Go de VRAM pour la version Full en 2048×2048, ou environ 16 Go pour la version Dev en résolution réduite. Comme pour HiDream-I1, l'usage de Flash Attention 2 (CUDA 12.4+) est fortement recommandé pour obtenir les performances optimales. Sans flash-attn, il faut désactiver explicitement l'option dans le code.

Configuration recommandée : GPU ≥ 24 Go VRAM pour HiDream-O1-Image Full en 2048×2048. La version Dev distillée (28 steps) tourne confortablement sur 16 Go. Des versions quantizées 4-bit sont en cours de publication par la communauté.

image.png

HiDream-O1-Image est désormais intégré nativement dans ComfyUI qui dispose des nodes nécessaires à la génération et l’édition d’images avec HiDream.

→ Tutoriel ComfyUI pour l’utilisation des workflows Hidream-O1

Prompter avec HiDream

iDream-O1 introduit une approche originale du prompting via son Reasoning-Driven Prompt Agent. Avant la génération proprement dite, un modèle de raisonnement (basé sur Gemma 4 ou n'importe quelle API compatible OpenAI) analyse votre prompt, réfléchit à la composition, aux attributs visuels, à la logique physique de la scène, puis le réécrit sous forme d'instruction structurée et auto-suffisante en anglais.

En pratique, vous pouvez écrire vos prompts en langage naturel, en français, en chinois ou dans un style très synthétique : l'agent se charge de l'optimisation. Cela explique en partie les très bons scores du modèle sur les benchmarks de suivi de prompt, et c'est particulièrement utile pour les compositions complexes ou multilingues.

Pour HiDream-I1 et E1, le prompting reste plus classique : prompts détaillés et narratifs en français ou en anglais, avec une bonne tolérance aux descriptions complexes grâce à l'usage combiné de trois encodeurs de texte (T5-XXL, CLIP ViT-L et LLaMA 3.1).