Définition

Définition —Qu'est-ce qu'Open Generative AI ?

Open Generative AI est une plateforme gratuite et open source pour générer des images et des vidéos IA, combinant 420+ modèles répartis sur 14 studios spécialisés. Contrairement aux plateformes fermées comme Midjourney ou Runway, elle n'applique aucun filtre de contenu, ne facture aucun abonnement et peut être auto-hébergée sous licence MIT pour une confidentialité totale des données.

Ce qu'elle fait

Ce que la plateforme fait réellement

Les 14 studios ne sont pas 14 applications séparées — c'est un catalogue de modèles partagé découpé en espaces de travail spécialisés, de sorte que les bons modèles sont déjà connectés quand vous en ouvrez un. Regroupés par tâche, voici ce que cela donne en pratique.

Images et plans cinématographiques

Le Studio Image bascule automatiquement entre le texte-vers-image (50+ modèles) et l'image-vers-image (55+ modèles). Le Studio Cinéma ajoute des contrôles de caméra, d'objectif, de focale et d'ouverture pour des plans photoréalistes.

Vidéo et mouvement

Le Studio Vidéo exécute le texte-vers-vidéo (40+ modèles) et l'image-vers-vidéo (60+ modèles) sur une seule timeline, de sorte qu'une image fixe générée devient la première image d'un clip. Le Studio Vibe Motion et AI Clipping gèrent les effets stylisés et l'extraction des moments forts.

Voix, synchronisation labiale et audio

Le Studio Lip Sync pilote 9 modèles dédiés sur deux modes — animer un portrait à partir de l'audio, ou resynchroniser une vidéo existante. Le Studio Audio génère et édite musique et sons ; le Studio Body Swap (Recast) gère les recasts d'apparence.

Automatisation et production

Le Studio Workflow enchaîne les modèles dans un pipeline reproductible basé sur des nœuds que vous pouvez exécuter sans surveillance. Les studios Agent, Design Agent, Marketing et Explore Apps s'appuient sur le même catalogue pour les travaux de production conversationnels et par lots.

Catalogue de modèles

Les 8 catégories de modèles qu'il contient

Chaque studio puise dans le même catalogue sous-jacent. C'est ce qui définit ce type de pile de modèles ouverte en pratique — une bibliothèque ouverte de modèles, organisée par tâche plutôt que verrouillée derrière un fournisseur unique.

70+

Text-to-Image

Flux Dev, Nano Banana 2, Seedream 5.0, Ideogram v3, SDXL et plus encore.

Voir les modèles
70+

Image-to-Image

Nano Banana 2 Edit, Flux Kontext Pro, Seededit v3, suréchantillonneurs.

Voir les modèles
85+

Text-to-Video

Kling v3, Sora 2, Veo 3, Wan 2.6, Seedance 2.0 et plus encore.

Voir les modèles
120+

Image-to-Video

Kling v2.1 I2V, Veo3 I2V, Hunyuan I2V, Wan 2.2 I2V.

Voir les modèles
35+

Video-to-Video

Effets vidéo, AI Clipping, Vibe Motion, éditions conditionnées par vidéo.

15

Lip Sync

Infinite Talk, Wan 2.2 Speech to Video, LatentSync, Creatify.

Voir les modèles
3

Body Swap / Recast

Recast du sujet et de l'apparence en image et en vidéo.

15+

Audio

Modèles de texte-vers-musique, de remix et d'édition audio.

Voir les modèles
Fermé contre ouvert

En quoi elle diffère des plateformes fermées

Le trait définissant de cette approche est ce qu'elle retire, pas ce qu'elle ajoute : pas de paywall entre vous et le modèle, pas de filtre décidant quels prompts sont autorisés, et une licence qui vous permet de lire et de modifier le code.

CapacitéAutres fournisseursMidjourney · Runway · KlingCette plateformegratuit et open source
CoûtPar abonnementGratuit (open source)
Filtres de contenuOui — prompts bloqués ou altérésAucun
ModèlesPropriétaires, famille unique420+ modèles ouverts et commerciaux
Auto-hébergementNonOui
Code sourceFerméSous licence MIT

Faites glisser pour voir la colonne de comparaison

Lisez la comparaison complète contre Midjourney ou Runway.

Auto-hébergement et licences

Auto-hébergement et inférence locale

Ce projet est publié sous la licence MIT — la licence open source la plus permissive, ce qui signifie que n'importe qui peut la lire, la modifier et la redistribuer. L'application de bureau va plus loin avec deux moteurs d'inférence locale, de sorte que la génération peut s'exécuter sans quitter votre machine.

sd.cpp — moteur intégré

Un moteur C++ (issu de stable-diffusion.cpp) qui s'exécute sur la même machine que l'application — GPU Metal sur Apple Silicon, CUDA/Vulkan/ROCm sur Linux et Windows. Gère les modèles image uniquement : Z-Image Turbo, Z-Image Base, Dreamshaper 8, Realistic Vision, SDXL.

z-image-turbosdxl-basesd-1.5

Wan2GP — apportez votre propre serveur GPU

Un client HTTP vers un serveur Wan2GP auto-géré sur un GPU CUDA ou ROCm — un PC gamer, un boîtier GPU loué, ou une machine Linux sur le LAN. Gère les modèles d'images plus volumineux et tous les modèles vidéo : Flux.1 Dev, Qwen Image, Wan 2.2, Hunyuan Video, LTX Video.

wan-2.2hunyuan-videoltx-video

L'inférence locale est disponible uniquement dans l'application de bureau — la version web hébergée utilise toujours les API cloud.

FAQ

Questions fréquentes, réponses claires

L'IA générative ouverte désigne des outils IA d'images, de vidéos et d'audio gratuits à utiliser, exempts de filtres de contenu, et suffisamment ouverts pour être auto-hébergés ou modifiés. Ce projet en est un exemple concret : 420+ modèles répartis sur 14 studios, sous licence MIT, sans abonnement.

Essayez-le gratuitement — dès maintenant

420+ modèles, 14 studios, sans abonnement. Aucun compte requis pour essayer.

Générer gratuitement
Les images et vidéos Open Generative AI sont générées par IA. Vérifiez les résultats avant de les utiliser à des fins exigeant exactitude ou authenticité.