Definición

Definición —¿Qué es Open Generative AI?

Open Generative AI es una plataforma gratuita y de código abierto para generar imágenes y videos con IA que combina más de 420 modelos en 14 estudios pensados para una tarea concreta. A diferencia de plataformas cerradas como Midjourney o Runway, no aplica filtros de contenido, no cobra suscripción y puede autohospedarse bajo la licencia MIT para una privacidad total de los datos.

Qué hace

Lo que la plataforma hace de verdad

Los 14 estudios no son 14 apps separadas: son un único catálogo de modelos dividido en espacios de trabajo pensados para una tarea, de modo que los modelos correctos ya están conectados cuando abres uno. Agrupado por tarea, así es en la práctica.

Imágenes e imágenes fijas cinematográficas

Image Studio alterna automáticamente entre texto a imagen (más de 50 modelos) e imagen a imagen (más de 55 modelos). Cinema Studio añade controles de cámara, lente, distancia focal y apertura para tomas fotorrealistas.

Video y movimiento

Video Studio ejecuta texto a video (más de 40 modelos) e imagen a video (más de 60 modelos) sobre una misma línea de tiempo, de modo que una imagen generada se convierte en el fotograma inicial de un clip. Vibe Motion Studio y AI Clipping se encargan de los efectos estilizados y de la extracción de momentos destacados.

Voz, lip sync y audio

Lip Sync Studio maneja 9 modelos dedicados en dos modos: anima un retrato desde el audio o vuelve a sincronizar un video existente. Audio Studio genera y edita música y sonido; Body Swap (Recast) Studio se encarga de los recast de apariencia.

Automatización y producción

Workflow Studio encadena modelos en un pipeline repetible basado en nodos que puedes ejecutar sin supervisión. Agent Studio, Design Agent Studio, Marketing Studio y Explore Apps construyen sobre el mismo catálogo para el trabajo de producción conversacional y por lotes.

Catálogo de modelos

Las 8 categorías de modelos

Cada estudio tira del mismo catálogo subyacente. Esto es lo que define en la práctica una pila de modelos abierta de este tipo: una única biblioteca abierta de modelos, organizada por tarea en lugar de encerrada tras un único proveedor.

70+

Texto a Imagen

Flux Dev, Nano Banana 2, Seedream 5.0, Ideogram v3, SDXL y más.

Ver los modelos
70+

Imagen a Imagen

Nano Banana 2 Edit, Flux Kontext Pro, Seededit v3, mejoradores de resolución.

Ver los modelos
85+

Texto a Video

Kling v3, Sora 2, Veo 3, Wan 2.6, Seedance 2.0 y más.

Ver los modelos
120+

Imagen a Video

Kling v2.1 I2V, Veo3 I2V, Hunyuan I2V, Wan 2.2 I2V.

Ver los modelos
35+

Video a Video

Efectos de video, AI Clipping, Vibe Motion y ediciones condicionadas por video.

15

Sincronización de labios

Infinite Talk, Wan 2.2 Speech to Video, LatentSync, Creatify.

Ver los modelos
3

Body Swap / Recast

Recast de sujeto y de apariencia en imagen y video.

15+

Audio

Modelos de texto a música, remix y edición de audio.

Ver los modelos
Cerrado frente a abierto

En qué se diferencia de las plataformas cerradas

El rasgo definitorio de este enfoque es lo que elimina, no lo que añade: sin muro de pago entre tú y el modelo, sin filtros que decidan qué prompts se permiten y una licencia que te permite leer y modificar el código.

CapacidadOtros proveedoresMidjourney · Runway · KlingEsta plataformagratis y de código abierto
CostePor suscripciónGratis (código abierto)
Filtros de contenidoSí: bloquean o alteran los promptsNinguno
ModelosPropietarios, una sola familiaMás de 420 modelos abiertos y comerciales
AutohospedajeNo
Código fuenteCerradoCon licencia MIT

Desliza para ver la columna de comparación

Lee el desglose completo frente a Midjourney o Runway.

Autohospedaje y licencia

Autohospedaje e inferencia local

Este proyecto se distribuye bajo la licencia MIT — la licencia de código abierto más permisiva, lo que significa que cualquiera puede leerla, modificarla y redistribuirla. La app de escritorio va más allá con dos motores de inferencia local, de modo que la generación puede ejecutarse sin salir de tu máquina.

sd.cpp — motor integrado

Un motor en C++ (de stable-diffusion.cpp) que se ejecuta en la misma máquina que la app: GPU Metal en Apple Silicon, CUDA/Vulkan/ROCm en Linux y Windows. Gestiona solo los modelos de imagen: Z-Image Turbo, Z-Image Base, Dreamshaper 8, Realistic Vision, SDXL.

z-image-turbosdxl-basesd-1.5

Wan2GP — trae tu propio servidor GPU

Un cliente HTTP para un servidor Wan2GP autoadministrado en una GPU CUDA o ROCm: un PC gaming, una caja GPU alquilada o una máquina Linux en la LAN. Gestiona los modelos de imagen más grandes y todos los modelos de video: Flux.1 Dev, Qwen Image, Wan 2.2, Hunyuan Video, LTX Video.

wan-2.2hunyuan-videoltx-video

La inferencia local solo está disponible en la app de escritorio: la versión web alojada siempre usa las API en la nube.

FAQ

Preguntas frecuentes, respondidas

La IA generativa abierta describe herramientas de imagen, video y audio con IA que son gratuitas de usar, libres de filtros de contenido y lo bastante abiertas para autohospedarse o modificarse. Este proyecto es un ejemplo real: más de 420 modelos en 14 estudios, con licencia MIT y sin suscripción.

Pruébalo gratis — Ahora mismo

Más de 420 modelos, 14 estudios, sin suscripción. No hace falta cuenta para probarlo.

Generar gratis
Las imágenes y los videos de Open Generative AI se generan con IA. Revisa los resultados antes de usarlos para cualquier propósito que requiera precisión o autenticidad.