定義

定義 —Open Generative AIとは?

Open Generative AIは、AI画像と動画を生成するための無料・オープンソースのプラットフォームで、14の専門スタジオにわたって420以上のモデルを組み合わせています。MidjourneyやRunwayのようなクローズドなプラットフォームとは異なり、コンテンツフィルターを適用せず、サブスクリプションも不要で、完全なデータプライバシーのためにMITライセンスのもとでセルフホストできます。

できること

この プラットフォーム が実際にやること

14のスタジオは14の別々のアプリではありません — 共有された1つのモデルカタログを目的別のワークスペースに分けたもので、開いた時点で適切なモデルがすでに接続されています。タスク別に分類すると、実際には次のようになります。

画像 & シネマティックな静止画

画像スタジオはtext-to-image(50以上のモデル)とimage-to-image(55以上のモデル)を自動的に切り替えます。シネマスタジオはフォトリアルな撮影のためのカメラ、レンズ、焦点距離、絞りコントロールを追加します。

動画 & モーション

動画スタジオは1つのタイムラインでtext-to-video(40以上のモデル)とimage-to-video(60以上のモデル)を実行するため、生成した静止画がクリップの冒頭フレームになります。Vibe MotionスタジオとAIクリッピングは、スタイライズエフェクトとハイライト抽出を担当します。

音声、リップシンク & オーディオ

リップシンクスタジオは2つのモードで9つの専用モデルを駆動します — 音声からポートレートをアニメーション化するか、既存の動画を再同期するか。音声スタジオは音楽とサウンドの生成・編集を行い、ボディスワップ(リキャスト)スタジオは外見のリキャストを処理します。

自動化 & プロダクション

ワークフロースタジオはモデルを連結して、無人実行できる反復可能なノードベースのパイプラインを構築します。エージェントスタジオ、デザインエージェントスタジオ、マーケティングスタジオ、アプリ探索は、同じカタログをベースに、対話型およびバッチでの制作作業に対応します。

モデルカタログ

内部にある8つのモデルカテゴリ

すべてのスタジオは同じ基盤となるカタログからモデルを引き出します。これが実際のオープンモデルスタックを定義するものです — 単一プロバイダーに閉じ込められるのではなく、タスク別に整理された、オープンなモデルライブラリ。

70+

テキストから画像

Flux Dev、Nano Banana 2、Seedream 5.0、Ideogram v3、SDXL など。

モデルを見る
70+

画像から画像

Nano Banana 2 Edit、Flux Kontext Pro、Seededit v3、アップスケーラーなど。

モデルを見る
85+

テキストから動画

Kling v3、Sora 2、Veo 3、Wan 2.6、Seedance 2.0 など。

モデルを見る
120+

画像から動画

Kling v2.1 I2V、Veo3 I2V、Hunyuan I2V、Wan 2.2 I2V。

モデルを見る
35+

動画から動画

ビデオエフェクト、AIクリッピング、Vibe Motion、動画条件付き編集。

15

リップシンク

Infinite Talk、Wan 2.2 Speech to Video、LatentSync、Creatify。

モデルを見る
3

ボディスワップ / リキャスト

画像と動画にわたる被写体と外見のリキャスト。

15+

音声

テキストから音楽、リミックス、音声編集モデル。

モデルを見る
クローズド vs. オープン

クローズドプラットフォームとの違い

このアプローチの決定的な特徴は、追加するものではなく取り除くものにあります:モデルへのペイウォールなし、どのプロンプトを許可するかを決めるフィルターなし、そしてコードを読んで変更できるライセンス。

機能他社プロバイダーMidjourney · Runway · Kling本プラットフォーム無料 & オープンソース
料金サブスクリプション制無料(オープンソース)
コンテンツフィルターあり — プロンプトがブロックまたは改変されるなし
モデル独自仕様、単一ファミリー420以上のオープン & 商用モデル
セルフホスティング不可可能
ソースコード非公開MITライセンス

スワイプして比較列を表示

以下との完全な比較を読む: Midjourney または Runway

セルフホスティング & ライセンス

セルフホスティングとローカル推論

このプロジェクトは MITライセンス の下で公開されています — 最も寛容なオープンソースライセンスであり、誰でも読んで、変更して、再配布できます。デスクトップアプリはさらに2つのローカル推論エンジンを搭載し、マシンから出ることなく生成を実行できます。

sd.cpp — 同梱エンジン

アプリと同じマシン上で動作するC++エンジン(stable-diffusion.cpp由来)— Apple SiliconではMetal GPU、LinuxとWindowsではCUDA/Vulkan/ROCmに対応。画像のみのモデルを処理:Z-Image Turbo、Z-Image Base、Dreamshaper 8、Realistic Vision、SDXL。

z-image-turbosdxl-basesd-1.5

Wan2GP — 自前のGPUサーバーを使用

CUDAまたはROCm GPU上の自前のWan2GPサーバーに接続するHTTPクライアント — ゲーミングPC、レンタルGPUボックス、LAN上のLinuxマシンなど。より大きな画像モデルとすべての動画モデルを処理:Flux.1 Dev、Qwen Image、Wan 2.2、Hunyuan Video、LTX Video。

wan-2.2hunyuan-videoltx-video

ローカル推論はデスクトップアプリのみで利用可能です — ホスト型のWeb版は常にクラウドAPIを使用します。

よくある質問

よくある質問にお答えします

オープン生成AIとは、無料で使え、コンテンツフィルターがなく、セルフホストや変更ができるほどオープンな、AI画像・動画・音声ツールを指します。このプロジェクトはその実例です:14のスタジオにわたる420以上のモデル、MITライセンス、サブスクリプション不要。

今すぐ 無料で お試しください

420以上のモデル、14のスタジオ、サブスクリプション不要。お試しにはアカウントも不要です。

無料で生成
Open Generative AIの画像と動画はAIによって生成されています。正確性や信頼性が求められる用途で使用する前に、結果をご確認ください。