画像 & シネマティックな静止画
画像スタジオはtext-to-image(50以上のモデル)とimage-to-image(55以上のモデル)を自動的に切り替えます。シネマスタジオはフォトリアルな撮影のためのカメラ、レンズ、焦点距離、絞りコントロールを追加します。
14のスタジオは14の別々のアプリではありません — 共有された1つのモデルカタログを目的別のワークスペースに分けたもので、開いた時点で適切なモデルがすでに接続されています。タスク別に分類すると、実際には次のようになります。
画像スタジオはtext-to-image(50以上のモデル)とimage-to-image(55以上のモデル)を自動的に切り替えます。シネマスタジオはフォトリアルな撮影のためのカメラ、レンズ、焦点距離、絞りコントロールを追加します。
動画スタジオは1つのタイムラインでtext-to-video(40以上のモデル)とimage-to-video(60以上のモデル)を実行するため、生成した静止画がクリップの冒頭フレームになります。Vibe MotionスタジオとAIクリッピングは、スタイライズエフェクトとハイライト抽出を担当します。
リップシンクスタジオは2つのモードで9つの専用モデルを駆動します — 音声からポートレートをアニメーション化するか、既存の動画を再同期するか。音声スタジオは音楽とサウンドの生成・編集を行い、ボディスワップ(リキャスト)スタジオは外見のリキャストを処理します。
ワークフロースタジオはモデルを連結して、無人実行できる反復可能なノードベースのパイプラインを構築します。エージェントスタジオ、デザインエージェントスタジオ、マーケティングスタジオ、アプリ探索は、同じカタログをベースに、対話型およびバッチでの制作作業に対応します。
すべてのスタジオは同じ基盤となるカタログからモデルを引き出します。これが実際のオープンモデルスタックを定義するものです — 単一プロバイダーに閉じ込められるのではなく、タスク別に整理された、オープンなモデルライブラリ。
Flux Dev、Nano Banana 2、Seedream 5.0、Ideogram v3、SDXL など。
モデルを見るNano Banana 2 Edit、Flux Kontext Pro、Seededit v3、アップスケーラーなど。
モデルを見るKling v3、Sora 2、Veo 3、Wan 2.6、Seedance 2.0 など。
モデルを見るKling v2.1 I2V、Veo3 I2V、Hunyuan I2V、Wan 2.2 I2V。
モデルを見るビデオエフェクト、AIクリッピング、Vibe Motion、動画条件付き編集。
Infinite Talk、Wan 2.2 Speech to Video、LatentSync、Creatify。
モデルを見る画像と動画にわたる被写体と外見のリキャスト。
テキストから音楽、リミックス、音声編集モデル。
モデルを見るこのアプローチの決定的な特徴は、追加するものではなく取り除くものにあります:モデルへのペイウォールなし、どのプロンプトを許可するかを決めるフィルターなし、そしてコードを読んで変更できるライセンス。
| 機能 | 他社プロバイダーMidjourney · Runway · Kling | 本プラットフォーム無料 & オープンソース |
|---|---|---|
| 料金 | サブスクリプション制 | 無料(オープンソース) |
| コンテンツフィルター | あり — プロンプトがブロックまたは改変される | なし |
| モデル | 独自仕様、単一ファミリー | 420以上のオープン & 商用モデル |
| セルフホスティング | 不可 | 可能 |
| ソースコード | 非公開 | MITライセンス |
スワイプして比較列を表示
以下との完全な比較を読む: Midjourney または Runway。
このプロジェクトは MITライセンス の下で公開されています — 最も寛容なオープンソースライセンスであり、誰でも読んで、変更して、再配布できます。デスクトップアプリはさらに2つのローカル推論エンジンを搭載し、マシンから出ることなく生成を実行できます。
アプリと同じマシン上で動作するC++エンジン(stable-diffusion.cpp由来)— Apple SiliconではMetal GPU、LinuxとWindowsではCUDA/Vulkan/ROCmに対応。画像のみのモデルを処理:Z-Image Turbo、Z-Image Base、Dreamshaper 8、Realistic Vision、SDXL。
CUDAまたはROCm GPU上の自前のWan2GPサーバーに接続するHTTPクライアント — ゲーミングPC、レンタルGPUボックス、LAN上のLinuxマシンなど。より大きな画像モデルとすべての動画モデルを処理:Flux.1 Dev、Qwen Image、Wan 2.2、Hunyuan Video、LTX Video。
ローカル推論はデスクトップアプリのみで利用可能です — ホスト型のWeb版は常にクラウドAPIを使用します。