画像スタジオ
テキストから生成するか、既存の写真を編集できます。70以上のtext-to-imageモデルと70以上のimage-to-imageモデルが自動的に切り替わります。
420以上のオープンソースAIモデル。14のスタジオ。サブスクリプション不要、コンテンツフィルターなし。いますぐ画像を生成して、動画として動き出す様子をお楽しみください。
オープンでフィルターのないモデルを搭載 — 登録不要。
モデルカタログの内側
生成AIのあらゆるタスクに対して、ひとつの過負荷なプロンプトボックスではなく、目的に特化したワークスペースを用意しています。画像・動画・音声・リップシンク・シネマ・ワークフローなど、必要なスタジオを開けば、適切なモデルがすでに接続されています。
テキストから生成するか、既存の写真を編集できます。70以上のtext-to-imageモデルと70以上のimage-to-imageモデルが自動的に切り替わります。
テキストから動画を生成するか、開始フレームをアニメーション化。85以上のtext-to-videoモデルと120以上のimage-to-videoモデルが自動的に切り替わります。
テキストプロンプトからAI音声と音楽を生成・編集できます。
長尺のアップロード動画からハイライトを自動抽出してクリップ化します。
スタイリッシュな映像エフェクトのためのモーション・アニメーション生成。
9つの専用モデルで、ポートレートのアニメーション化や既存映像へのリップシンクを実現します。
画像や動画内の被写体の身体・外見を別のものに差し替え(リキャスト)できます。
プロ仕様のカメラ・レンズ・焦点距離・絞りコントロールを備えたフォトリアルなシネマティック映像。
ひとつのインプットから、広告・マーケティング向けのクリエイティブバリエーションを生成します。
画像・動画・音声モデルを組み合わせて自動化フローを構築できる、ビジュアルな多段階AIパイプライン。
会話形式で生成タスクを計画・実行する、マルチターン対応のクリエイティブエージェント。
反復的なビジュアル作業のための、キャンバスベースの自律型デザインエージェント。
同じモデルカタログをベースにしたアプリテンプレートとユースケースのディレクトリ。
一貫性のあるAIペルソナやインフルエンサー向けコンテンツの作成・管理ツール。
ヒーローセクションでもフルワークスペースでも、同じ3ステップの流れで動作します — 入力して、生成して、その結果を動きへ。

見たいものを入力するだけ。アカウント不要ですぐ始められます。

プロンプトは数秒で実際のフィルターなしモデルを通過します。

その画像を動きに変え、スタジオでどう動き出すかをプレビューできます。
3つのセクションが主要な作業を担い、それぞれが1つのキャンバスで2つのモードを実行します — 作ったものがそのまま次の生成の入力になるので、間の書き出しステップは不要です。

空白のキャンバスでのtext-to-image、参照画像をドロップした瞬間に切り替わるimage-to-image — さらにキャラクターの一貫性のために1リクエストあたり最大14枚の参照画像に対応。

文章または静止フレームから開始 — text-to-videoとimage-to-videoが1つのタイムラインを共有するので、生成した画像がクリップの最初のフレームになります。

ポートレートモードは音声トラックから静止画像を動かし、ビデオモードは既存のクリップを再同期します。どちらも汎用の一括処理ではなく、専用のリップシンクモデルで実行されます。
どの環境でも同じオープンソースカタログが付属します。8カテゴリにわたる420以上のモデル — セルフホストでもオンラインで無料利用でも、同じカタログです。
カテゴリの数はオープンソースプロジェクトが公開しているモデル一覧と一致しています。
ツールからそのまま出力された静止画 — レタッチなし、アップスケーリングなし、入力時のプロンプト改変なし。








通常なら3〜4つの別々のサブスクリプションが必要な作業を、1つのオープンソースカタログでカバーします。
プレーンなプロダクト写真を一度撮影すれば、image-to-imageモデルで数十の背景にライティングと構図を変更できます。
画像スタジオカメラ、レンズ、焦点距離、絞りを固定し、一貫した見た目でシーケンスの全フレームを生成します。
シネマスタジオ音声を録音または生成し、ポートレートをセットすれば、リップシンクモデルがトーキング動画を最初から最後まで駆動します。
リップシンクスタジオ1つのブリーフが1週間分の広告バリエーションに — 同じ被写体で異なるクロップ、比率、ムードを一度に生成します。
マーケティングスタジオ1つのリクエストに最大14枚の参照画像を入れることで、ゲームやコミックのキャラクターがどの角度からでも同じ顔を保てます。
画像スタジオ画像モデルを動画モデル、音声処理へと接続し、バッチのプロンプトでチェーン全体を無人実行できます。
ワークフロースタジオサブスクリプションプラットフォームは月額課金で、プロンプトをフィルターし、独自のモデルファミリーだけを提供します。このオープンソースプロジェクトは、それぞれに対して無料の代替案を示します — プロジェクト自身が公開しているのと同じオープンソース比較です。
| 機能 | 他社プロバイダーMidjourney · Runway · Kling · Luma · Pika | Open Generative AI無料 & オープンソース |
|---|---|---|
| 料金 | サブスクリプション制 | 無料(オープンソース) |
| コンテンツフィルター | あり — プロンプトがブロックまたは改変される | なし |
| 制限 | プラットフォームのガードレールが適用される | 完全な創作の自由 |
| モデル | 独自仕様 | 400以上のオープン & 商用モデル |
| 複数画像の入力 | 制限あり | 1リクエストあたり最大14枚 |
| リップシンク | なし | 9つのモデル、画像 & 動画モード |
| ホスト版 | サブスクリプション | 無料 |
| セルフホスティング | 不可 | 可能 |
| カスタマイズ | 不可 | 完全にハック可能 |
| データプライバシー | クラウドベース | データはローカルに保持(セルフホスト時) |
| ソースコード | 非公開 | MITライセンス |
スワイプしてOpen Generative AIの列を表示
毎週これを使って作品を届けている人々からのフィードバック。名前ではなく役割で紹介しています。
1リクエストで14枚の参照画像を使えることが、移行した最大の理由です。生成するアングルシートのすべてで、ようやくキャラクターの顔が一貫するようになりました。
切り替えて以来、フィルターにプロンプトを途中で止められたことはありません。モデレーションをすり抜けるための言い換えをやめて、そのまま動画を作れるようになりました。
4090を積んだ1台にセルフホストし、必要なときはローカルモデルに切り替えています。インターフェースは同じで、データがマシンから出て行くことはありません。