モデルカテゴリ

オーディオ モデル — 15以上のAI 音楽・サウンド生成ツール

テキストから音楽を生成、リミックス、音声編集を1つのスタジオで — 15以上のモデルがテキストのプロンプトからAIサウンドを生成・編集します。サブスクリプション不要。

15+ オーディオ モデル$0 生成コスト

オーディオモデルは、テキストのプロンプトからAI音楽とサウンドを生成・編集します — テキストから音楽を生成、リミックス、音声編集を1つのスタジオで行えます。このカテゴリは15以上のモデルを提供し、画像・動画カテゴリとは異なり、個別のモデル名ではなく機能別に紹介されています。

オーディオ モデル

15以上のオーディオモデルを1つのOpen Generative AIカタログで

このカテゴリは個別のモデル名ではなく機能別に紹介されています。以下のすべてのモデルは同じ Audio Studio のプロンプトボックスで動作し、モデルごとにアカウントを分けたり、フィルターが切り替わったりすることはありません。

text-to-music

テキストのプロンプトからオリジナルのAI音楽を生成。

remix

既存の音声を新しいスタイルで再解釈。

audio-editing

既存の音声を編集・調整。

ホスト型 vs. ローカル実行

現在はホスト型のみ、ローカルのオーディオ経路はなし

Open Generative AI のローカル推論のドキュメントは画像・動画生成のみを対象としているため、オーディオ生成はカタログの他モデルと同じホスト型 API で実行されます。

ホスト型

Audio Studio は、ホスト型 API を通じてテキストのプロンプトからAIサウンドと音楽を生成・編集します。カタログの15以上のテキストから音楽を生成、リミックス、編集モデルに対応しています。

ローカル推論

ローカル推論のドキュメント(sd.cpp と Wan2GP)は画像モデルと動画/大規模画像モデルを対象としており、オーディオ生成はローカルオプションとして記載されていません。

比較

3つのオーディオ機能を横並びで比較

カタログで紹介されている3つの機能を簡単に見比べましょう。作りたい用途に合うものを選べます。

機能できることカテゴリ規模
Text-to-MusicテキストのプロンプトからオリジナルのAI音楽を生成合計15以上のモデル
リミックス既存の音声を新しいスタイルで再解釈合計15以上のモデル
音声編集AI生成またはアップロードした既存の音声を編集・調整合計15以上のモデル

スワイプで全表を表示

よくある質問

オーディオ モデル よくある質問

15以上です。テキストから音楽を生成、リミックス、音声編集に対応しています。

もっと探す

その他の Open Generative AI モデルカテゴリ

このカテゴリは以下のカテゴリと密接に関連しています。また、生成フロー全体を実行する Audio Studio のページもあわせてご覧ください。

オーディオを生成するなら Open Generative AI — 今すぐ無料

15以上のオーディオモデル。コンテンツフィルターなし、サブスクリプション不要。お試しにアカウント登録は必要ありません。

無料で試す
Open Generative AIの画像と動画はAIによって生成されています。正確性や信頼性が求められる用途で使用する前に、結果をご確認ください。