リファレンスを活用
最大3つのオーディオクリップを使用して、声やスタイルをガイドします。または、画像を追加してシーンの音を記述します。
物語を語る声。ムードを作る音楽。躍動感のあるシーン。数つの言葉から、すべてを作り出しましょう。
Powered by ByteDance · 1回の生成につき1,000オーディオ文字
窓を叩く雨音のクローズアップ、遠くで低く響く雷鳴、そして雨が弱まる様子。音声や音楽はなし。
効果音のサンプルです。次の制作では、音声や音楽も組み込むことができます。
開始点を選び、言葉を少し変えて、あなたのアイデアをスタジオに持ち込みましょう。
モデルに従わせる感情、参照する声、または命を吹き込むシーンを指定します。プロジェクトに合うまで形を整えましょう。
最大3つのオーディオクリップを使用して、声やスタイルをガイドします。または、画像を追加してシーンの音を記述します。
速度、音量、ピッチを調整。目標の長さと8〜48 kHzのサンプリングレートを選択できます。実際の長さは異なる場合があります。
試聴、保存、ダウンロード。作成したものは履歴に残り、次の編集やエピソード、アイデアにいつでも使えます。
ナレーション、対話、音楽、効果音、またはそれらを組み合わせたシーンを作成できます。声、ムード、設定、オーディオの展開を記述してください。Seed Audio 1.0はByteDanceのオーディオ生成モデルです。
はい。最大3つのMP3またはWAVオーディオクリップ(各30秒以内)、または1つのJPG、PNG、WebP画像を添付できます。各ファイルは最大10MBまでです。オーディオリファレンスと画像ガイドは別々に使用してください。使用許可を得ているメディアのみをアップロードしてください。
最大120秒までの目標時間を設定するか、「自動」を選択します。時間はプロンプトによる目安であり、実際の長さは異なる場合があります。MP3、WAV、OGG Opus、または生のPCMをダウンロード可能です。PCMには試聴用のWAVプレビューが含まれます。
生成に成功するたびに、プランのオーディオ割り当てから1,000文字が使用されます。生成前に残高とコストを確認できます。このページのデモを聴いても割り当ては消費されません。
テキスト読み上げは、選択した声でスクリプトを読み上げることに特化しています。このジェネレーターでは、声、音楽、環境音、効果音を含むオーディオ全体のアイデアを記述できます。プロンプトを使用して、演技やシーンをディレクションしてください。