Usa un riferimento
Usa fino a tre clip audio per guidare una voce o uno stile. Oppure aggiungi un'immagine e descrivi i suoni della scena.
Una voce che racconta la tua storia. Musica che crea l'atmosfera. Una scena che prende vita. Crea tutto questo partendo da poche parole.
Tecnologia ByteDance · 1000 caratteri audio per generazione
Pioggia in primo piano su una finestra, un tuono sommesso in lontananza, poi la pioggia si attenua. Senza voci né musica.
Un assaggio dei suoi effetti sonori. La tua prossima creazione potrà includere anche voci e musica.
Scegli un punto di partenza, cambia qualche parola e porta la tua idea in studio.
Fornisci al modello un'emozione da seguire, una voce di riferimento o una scena da animare. Continua a rifinire finché non si adatta al tuo progetto.
Usa fino a tre clip audio per guidare una voce o uno stile. Oppure aggiungi un'immagine e descrivi i suoni della scena.
Regola velocità, volume e intonazione. Scegli una durata target e una frequenza di campionamento da 8 a 48 kHz. La durata effettiva può variare.
Ascolta, salva e scarica. Le tue creazioni restano nella cronologia, pronte per il prossimo montaggio, episodio o idea.
Crea narrazioni, dialoghi, musica, effetti sonori o una scena che li combini tutti. Descrivi le voci, l'atmosfera, l'ambientazione e come deve evolversi l'audio. Seed Audio 1.0 è il modello di creazione audio di ByteDance.
Sì. Allega fino a tre clip audio MP3 o WAV, ciascuna fino a 30 secondi, oppure un'immagine JPG, PNG o WebP. Ogni file può pesare fino a 10 MB. Usa i riferimenti audio e la guida per immagini separatamente. Carica solo contenuti di cui possiedi i diritti.
Imposta una durata target fino a 120 secondi, o scegli Auto. La durata è un'indicazione per il prompt, quindi la lunghezza effettiva può variare. Scarica in MP3, WAV, OGG Opus o PCM grezzo. Il PCM include un'anteprima WAV per l'ascolto.
Ogni generazione completata utilizza 1000 caratteri della quota audio del tuo piano. Puoi visualizzare il tuo saldo e il costo prima di generare. L'ascolto delle demo su questa pagina non consuma la tua quota.
Il text-to-speech si concentra sulla lettura di un testo con una voce selezionata. Questo generatore ti permette di descrivere un'intera idea audio, inclusi voci, musica, ambiente ed effetti. Usa un prompt per dirigere l'interpretazione e la scena.