Bringe eine Referenz mit
Verwende bis zu drei Audioclips, um eine Stimme oder einen Stil zu leiten. Oder füge ein Bild hinzu und beschreibe die Geräusche der Szene.
Eine Stimme, die deine Geschichte erzählt. Musik, die die Stimmung vorgibt. Eine Szene, die lebendig wirkt. Erschaffe alles aus nur wenigen Worten.
Powered by ByteDance · 1.000 Audio-Zeichen pro Generierung
Prasselnder Regen nah am Fenster, ein tiefes Grollen von fernem Donner, dann nachlassender Regen. Keine Sprache oder Musik.
Ein Vorgeschmack auf die Soundeffekte. Deine nächste Kreation kann auch Stimmen und Musik enthalten.
Wähle einen Ausgangspunkt, ändere ein paar Worte und nimm deine Idee mit ins Studio.
Gib dem Modell ein Gefühl vor, eine Stimme als Referenz oder eine Szene, die zum Leben erweckt werden soll. Verfeinere es so lange, bis es zu deinem Projekt passt.
Verwende bis zu drei Audioclips, um eine Stimme oder einen Stil zu leiten. Oder füge ein Bild hinzu und beschreibe die Geräusche der Szene.
Passe Geschwindigkeit, Lautstärke und Tonhöhe an. Wähle eine Ziellänge und eine Abtastrate von 8 bis 48 kHz. Die tatsächliche Dauer kann variieren.
Anhören, speichern und herunterladen. Deine Kreationen bleiben in deinem Verlauf gespeichert, bereit für den nächsten Edit, die nächste Episode oder Idee.
Erstelle Narrationen, Dialoge, Musik, Soundeffekte oder eine Szene, die alles kombiniert. Beschreibe die Stimmen, die Stimmung, die Umgebung und den Ablauf des Audios. Seed Audio 1.0 ist das Audio-Erstellungsmodell von ByteDance.
Ja. Hänge bis zu drei MP3- oder WAV-Audioclips von jeweils bis zu 30 Sekunden oder ein JPG-, PNG- oder WebP-Bild an. Jede Datei darf bis zu 10 MB groß sein. Verwende Audio-Referenzen und Bild-Vorgaben separat. Lade nur Medien hoch, für deren Nutzung du die Erlaubnis hast.
Lege eine Zieldauer von bis zu 120 Sekunden fest oder wähle Auto. Die Dauer dient als Orientierung für den Prompt, daher kann die tatsächliche Länge variieren. Lade MP3, WAV, OGG Opus oder rohes PCM herunter. PCM enthält eine WAV-Vorschau zum Anhören.
Jede erfolgreiche Generierung verbraucht 1.000 Zeichen deines Audio-Kontingents. Du kannst dein Guthaben und die Kosten vor der Generierung einsehen. Das Anhören der Demos auf dieser Seite verbraucht kein Kontingent.
Text-to-Speech konzentriert sich darauf, ein Skript mit einer gewählten Stimme vorzulesen. Dieser Generator lässt dich eine komplette Audio-Idee beschreiben, inklusive Stimmen, Musik, Ambiente und Effekten. Nutze einen Prompt, um die Darbietung und die Szene zu steuern.