Trae una referencia
Usa hasta tres clips de audio para guiar una voz o estilo. O añade una imagen y describe los sonidos de la escena.
Una voz que cuenta tu historia. Música que crea el ambiente. Una escena que cobra vida. Créalo todo a partir de unas pocas palabras.
Tecnología de ByteDance · 1000 caracteres de audio por generación
Lluvia de cerca golpeando una ventana, un trueno lejano y luego la lluvia amainando. Sin voz ni música.
Una muestra de sus efectos de sonido. Tu próxima creación también puede incluir voces y música.
Elige un punto de partida, cambia algunas palabras y lleva tu idea al estudio.
Dale al modelo un sentimiento a seguir, una voz de referencia o una escena para cobrar vida. Sigue dándole forma hasta que encaje en tu proyecto.
Usa hasta tres clips de audio para guiar una voz o estilo. O añade una imagen y describe los sonidos de la escena.
Ajusta la velocidad, el volumen y el tono. Elige una duración objetivo y una frecuencia de muestreo de 8 a 48 kHz. La duración real puede variar.
Escucha, guarda y descarga. Tus creaciones permanecen en tu historial, listas para la próxima edición, episodio o idea.
Crea narraciones, diálogos, música, efectos de sonido o una escena que los combine. Describe las voces, el ambiente, el entorno y cómo debe desarrollarse el audio. Seed Audio 1.0 es el modelo de creación de audio de ByteDance.
Sí. Adjunta hasta tres clips de audio MP3 o WAV, de hasta 30 segundos cada uno, o una imagen JPG, PNG o WebP. Cada archivo puede tener hasta 10 MB. Usa las referencias de audio y la guía de imagen por separado. Sube solo contenido para el que tengas permiso.
Establece una duración objetivo de hasta 120 segundos o elige Automático. La duración es una guía para el prompt, por lo que la longitud real puede variar. Descarga en MP3, WAV, OGG Opus o PCM sin procesar. El PCM incluye una vista previa en WAV para escuchar.
Cada generación exitosa utiliza 1000 caracteres de la cuota de audio de tu plan. Puedes ver tu saldo y el coste antes de generar. Escuchar las demostraciones de esta página no consume tu cuota.
El texto a voz se centra en leer un guion con una voz seleccionada. Este generador te permite describir una idea de audio completa, incluyendo voces, música, ambiente y efectos. Usa un prompt para dirigir la interpretación y la escena.