AI 音频生成器Seed Audio 1.0

每一个创意都有其声音。

讲述故事的人声,烘托氛围的音乐,栩栩如生的场景。只需寥寥数语,即可创造一切。

由 ByteDance 提供技术支持 · 每次生成消耗 1,000 个音频字符

试听室真实的 Seed Audio 示例
氛围音 · MP3

雨后黄昏

0:00 / 0:08

窗户上雨点拍打的特写,远处低沉的雷声,随后雨势减弱。无语音或音乐。

音效初体验。您的下一次创作也可以包含人声和音乐。

一个模型,无限可能。配音音乐对话声景
从一个创意开始

我们要创作什么?

选择一个起点,修改几个词,然后将您的创意带入工作室。

打造您的专属作品
添加情绪、场景以及关键细节。55 / 2048
您的提示词将同步带入。在工作室中添加参考资料并调整设置。
您来导演,Seed 来创作。

一点指引。
极广的范围。

为模型提供可遵循的情绪、可参考的人声或可激活的场景。不断打磨,直到它完美契合您的项目。

@Audio1您的参考,您的方向。

引入参考资料

使用最多三个音频片段来引导人声或风格。或者添加一张图片并描述场景中的声音。

精调表达效果

调整速度、音量和音调。选择目标长度和 8 到 48 kHz 的采样率。实际时长可能会有所不同。

应用到您的项目中

试听、保存并下载。您的作品将保留在历史记录中,随时可用于下一次剪辑、剧集或创意。

MP3WAVOGG OpusPCM
在您播放之前

几个有用的回答。

我可以用 Seed Audio 1.0 创作什么?

创作旁白、对话、音乐、音效或融合这些元素的场景。描述人声、情绪、环境以及音频的展开方式。Seed Audio 1.0 是 ByteDance 的音频创作模型。

我可以使用参考人声或图片吗?

是的。您可以上传最多三个 MP3 或 WAV 音频片段(每个最长 30 秒),或一张 JPG、PNG 或 WebP 图片。每个文件最大为 10 MB。音频参考和图片引导需分开使用。请仅上传您拥有使用权限的媒体。

我可以选择长度和下载格式吗?

设置最高 120 秒的目标时长,或选择“自动”。时长仅作为提示引导,实际长度可能有所不同。支持下载 MP3、WAV、OGG Opus 或原始 PCM 格式。PCM 包含一个用于试听的 WAV 预览。

生成音频需要多少费用?

每次成功生成将消耗您套餐额度中的 1,000 个音频字符。您可以在生成前查看余额和成本。试听本页面的演示音频不会消耗额度。

这与文本转语音有何不同?

文本转语音侧重于用选定的人声朗读脚本。而此生成器允许您描述整个音频创意,包括人声、音乐、氛围和音效。使用提示词来导演表演和场景。

点击播放
您的下一个创意。

创作您的音频