ELEVENLABS
ElevenLabs 即时声音克隆
当前正式可用的方案。使用短样本创建声音,生成试听后可用于 Premium 文档转换。
创建我的声音 →声音克隆会从一段短录音中学习可辨识的音色、节奏与表达特征,再用这些特征朗读新的文本。DocsToAudio 将克隆声音接入现有文档转音频流程,无需逐章人工录制。
录音、授权、试听与使用都在一个清晰的四步流程中完成。
朗读建议文本 10–30 秒,或上传不超过 10 MB 的清晰 MP3。
确认声音属于你,或你已经获得声音所有者的明确许可。
为声音命名并创建克隆声音,完成后先生成一段短试听检查效果。
在声音选择器中选择克隆声音,一次性转换长文档、多个章节或整本书。
克隆声音创建完成后,会直接出现在文档转音频流程的声音选择器中。你可以自由切换不同的克隆声音,用选定的声音一次性转换长文档、多个章节或整本书。
ELEVENLABS
当前正式可用的方案。使用短样本创建声音,生成试听后可用于 Premium 文档转换。
创建我的声音 →MORE MODELS
我们计划提供更多声音克隆模型,让你可以根据音色效果和使用需求选择合适的方案。
适合希望在创作、学习或内容发布中持续使用熟悉声音的用户。
把草稿、文章和会员内容转换成由同一声音讲述的音频。
用熟悉的声音收听学习笔记和长篇资料。
无需逐章录音,也能为书面内容提供另一种获取方式。
只需创建一次声音,即可在熟悉的文档转音频流程中持续使用。
使用你自己的声音,或已经获得明确授权的特定声音生成音频,不再局限于平台预设声音。
无需把文本拆成许多短片段再手动拼接,可以直接转换长文档、多个章节或整本书。
克隆声音创建完成后会出现在声音选择器中,可以像其他声音一样随时选择和切换。
声音属于敏感数据。当前正式流程会将样本发送至 ElevenLabs,用于创建并托管克隆声音;DocsToAudio 会记录授权时间,并提供试听和删除控制。
请提供 10–30 秒的清晰录音。相比录满 30 秒,稳定语速和没有背景噪音更加重要。
当前上传流程支持不超过 10 MB 的 MP3,也可以直接使用受支持的浏览器录音。
只有在获得对方明确授权后才可以。创建前必须确认授权,禁止冒用或欺骗性使用。
当前每个克隆声音席位收取 5,000 积分,每个账户最多拥有 2 个有效席位。席位费用在创建克隆声音时一次性收取,删除声音后不退还。使用克隆声音转换文档时会另外按实际转换用量收费,计费标准与使用 ElevenLabs 提供的普通声音进行转换一致。
可以用于多语言文本,但相似度和发音会受到模型、样本语言和目标语言影响。长篇转换前请先试听。
DOCS → VOICE