AI语音设计 - 从文本创建自定义语音 | AnyToSpeech
AI声音设计

从文本描述设计声音
文本描述

选择特征或编写自己的提示。听取三个AI预览,保存您最喜欢的,并在AnyToSpeech中随处使用——TTS、播客、有声书等。

9
语言
3
预览选项
1
声音,随处可用
如何运作

从描述到自定义声音,仅需几分钟

无需录音。描述您想要的声音——或回答几个问题——并从AI生成的预览中选择。

1

描述您的声音

使用结构化模式设置Inworld的13个属性——方言、性别、年龄、情感、语调、音高、音量、速度、清晰度、流利度、个性、质感、环境——或切换到自由风格,编写30-250个字符的提示。

2

从预览中选择

我们根据您的描述生成三个声音选项。听取每个预览,使用与您的用例匹配的示例文本,然后选择最合适的。

3

随处使用

您设计的声音已保存到您的帐户,并出现在每个AnyToSpeech工具中——文本转语音、播客、PDF有声书等——就像一个声音克隆。

两种设计方式

结构化提示或自由风格提示

结构化模式遵循 Inworld 语音设计最佳实践。自由风格让您拥有完全的创作控制。

  • 结构化模式 — 点击药丸获取所有 13 个 Inworld 结构化属性——我们构建与门户使用的相同 key:value 配置文件。
  • 自由风格模式 — 当您确切知道自己想要什么时,写下您的描述——非常适合角色和品牌声音。
  • 三个预览 — 在提交之前并排比较选项。无需猜测。
  • 跨平台使用 — 设计的声音在您的语音选择器中显示,带有设计徽章。
尝试语音设计
声音描述
一个舒缓、平静的女性声音,带有柔和的美式口音,年龄在 30-45 岁之间。温柔、流畅的表达。温暖、宁静的音调。完美的广播质量音频。
收听每个选项并选择您最喜欢的。
选项 1
选项 2
选项 3
为什么选择语音设计

创造无法克隆的声音

非常适合角色、品牌形象、叙述者和尚不存在的声音。

Inworld 驱动的设计

基于 Inworld 的语音设计 API 构建,提示与其最佳实践指导相一致。

保存前先听

三个预览样本让您在发布前比较音调、节奏和角色。

9 种语言

以英语、法语、西班牙语、德语、葡萄牙语、意大利语、日语、韩语和中文设计声音。

全平台使用

在 TTS、播客、图像阅读和所有支持自定义声音的工具中使用您设计的声音。

无需录音

与克隆不同,语音设计只需要文本描述——当您没有样本音频时非常理想。

专业功能

与付费计划一起提供,包含语音克隆。登录以开始设计。

语言

支持 9 种语言的设计

为您的目标语言和受众创建优化的声音。

🇺🇸 English 🇫🇷 French 🇪🇸 Spanish 🇩🇪 German 🇧🇷 Portuguese 🇮🇹 Italian 🇯🇵 Japanese 🇰🇷 Korean 🇨🇳 Chinese

准备好设计您的声音了吗?

登录以创建自定义 AI 声音,并在每个 AnyToSpeech 功能中使用它们。

登录以开始
常见问题

常见问题

声音设计与声音克隆有什么不同?

声音克隆是从音频录音中复制您的声音。声音设计是根据文本描述创建新声音——无需麦克风。非常适合角色、旁白和品牌形象。

我需要付费计划吗?

是的。声音设计是专业功能,与付费计划中的声音克隆一起提供。

结构化模式与自由模式有什么区别?

结构化模式与 Inworld 的门户相匹配——13 个属性(方言、性别、年龄、情感、语调、音高、音量、速度、清晰度、流利度、个性、质感、环境)。自由模式允许您编写自己的 30-250 字描述。

我可以获得多少个预览?

每个设计请求生成三个预览声音。收听所有三个,选择您最喜欢的,并将其保存到您的帐户中。

我可以在哪里使用我设计的声音?

在 AnyToSpeech 中自定义声音可用的所有地方——文本转语音、AI 播客、PDF 有声书、图像朗读等。它会在您的声音选择器中以“设计”标签显示。