Дизайн голоса ИИ - Создайте индивидуальные голоса из текста | AnyToSpeech
Дизайн ИИ-голоса

Создайте голос из
Текстового описания

Выбирайте черты с помощью подсказок или напишите собственное описание. Слушайте три предварительных варианта ИИ, сохраните любимый и используйте его в AnyToSpeech — TTS, подкастах, аудиокнигах и не только.

9
Языки
3
Варианты предварительного просмотра
1
Голос, повсюду
Как это работает

От описания до пользовательского голоса за минуты

Запись не требуется. Опишите желаемый голос — или ответьте на несколько вопросов — и выберите из предварительно сгенерированных ИИ-вариантов.

1

Опишите ваш голос

Используйте структурированный режим для настройки 13 атрибутов профиля Inworld — диалект, пол, возраст, эмоция, тон, высота, громкость, скорость, четкость, беглость, личность, текстура, окружение — или переключитесь на свободный стиль и напишите описание от 30 до 250 символов.

2

Выберите из предварительных вариантов

Мы генерируем три варианта голоса на основе вашего описания. Слушайте каждый предварительный просмотр с образцом текста, соответствующим вашему случаю использования, затем выберите тот, который подходит лучше всего.

3

Используйте его повсюду

Ваш созданный голос сохранен в вашем аккаунте и доступен во всех инструментах AnyToSpeech — текст в речь, подкасты, аудиокниги в формате PDF и не только — точно так же, как клон голоса.

Два способа создания

Структурированные пилюли или свободный ввод

Структурированный режим следует лучшим практикам голосового дизайна Inworld. Свободный ввод дает вам полный контроль над креативом.

  • Структурированный режим — Нажмите на пилюли для всех 13 структурированных атрибутов Inworld — мы создаем такой же профиль ключ:значение, который использует портал.
  • Свободный режим — Напишите собственное описание, когда точно знаете, что хотите — отлично подходит для персонажей и голосов брендов.
  • Три предварительных просмотра — Сравните варианты бок о бок перед тем, как принять решение. Никаких догадок.
  • Работает на всей платформе — Созданные голоса отображаются в вашем выборе голосов с отметкой 'Созданный'.
Попробуйте голосовой дизайн
Описание голоса
Успокаивающий, мягкий женский голос с легким американским акцентом, 30-45 лет. Нежная, плавная подача. Теплый, мирный тон. Идеальное качество звука для трансляции.
Прослушайте каждый вариант и выберите свой любимый.
Вариант 1
Вариант 2
Вариант 3
Почему голосовой дизайн

Создавайте голоса, которые нельзя клонировать

Идеально подходит для персонажей, образов брендов, рассказчиков и голосов, которых еще не существует.

Дизайн на основе Inworld

Создано на основе API голосового дизайна Inworld с подсказками, соответствующими их рекомендациям по лучшим практикам.

Слушайте перед сохранением

Три образца предварительного просмотра позволяют сравнить тон, темп и характер перед публикацией.

9 языков

Создавайте голоса на английском, французском, испанском, немецком, португальском, итальянском, японском, корейском и китайском.

На всей платформе

Используйте свой созданный голос в TTS, подкастах, чтении изображений и в каждом инструменте, который поддерживает пользовательские голоса.

Запись не требуется

В отличие от клонирования, голосовой дизайн требует только текстового описания — идеально, когда у вас нет образца аудио.

Профессиональная функция

Включена в платные планы вместе с клонированием голосов. Войдите в систему, чтобы начать проектирование.

Языки

Создавайте на 9 языках

Создавайте голоса, оптимизированные для вашего целевого языка и аудитории.

🇺🇸 English 🇫🇷 French 🇪🇸 Spanish 🇩🇪 German 🇧🇷 Portuguese 🇮🇹 Italian 🇯🇵 Japanese 🇰🇷 Korean 🇨🇳 Chinese

Готовы создать свой голос?

Войдите, чтобы создать индивидуальные AI-голоса и использовать их во всех функциях AnyToSpeech.

Войдите, чтобы начать
Часто задаваемые вопросы

Распространенные вопросы

Чем дизайн голоса отличается от клонирования голоса?

Клонирование голоса копирует ваш голос с аудиозаписей. Дизайн голоса создает новый голос на основе текстового описания — без микрофона. Отлично подходит для персонажей, рассказчиков и брендов.

Мне нужен платный план?

Да. Дизайн голоса — это функция Pro, доступная вместе с клонированием голоса в платных планах.

Что такое структурированный и свободный режим?

Структурированный режим соответствует порталу Inworld — 13 атрибутов (диалект, пол, возраст, эмоция, тон, высота, громкость, скорость, четкость, беглость, личность, текстура, окружение). Свободный режим позволяет написать собственное описание от 30 до 250 символов.

Сколько предварительных прослушиваний я получаю?

Каждый запрос на дизайн генерирует три предварительных голоса. Прослушайте все три, выберите любимый и сохраните его в своем аккаунте.

Где я могу использовать свой созданный голос?

Везде, где работают индивидуальные голоса в AnyToSpeech — текст в речь, AI-подкасты, аудиокниги в PDF, чтение изображений и многое другое. Он появится в вашем выборе голосов с отметкой 'Созданный'.