AIボイスデザイン - テキストからカスタムボイスを作成 | AnyToSpeech
AI音声デザイン

声をデザインする
テキスト説明から

ガイド付きのピルで特性を選ぶか、自分のプロンプトを書いてください。3つのAIプレビューを聞き、お気に入りを保存し、AnyToSpeechのすべての場所で使用してください — TTS、ポッドキャスト、オーディオブックなど。

9
言語
3
プレビューオプション
1
声、どこでも
使い方

説明からカスタム声まで数分

録音は不要です。欲しい声を説明するか、いくつかの質問に答えて、AI生成のプレビューから選んでください。

1

声を説明する

構造化モードを使用してInworldの13のプロファイル属性を設定します — 方言、性別、年齢、感情、トーン、ピッチ、音量、速度、明瞭さ、流暢さ、個性、質感、環境 — またはフリースタイルに切り替えて30〜250文字のプロンプトを書いてください。

2

プレビューから選ぶ

説明から3つの声のオプションを生成します。使用ケースに合わせたサンプルテキストで各プレビューを聞き、最も適したものを選択してください。

3

どこでも使用する

デザインした声はアカウントに保存され、すべてのAnyToSpeechツール — テキスト読み上げ、ポッドキャスト、PDFオーディオブックなど — に表示されます。まるで声のクローンのように。

デザインする2つの方法

構造化ピルまたはフリースタイルプロンプト

構造化モードはInworldの音声デザインのベストプラクティスに従います。フリースタイルは完全な創造的コントロールを提供します。

  • 構造化モード — すべての13のInworld構造化属性のためにピルをタップします — ポータルが使用するのと同じkey:valueプロファイルを構築します。
  • フリースタイルモード — {name}が正確に求めるものを知っているときに自分の説明を書く — キャラクターやブランドの声に最適です。
  • 3つのプレビュー — コミットする前にオプションを並べて比較します。推測は不要です。
  • プラットフォーム全体で動作 — デザインされた声は、デザインバッジ付きで音声ピッカーに表示されます。
音声デザインを試す
声の説明
穏やかで落ち着いた女性の声、柔らかいアメリカのアクセント、30-45歳。優しく流れるような話し方。温かく平和なトーン。完璧な放送品質の音声。
各オプションを聞いて、お気に入りを選んでください。
オプション 1
オプション 2
オプション 3
なぜ音声デザインか

クローンできない声を作成

キャラクター、ブランドペルソナ、ナレーター、そしてまだ存在しない声に最適です。

Inworldパワーのデザイン

Inworldの音声デザインAPIに基づき、ベストプラクティスガイダンスに沿ったプロンプトで構築されています。

保存前に聞く

3つのプレビューサンプルで、公開前にトーン、ペース、キャラクターを比較できます。

9言語

英語、フランス語、スペイン語、ドイツ語、ポルトガル語、イタリア語、日本語、韓国語、中国語で声をデザインします。

プラットフォーム全体

TTS、ポッドキャスト、画像読み上げ、カスタム声をサポートするすべてのツールでデザインした声を使用します。

録音不要

クローンとは異なり、音声デザインはテキストの説明のみを必要とします — サンプル音声がないときに最適です。

プロ機能

音声クローンとともに有料プランに含まれています。デザインを開始するにはサインインしてください。

言語

9言語でデザイン

ターゲット言語とオーディエンスに最適化された声を作成します。

🇺🇸 English 🇫🇷 French 🇪🇸 Spanish 🇩🇪 German 🇧🇷 Portuguese 🇮🇹 Italian 🇯🇵 Japanese 🇰🇷 Korean 🇨🇳 Chinese

声をデザインする準備はできましたか?

サインインしてカスタムAI音声を作成し、AnyToSpeechのすべての機能で使用しましょう。

サインインして始める
よくある質問

よくある質問

音声デザインは音声クローンとどう違いますか?

音声クローンは音声録音からあなたの声をコピーします。音声デザインはテキストの説明から新しい声を作成します — マイクは不要です。キャラクター、ナレーター、ブランドのペルソナに最適です。

有料プランが必要ですか?

はい。音声デザインはプロ機能で、有料プランに含まれる音声クローンと一緒に利用できます。

構造化モードとフリースタイルモードの違いは何ですか?

構造化モードはInworldのポータルに対応しており、13の属性(方言、性別、年齢、感情、トーン、ピッチ、音量、速度、明瞭さ、流暢さ、個性、質感、環境)があります。フリースタイルでは、30〜250文字の説明を自由に書けます。

プレビューは何回できますか?

各デザインリクエストは3つのプレビューボイスを生成します。すべてのボイスを聴いて、お気に入りを選び、アカウントに保存します。

デザインした声はどこで使えますか?

AnyToSpeechでカスタム音声が機能するすべての場所で使用できます — テキスト読み上げ、AIポッドキャスト、PDFオーディオブック、画像読み上げなど。デザイン済みバッジ付きの音声ピッカーに表示されます。