AIテキスト読み上げ
わずか数秒でテキストを自然な音声に変換
最先端のAI技術で、リアルなテキスト読み上げ音声を生成します。32言語、5000種類以上の音声とアクセントから選択し、動画、ポッドキャスト、eラーニングなどに最適な自然なナレーションを作成しましょう。
よくある質問
AI音声はどのくらいリアルですか?
当社のAI音声は、自然で人間らしく聞こえるように設計されています。高度なニューラルテキスト読み上げ技術を使用しており、自然なイントネーション、呼吸パターン、感情のニュアンスが含まれているため、多くの場合、プロのナレーターとほとんど区別がつきません。
どの言語に対応していますか?
現在、英語(アメリカ、イギリス、オーストラリアなどの様々なアクセント)、スペイン語、フランス語、ドイツ語、日本語、中国語、ロシア語、アラビア語、ヒンディー語など、32以上の言語と方言をサポートしています。ライブラリには定期的に新しい言語や地域のアクセントを追加しています。
音声出力をカスタマイズできますか?
はい、様々な方法でカスタマイズ可能です。話す速度やピッチの調整、特定の単語の強調、ポーズや区切りの制御、さらには感情的なトーン(喜び、真剣、興奮など)の変更もできます。上級者向けには、発音や伝え方を正確に制御できるSSML(音声合成マークアップ言語)もサポートしています。
自分のAIボイスクローンを作成するにはどうすればよいですか?
ボイスクローニングはProおよびビジネスプランでご利用いただけます。クローンを作成するには、対象となる音声のクリアなオーディオサンプルを少なくとも3分間提供していただく必要があります。システムがその音声特性を学習し、任意のテキストから音声を生成できるデジタル版を作成します。なお、クローン作成は適切な許可を得た音声のみで行ってください。
どのようなファイル形式で書き出せますか?
生成された音声はMP3、WAV、OGG形式で書き出すことができます。用途に応じて、標準品質(128kbps)からプロフェッショナル用途向けのハイデフィニションオーディオ(320kbps)まで、異なる品質レベルを選択可能です。
開発者向けのAPIはありますか?
はい、当社のテキスト読み上げ技術をアプリケーション、ウェブサイト、またはサービスに統合できる堅牢なAPIを提供しています。APIはProプラン(基本アクセス)およびビジネスプラン(フルアクセス、高いレート制限、SLA付き)で利用可能です。ドキュメントは開発者ハブで公開されています。
各プランの使用制限はどのようになっていますか?
無料プランは月間10分、Proプランは月間120分の音声生成が含まれます。ビジネスプランでは無制限の音声生成が可能です。これらの制限は、プラットフォームの使用時間ではなく、最終的に出力された音声の長さを指します。
データは安全でプライバシーは守られていますか?
はい、データのセキュリティとプライバシーを非常に重視しています。音声生成のために送信されたすべてのテキストは、転送中および保存時に暗号化されます。処理後のテキスト内容は、お客様がアカウントに明示的に保存しない限り、当社で保管することはありません。当社のプラットフォームはGDPRに準拠しており、ビジネスのお客様には追加のセキュリティ機能も提供しています。