Google、テキスト記述でAI音声をゼロからデザインできる新しいFlash TTSモデルを発表
Google's new Flash TTS models let you design AI voices from scratch using text descriptions
記事のポイント
📰ニュース
Googleが100以上の言語に対応し、テキスト記述からAI音声を生成できる新しいTTSモデル「Flash TTS」を発表しました。
🔍注目ポイント
テキスト記述で新しいAI音声をゼロからデザインでき、30秒の音声サンプルから声のクローンも作成可能です。
🔮これからどうなる
コンテンツ制作者は、より多様でパーソナライズされたAI音声を簡単に利用できるようになります。
Googleが発表したGemini 3.8 Flash TTSとFlash-Lite TTSは、100以上の言語をサポートしています。
Flash TTSはテキスト記述から新しい音声を生成でき、両モデルとも個々の行に演出指示を追加したり、単一のスクリプトから2人分の対話音声を生成したりできます。
さらに、30秒のサンプルから声のプロファイルを構築する音声クローン機能も搭載しています。
Flash TTSはテキスト記述から新しい音声を生成でき、両モデルとも個々の行に演出指示を追加したり、単一のスクリプトから2人分の対話音声を生成したりできます。
さらに、30秒のサンプルから声のプロファイルを構築する音声クローン機能も搭載しています。
Googleの新しいFlash TTSモデルは、テキストだけでオリジナルのAI音声を作れるので、ポッドキャストや動画制作の幅が広がりそうですね。あなたの生活にも新しい音声体験が訪れるかもしれません。