ElevenLabs、新音声モデルv4でAI音声の表現力と一貫性を向上
ElevenLabs' new v4 speech model makes AI voices more expressive and consistent
記事のポイント
📰ニュース
ElevenLabsが新音声モデルEleven v4を発表し、AI音声の表現力と一貫性が大幅に向上しました。
🔍注目ポイント
笑いやささやきをより正確に再現し、長尺コンテンツでも声質の一貫性を保つ技術が優れています。
🔮これからどうなる
オーディオブックやリアルタイム音声エージェントなど、多様なAI音声利用シーンで自然な体験が提供されます。
新モデルには、150ミリ秒で発話を開始するリアルタイム向け「Turbo」バリアントも含まれています。
AI音声の評価サイト「Artificial Analysis' Voice Arena」のリーダーボードでは、CartesiaやGoogleのGeminiを上回る評価を得ています。
AI音声の評価サイト「Artificial Analysis' Voice Arena」のリーダーボードでは、CartesiaやGoogleのGeminiを上回る評価を得ています。
ElevenLabsの新しい音声モデルは、AIの音声がさらに人間らしくなる一歩ですね。オーディオブックやゲームのキャラクターボイスなど、私たちの生活に身近なコンテンツがより自然になりそうです。