GoogleのGemini 3.5 Transcribe、85言語対応で言い間違いも自動修正する音声認識
Google's Gemini 3.5 Transcribe turns speech to text in 85 languages while auto-correcting your verbal stumbles
記事のポイント
📰ニュース
Googleが、85言語に対応し、言い間違いや不要な言葉を自動修正する音声認識モデル「Gemini 3.5 Transcribe」を発表しました。
🔍注目ポイント
リアルタイムでフィラーワードを除去し、言い間違いを修正しながら、ストリーミングモードで4.0%の低い単語エラー率を達成しています。
🔮これからどうなる
多言語での議事録作成や音声入力の精度が向上し、ユーザーはより自然な会話でAIと連携できるようになります。
Gemini 3.5 Transcribeは、前モデルChirp 3と比較してレイテンシーが70%低減され、高速な処理が可能です。
ファンクションコーリングを通じて、他のGeminiモデルと連携し、タスクを連携して実行できます。
これにより、より高度な音声ベースのアプリケーション開発が期待されます。
ファンクションコーリングを通じて、他のGeminiモデルと連携し、タスクを連携して実行できます。
これにより、より高度な音声ベースのアプリケーション開発が期待されます。
Googleの新しい音声認識は、会議の議事録作成や音声入力の精度を格段に向上させそうです。日常のコミュニケーションがよりスムーズになるかもしれませんね。