事実
Googleは、Gemini AI向けの音声合成(TTS)モデル2種を新たに公開した。うち1種は長尺コンテンツのダビングなど大規模な音声生成に対応しており、用途に応じて使い分けが可能な構成となっている。
今回公開されたのは、Geminiプラットフォームで利用できるTTSモデル2種である。一方は大規模なダビング用途を想定したモデルで、従来のAI音声技術の課題とされてきた長尺コンテンツへの対応を強化している点が特徴だ。
もう1種は対話的な音声生成に向けたモデルで、それぞれのユースケースに合わせて選択できる。両モデルともGeminiの機能として提供され、開発者やユーザーがAIによる自然な音声合成を活用できるようになっている。
長尺のダビングに対応したモデルにより、動画の吹き替えやナレーションなど、これまでAI音声では困難とされてきた長時間の音声生成への活用が見込まれる。GoogleはGeminiの機能拡充の一環として、音声分野の選択肢を拡げている。
なお、モデルの詳細な性能指標や提供条件に関する具体的な数値は、現時点では公開情報の範囲で確認されていない。
本件は最終的に Verdict: 事実 と判定された。