Google、テキスト説明からAI音声をゼロから設計できるGemini 3.8 Flash TTSを発表
Google、テキスト説明からAI音声をゼロから設計できるGemini 3.8 Flash TTSを発表
| 項目 | 内容 |
|---|---|
| ジャンル | AI |
| 日付 | 2026-09-24 |
| 元記事 | The Decoder |
要約
Googleは100以上の言語に対応するGemini 3.8 Flash TTSとFlash-Lite TTSを発表した。最大の特徴はテキストによる説明文から新しい音声キャラクターをゼロから設計できる機能で、「若い女性の声、少しハスキーで落ち着いたトーン」のような指示だけで任意の音声を生成できる。また30秒のサンプルからの音声クローニング機能も搭載。DeepMindが同日発表したGemini 3.8 Text-to-Speechと合わせて、Google全体でTTS技術の大幅な強化が行われている。これによりコンテンツ制作者や企業がカスタム音声AIをより低コストで導入できるようになり、音声コンテンツ市場に大きな影響を与えそうだ。