Google DeepMind、表現力豊かな音声生成モデル「Gemini 3.1 Flash TTS」を発表

ワンポイント新タグ機能でAI音声の抑揚を細かく制御可能に
この記事は Google DeepMind Blog の一次情報をもとにAIが再構成したものです。 原文を読む →
Google DeepMindは新しい音声合成モデル「Gemini 3.1 Flash TTS」を発表しました。新機能「granular audio tags」により、AIが生成する音声の抑揚や感情表現を細かく指定できるようになります。詳細な技術仕様は公式ブログでは明らかにされていません。
全文を読むには有料プランへの登録が必要です。
プランを見る →