← 記事一覧
Google新モデル

Google、音声生成モデル「Gemini 3.8 Flash TTS」「Flash-Lite TTS」を発表

原題:Gemini 3.8 text-to-speech says hello

公式発表
情報の取得
出典
Google DeepMind Blog

Googleが、テキストから音声を作る新モデル「Gemini 3.8 Flash TTS」と「Gemini 3.8 Flash-Lite TTS」を発表しました。Google AI Studio、Gemini API、Gemini Enterprise、Gemini Notebook、Google Vidsで、オリジナルのキャラクター音声を作ったり、セリフごとに演出を付けたりできます。

要点

  • Flash TTSは表現重視。100以上の言語・方言で、役柄やアクセントなどを言葉で指定して新しい声を一から作れる
  • Flash-Lite TTSは大量生成向けで、吹き替えや音声エージェントなどにコストを抑えて使える
  • すぐに使える声は2,000種類以上
  • 30秒の音声サンプルから声を再現する機能もあり、同意の確認、SynthIDの透かし、C2PAの認証情報で保護する
公式発表を読む(Google DeepMind Blog)→

※ この要約は、公式発表の本文をもとに AI が作成したものです。運営者が内容を確認して公開しています。

ほかのAIニュース