Google、音声生成モデル「Gemini 3.8 Flash TTS」「Flash-Lite TTS」を発表
原題:Gemini 3.8 text-to-speech says hello
- 公式発表
- 情報の取得
- 出典
- Google DeepMind Blog
Googleが、テキストから音声を作る新モデル「Gemini 3.8 Flash TTS」と「Gemini 3.8 Flash-Lite TTS」を発表しました。Google AI Studio、Gemini API、Gemini Enterprise、Gemini Notebook、Google Vidsで、オリジナルのキャラクター音声を作ったり、セリフごとに演出を付けたりできます。
要点
- Flash TTSは表現重視。100以上の言語・方言で、役柄やアクセントなどを言葉で指定して新しい声を一から作れる
- Flash-Lite TTSは大量生成向けで、吹き替えや音声エージェントなどにコストを抑えて使える
- すぐに使える声は2,000種類以上
- 30秒の音声サンプルから声を再現する機能もあり、同意の確認、SynthIDの透かし、C2PAの認証情報で保護する
※ この要約は、公式発表の本文をもとに AI が作成したものです。運営者が内容を確認して公開しています。
ほかのAIニュース
GitHub、Copilotで複数モデルを提供終了。代替モデルを案内
GitHubは、Copilot Chat・インライン編集・askとagentモード・コード補完を含む全体験で、Gemini 3.5 Flash、Gemini 3.6 Flash、Kimi K2.7 Code、Claude Opus 4.7を提供終了した。代替として、Gemini 3.8 Flash、Kimi K3、Claude Opus 5.5が案内されている。
Google、最新モデル「Gemini 4 Argon」など9月のAI発表をまとめて公開
Googleは9月のAIニュースの総まとめを公開した。最新のフロンティアモデル「Gemini 4 Argon」は、まず信頼されたサイバー防御者向けのFairwind Programで提供されている。ほかにGemini 3.8 Flash、Gemini 3.8 Liveなどのモデルも紹介されている。
GitHub Copilot、デスクトップアプリを操作するコンピューター利用を提供
GitHubは、コンピューター利用(computer use)を GitHub Copilot CLI と GitHub Copilot アプリでパブリックプレビューとして提供開始した。macOS と Windows で、Copilot がデスクトップアプリを操作できる。