Googleが新TTSモデル「Gemini 3.8 Flash TTS」を発表、声のゼロからの生成と演技指示に対応

ITmedia AI+

Googleは、テキストから音声を生成する最新モデル「Gemini 3.8 Flash TTS」と「Flash-Lite TTS」を公開しました。これにより、ユーザーは声質やアクセント、演技などを自然言語で細かく指定し、ゼロからオリジナルの音声を生成できるようになります。日本語対応も強化され、コンテンツ制作やビジネスコミュニケーションへの応用が期待されます。

この記事は外部メディアの内容を要約したものです。詳細は元記事をご覧ください。

元記事を読む →