HeadlinesBriefing favicon HeadlinesBriefing.com

Gemini 3.8 Flash TTSが表現的な音声生成で登場

Hacker News •
×

Google AIがGemini 3.8 Flash TTSとGemini 3.8 Flash-Lite TTSを最も表現的なオーディオ生成モデルとして発表しました。これらのモデルにより、クリエイターはGoogle AI Studio、Gemini API、Google Vidsでカスタムキャラクター音声やシーンのダイアログを生成できます。Gemini 3.8 Flash TTSは深いクリエイティブディレクションのために構築されており、ユーザーは自然言語プロンプトを使用してゼロからまったく新しい声を作成できます。ユーザーは、演技のヒント、ペース、方言の変化、バックチャンネリングに対するきめ細かい制御を伴い、各パフォーマンスラインをライン単位で指示できます。Gemini 3.8 Flash-Lite TTSは、トーンとペースに対するきめ細かい制御を伴う、ダビングや表現的な音声エージェントの高ボリュームでコスト効率の良いスケールを提供します。これらのモデルは、Googleの成長するGemini Audioファミリーを補完し、100以上の言語と方言で2,000以上のプロダクション準備が整った音声へのアクセスを提供します。主要エンティティ:企業:Google、Google AI;人物:Alan Cowen。FAQ:Gemini 3.8 Flash TTSの主な機能は何ですか?Gemini 3.8 Flash TTSは、自然言語プロンプトを使用してゼロからカスタムボイスを作成し、ライン単位のきめ細かいパフォーマンス制御、100以上の言語で2,000以上のプロダクション準備が整った音声へのアクセス、および同意確認による30秒のオーディオサンプルからの音声レプリケーションを可能にします。FAQ Q:Gemini 3.8 Flash TTSの主な機能は何ですか?FAQ A:Gemini 3.8 Flash TTSは、自然言語プロンプトを使用してゼロからカスタムボイスを作成し、ライン単位のきめ細かいパフォーマンス制御、100以上の言語で2,000以上のプロダクション準備が整った音声へのアクセス、および同意確認による30秒のオーディオサンプルからの音声レプリケーションを可能にします。