Gemini Audioによるテキスト読み上げモデルの紹介

1 件の動画 · 更新: 52分前
Create your own voices with Gemini 3.8 text-to-speech 📺 Create your own voices with Gemini 3.8 text-to-speech ⏱ 1:00📅 2026/09/24 02:53🌐 日本語翻訳

Gemini Audioによるテキスト読み上げモデルの紹介

▼

シンプルなプロンプトから一貫性のある表現豊かな音声出力をオンデマンドで生成する「text to speech」技術をご紹介します。1000種類以上のボイスや、独自の声を安全に再現する機能を通じて、マルチスピーカーの対話シーンなどへの適用方法を確認できます。

■ テキストから音声への変換
- シンプルなプロンプトによる一貫した表現豊かな音声出力の実現

■ ボイスのカスタマイズと選択
- 1000種類以上の事前設定済みボイスからの選択
- ボイスの深さなど詳細な調整機能

■ マルチスピーカーと自己音声の活用
- お気に入りのボイスを保存・配置し、複数話者シーンを演出
- 音声アイデンティティチェックによる安全な自身の声の再現

この動画を紹介した Google DeepMind の最新動画も、紹介付きで読めます。

📄 このページの紹介文は AI が独自に生成したものであり、著作権をはじめとする他者の権利(商標権・名誉権・プライバシー等)を侵害しないよう配慮しています。動画の著作権は各作成者に帰属します。