マルチモーダル・サービス
音声生成AIとは?
読み: おんせいせいせいえーあい英語: Audio Generation AI更新日: 2026-06-23
音声生成AIとは、音声合成、声の変換、ナレーション生成などを行うAIです。
生成AIパスポート
関連表記: 音声生成AI / 音声生成 / ボイスクローン / Voice Cloning / TTS
試験で問われるポイント
- 本人同意、なりすまし、詐欺リスクに注意します。
- ディープフェイク音声との関係が問われます。
- アクセシビリティやナレーション制作にも使われます。
具体例
研修動画のナレーション案を作る一方、なりすまし詐欺への対策も必要です。
混同しやすい点
- 本人の声を無断で再現しても問題ないと考える。
- 音声生成は画像生成と無関係だと考える。
関連問題で復習
生成AIパスポート現在の生成AIの動向
Speech-to-Text(STT)とText-to-Speech(TTS)の組み合わせとして正しいものはどれか。
G検定ディープラーニングの応用例
データ生成タスクの種類として、最も適切な組合せはどれか。
G検定AI倫理・AIガバナンス
CEOの声を合成した緊急送金の電話を受けた。最も適切な対応はどれか。
生成AIパスポート現在の生成AIの動向
既に用意した一枚の商品画像を参照し、商品の外観を引き継いだ短い動画を生成したい。最も目的に合う方式はどれか。
生成AIパスポート現在の生成AIの動向
2026年版シラバスで扱われるGoogleの動画生成AI「Veo 3」の特徴として、最も適切なものはどれか。
生成AIパスポート現在の生成AIの動向
本人の同意を得て案内動画を制作する。処理Aはサンプル音声に似た声質を再現し、処理Bは既にある音声に動画内の口の動きを合わせる。それぞれの技術の対応はどれか。