生成AIパスポート 用語解説
VAE(変分自己符号化器)とは
観測データから潜在変数の近似的な分布を推論するエンコーダと、その潜在変数から元データに近いデータを復元するデコーダを組み合わせ、再パラメータ化によって学習する生成モデル。
この記事の目次
まず押さえる結論
VAE(変分自己符号化器)は、生成AIパスポートの「第2章 生成AI(ジェネレーティブAI)」で確認しておきたい用語です。定義だけでなく、どの場面で使う言葉か、何と混同しやすいか、問題文のどの表現で判断するかまで確認します。
情報源と編集区分
公式範囲を確認し、具体例・誤答例・判断手順は当サイトが編集。 一次情報確認日: 2026-08-31。
公式シラバス(PDF)(公式)具体例から判断の境界を固める
生成器・識別器を競わせるのではなく、エンコーダとデコーダで潜在変数の分布を学習し元データを復元する生成モデルとして捉える
観測データをエンコーダに通すと、そのデータがどのような潜在変数の分布から生まれたかを近似的に推論します。続けてデコーダが、その潜在変数から元のデータに近いデータを生成します。GAN(敵対的生成ネットワーク)のように生成器と識別器を競わせるのではなく、再パラメータ化という工夫によって、確率的な潜在変数を含む目的関数を勾配法で最適化できるようにしている点が識別材料です。
- 問題文で見る箇所
- 「エンコーダ」「デコーダ」「潜在変数」「再パラメータ化」という語の組み合わせを確認します。「生成器」「識別器」「競わせる」という語があれば、VAEではなくGAN(敵対的生成ネットワーク)を候補にします。
- 隣接概念との境界
- GAN(敵対的生成ネットワーク)は、データを作る生成器と本物か偽物かを見分ける識別器を競わせて学習します。VAEは、観測データから潜在変数の分布を推論するエンコーダと、その潜在変数から元データに近いデータを復元するデコーダを組み合わせて学習し、2つのネットワークを競わせる仕組みは持ちません。
誤答しやすい選択肢
- VAEを、生成器と識別器を競わせて学習する仕組みとして説明する。これはGAN(敵対的生成ネットワーク)の学習方法です。
- エンコーダが入力データをそのまま複製して出力すると説明する。エンコーダが行うのは潜在変数の近似的な分布への変換で、復元を担うのはデコーダです。
- 再パラメータ化を、生成されたデータの品質を判定する仕組みとして説明する。再パラメータ化は、確率的な潜在変数を含む目的関数を勾配法で最適化できるようにする工夫です。
4段階の判断手順
- 01設問が2つのネットワークを競わせる説明か、エンコーダとデコーダを組み合わせる説明かを分ける。
- 02競わせる記述があればGAN(敵対的生成ネットワーク)、潜在変数の分布を推論・復元する記述があればVAEと判断する。
- 03エンコーダが担う推論とデコーダが担う復元の役割が入れ替わっていないか確認する。
- 04再パラメータ化が品質判定ではなく最適化の工夫として説明されているか見直す。
到達条件: VAEをエンコーダとデコーダで潜在変数の分布を学習・復元する生成モデルとして説明し、生成器と識別器を競わせるGAN(敵対的生成ネットワーク)と区別できる。
試験での問われ方
定義の言い換え
用語そのものではなく、説明文の一部を言い換えて出されることがあります。
似た概念との比較
同じ章の用語と入れ替えた選択肢に注意します。対象、目的、使う場面を分けます。
具体例からの判断
問題文の事例が、定義のどの部分に対応しているかを先に確認します。
誤答しやすいポイント
×ハルシネーション・アライメント・ファインチューニングの取り違え。事実と異なるもっともらしい出力=ハルシネーション、人間の意図に沿わせること=アライメント、追加学習で調整=ファインチューニング。
×GANとVAEの混同。GANは生成器と識別器を競わせる方式、VAEはエンコーダ・デコーダと潜在ベクトルを使う方式。
×Transformerの中核を畳み込みや位置エンコーディングと取り違える。中核は自己注意(Self-Attention)。
関連する確認問題
第2章 生成AI(ジェネレーティブAI) / 生成AIの誕生まで
入力データをエンコーダで潜在ベクトルに圧縮し、デコーダで元のデータを復元するように学習する生成モデルはどれか。
正解は「VAE(変分自己符号化器)」である。VAEは、エンコーダで入力データを潜在ベクトルへ圧縮し、デコーダでそこから元のデータに近い形を復元するように学習する生成モデルである。問題文の「エンコーダで潜在ベクトルに圧縮」「デコーダで元のデータを復元」という2条件は、VAEの構造そのものを指している。LSTM(長・短期記憶)は長期的な依存関係を記憶しながら系列データを処理するモデル、Transformerモデルは自己注意力を中核として入力全体の関係性を扱うモデル、GAN(敵対的生成ネットワーク)は生成器と識別器という2つのネットワークを競わせる方式であり、いずれも潜在ベクトルを介した圧縮と復元を主な学習目的とする構造ではない。
第2章 生成AI(ジェネレーティブAI) / 生成AIの誕生まで
直前までの単語列をもとに次の単語を予測することを繰り返して文章を生成する、GPTが採用している方式を何というか。
正解は「自己回帰モデル」である。自己回帰モデルは、直前までの単語列をもとに次の単語を予測することを繰り返して文章を生成する方式であり、GPTモデルはこの方式を採用している。問題文の「直前までの単語列」「次の単語を予測」「繰り返して生成」という条件は、自己回帰モデルの仕組みそのものである。GAN(敵対的生成ネットワーク)は生成器と識別器という2つのネットワークを競わせる方式、VAE(変分自己符号化器)はエンコーダ・デコーダで圧縮と復元を行う方式、ボルツマンマシンは初期の確率的な生成モデルであり、いずれも逐次的に次の単語を予測して積み上げる仕組みではない。
第2章 生成AI(ジェネレーティブAI) / 生成AIの誕生まで
画像認識などで広く使われ、フィルタを用いた畳み込みによって画像の局所的な特徴を抽出することを中核とするニューラルネットワークはどれか。
正解は「CNN(畳み込みニューラルネットワーク)」である。CNNは、フィルタを用いた畳み込みによって画像の局所的な特徴を抽出することを中核とし、画像認識で広く使われるニューラルネットワークである。問題文の「フィルタを用いた畳み込み」「画像の局所的な特徴を抽出」という条件は、CNNの構造そのものである。RNN(回帰型ニューラルネットワーク)は前の情報を保持しながら系列データを順に処理するモデル、ボルツマンマシンは確率的な仕組みでデータの分布を学習する初期の生成モデル、VAE(変分自己符号化器)はエンコーダ・デコーダと潜在ベクトルで復元する生成モデルであり、いずれも畳み込みによる局所特徴の抽出を中核とする構造ではない。
同じ章で確認したい用語
到達チェック
- VAE(変分自己符号化器)を一文で説明できる
- 同じ章の似た用語と違いを説明できる
- 問題文の具体例から、VAE(変分自己符号化器)に関係する論点を拾える
- 関連問題を解き、誤答した選択肢の理由を確認できる
執筆: ミナト編集部(運営者情報を見る)