生成AIパスポート 用語解説
画像生成AIとは
テキストの指示(プロンプト)から、絵やイラストなどの画像を作り出す生成AI。
まず押さえる結論
画像生成AIは、生成AIパスポートの「第3章 現在の生成AI(ジェネレーティブAI)の動向」で確認しておきたい用語です。定義だけでなく、どの場面で使う言葉か、何と混同しやすいか、問題文のどの表現で判断するかまで確認します。
情報源と編集区分
公式範囲を確認し、具体例・誤答例・判断手順は当サイトが編集。 一次情報確認日: 2026-06-27。
公式シラバス(PDF)(公式)試験での問われ方
定義の言い換え
用語そのものではなく、説明文の一部を言い換えて出されることがあります。
似た概念との比較
同じ章の用語と入れ替えた選択肢に注意します。対象、目的、使う場面を分けます。
具体例からの判断
問題文の事例が、定義のどの部分に対応しているかを先に確認します。
誤答しやすいポイント
×RAGとファインチューニングの混同。RAGは外部知識(ベクトルデータベース)を検索して文脈に加える手法で、モデルの再学習はしない。ファインチューニングは追加学習。
×ディープフェイクと偽情報(ディスインフォメーション)の区別。前者は人物の映像・音声を本物のように偽造する技術、後者は意図的に作られ拡散される偽情報そのもの。
×生成物の種類の取り違え。Soraは動画、Image Generationは画像、音声生成AIは音声。名前ではなく生成する対象で見分ける。
関連する確認問題
第3章 現在の生成AI(ジェネレーティブAI)の動向 / 生成AIが出来ることと主なサービス
テキストの指示(プロンプト)から絵やイラストなどの画像を作り出すAIの種類を何というか。
正解は「画像生成AI」である。テキストの指示(プロンプト)から絵やイラストなどの画像を作り出すAIを画像生成AIという。動画生成AIが作り出すのは動画であり、静止した画像ではなく時間軸を持つ映像を生成する点で異なる。音声生成AIは話し言葉などの音声を作り出すAIであり、絵やイラストを描くものではない。音楽生成AIはメロディーや伴奏といった楽曲を作り出すAIであり、画像を生成する用途ではない。プロンプトから絵やイラストを作り出すという条件に当てはまるのは画像生成AIだけである。
第3章 現在の生成AI(ジェネレーティブAI)の動向 / 生成AIが出来ることと主なサービス
入力した文章を読み上げたり、人の声を合成して話し言葉の音声を作り出す生成AIを何というか。
正解は「音声生成AI」である。入力した文章を読み上げたり、人の声を合成して話し言葉の音声を作り出すAIを音声生成AIという。音楽生成AIが手掛けるのはメロディーや伴奏といった楽曲であり、話し言葉の音声を合成する用途ではない。テキスト生成AIが作り出すのは文章そのものであり、文章を音声に変換する処理ではない。画像生成AIが作り出すのは絵やイラストなどの画像であり、話し言葉の音声を作り出す用途ではない。文章の読み上げや声の合成で話し言葉の音声を作り出すという条件に当てはまるのは音声生成AIだけである。
第3章 現在の生成AI(ジェネレーティブAI)の動向 / 生成AIが出来ることと主なサービス
生成AIと、それが作り出す生成物による分類の組み合わせとして正しいものはどれか。
正解は「Veo3 ── 動画生成AI」である。Veo3はGoogleが開発した動画生成AIなので、名称と生成物の分類の組み合わせが正しい。Soraは動画生成AIであり画像生成AIではないため組み合わせが誤り、Claudeは対話型のテキスト生成AIであり音声生成AIではないため組み合わせが誤り、Geminiも対話型のテキスト生成AIであり音楽生成AIではないため組み合わせが誤り。設問は「名称」と「生成物による分類」の対応そのものを問うており、いずれの誤答も名称は実在するが、結び付けられた分類の側が実際の生成物とずれている。 各サービスを主な生成物へ個別に対応させる。SoraとVeo3は動画生成、ClaudeとGeminiは対話型のテキスト生成に分類される。四つの組合せのうち名称と媒体が一致するVeo3と動画生成AIを選ぶ。 サービスの開発元ではなく主な出力媒体を照合し、動画を作るSora・Veo3と、文章で対話するClaude・Geminiの2群に分ける。
同じ章で確認したい用語
到達チェック
- 画像生成AIを一文で説明できる
- 同じ章の似た用語と違いを説明できる
- 問題文の具体例から、画像生成AIに関係する論点を拾える
- 関連問題を解き、誤答した選択肢の理由を確認できる
執筆: ミナト編集部(運営者情報を見る)