AI資格ドリル
資格を選ぶ↓

DS検定 用語解説

正規化とは

データの重複や更新時の不整合を防ぐため、テーブルを機能ごとに分割して整理する設計手法。第一正規化から第三正規化まで段階的に適用される。

まず押さえる結論

正規化は、DS検定の「第6章 データエンジニアリング基礎」で確認しておきたい用語です。定義だけでなく、どの場面で使う言葉か、何と混同しやすいか、問題文のどの表現で判断するかまで確認します。

情報源と編集区分

公式範囲を確認し、具体例・誤答例・判断手順は当サイトが編集。 一次情報確認日: 2026-10-02。

試験概要(公式)

具体例から判断の境界を固める

正規化を、役割と隣接概念の境界から捉える

データの重複や更新時の不整合を防ぐため、テーブルを機能ごとに分割して整理する設計手法。第一正規化から第三正規化まで段階的に適用される。 試験では名称だけでなく、処理の対象、目的、使う段階を別概念と入れ替えた選択肢が出るため、定義の主語と動作を分けて確認します。

問題文で見る箇所
データの重複や更新時の不整合を防ぐため、テーブルを機能ごとに分割して整理する設計手法全体であり、第一正規化から第三正規化まで段階的に適用されるかを確認します。
隣接概念との境界
正規化はテーブルを機能ごとに分割して整理する設計手法全体を指し、第一正規化は各セルへ単一の値だけを入れて繰り返し項目を排除する、その最初の段階を指します。

誤答しやすい選択肢

  • 正規化の最初の段階である第一正規化の内容だけをもって、第一正規化から第三正規化までを含む正規化全体を説明したものとして扱う。定義の主語と処理対象を確認します。
  • 正規化の目的だけを見て、同じ目的を持つ別手法まで同じ用語とする。具体的な処理を比較します。
  • 正規化を使えば目的が必ず達成されると断定する。適用条件や評価を別に確認します。

4段階の判断手順

  1. 01問題文が状態、手法、評価指標、制度のどれを説明しているか決める。
  2. 02定義の中心となる対象と動作が正規化に一致するか確認する。
  3. 03隣接概念と共通する目的ではなく、処理や条件の違いを見る。
  4. 04必ず・完全に・だけでよいという過度な断定がないか見直す。

到達条件: 正規化を一文で説明し、最も混同しやすい隣接概念との違いを処理または条件から言える。

試験での問われ方

01

定義の言い換え

用語そのものではなく、説明文の一部を言い換えて出されることがあります。

02

似た概念との比較

同じ章の用語と入れ替えた選択肢に注意します。対象、目的、使う場面を分けます。

03

具体例からの判断

問題文の事例が、定義のどの部分に対応しているかを先に確認します。

誤答しやすいポイント

「第6章 データエンジニアリング基礎」の問題で、取り違えやすい組み合わせです。

  • 構造化データと非構造化データの判断基準を誤る。テキスト・音声・画像・動画のような雑多な形式か、テーブル形式で管理できるかで区別する。
  • 第一正規化から第三正規化までの段階を混同する。各段階でどの種類の重複・従属関係を解消するのかが異なる。
  • 内部結合・外部結合・自己結合の使い分けを誤る。条件に一致しない行を残すかどうかで結合方式が変わる。

関連する確認問題

第6章 データエンジニアリング基礎 / データ構造・蓄積

テーブル内の非キー属性間の従属関係(推移的関数従属)を解消し、テーブルを分割する正規化の段階として正しいものはどれか。

正解は「第三正規化」である。第一正規化は繰り返し項目をなくし、ひとつのセルにひとつの値だけを入れる段階であり、第二正規化は主キーの一部だけに依存する属性を分離する段階である。第三正規化では、これらとは異なり、非キー属性同士の推移的関数従属を解消し、更新時の不整合を起こしにくいテーブル構造にする。「ER図作成」はテーブル同士の関係を図として表す作業であり、テーブル内の属性間の従属関係を解消して分割するという正規化の段階そのものではない。設問は非キー属性間の従属関係を対象とする段階を問うており、主キーへの依存や繰り返し項目を対象とする他の段階とは解消する従属関係の種類が異なる。

第6章 データエンジニアリング基礎 / データ構造・蓄積

非キー属性が別の非キー属性に依存するテーブルを分割した。到達する正規形はどれか。

非キー属性が別の非キー属性に依存する関係を分割したので、到達した段階は第三正規化にあたる。正解は「第三正規化」である。第三正規化は、非キー属性どうしの従属関係である推移的関数従属を解消してテーブルを分割する。「第一正規化」は繰り返し項目をなくす段階、「第二正規化」は主キーの一部だけに依存する属性を分離する段階であり、扱う従属関係の種類が異なる。「UNION処理」は表の行を縦にまとめる操作で、正規化の段階ではない。したがって、設問の事例が到達する正規形は第三正規形である。

第6章 データエンジニアリング基礎 / データ構造・蓄積

1つのセルに複数の商品名をカンマで区切って入れていたテーブルを、繰り返し項目をなくし、1つのセルに1つの値だけを入れる形に直した。この段階はどれか。

1つのセルに複数の値が入っている状態を直したので、繰り返し項目をなくす段階が問われている。正解は「第一正規化」である。第一正規化は、繰り返し項目をなくし、1つのセルに1つの値だけを入れる段階である。「第三正規化」は非キー属性どうしの依存を解消する段階で、この事例の直し方より先の段階にあたる。「ER図作成」はテーブルどうしの関係を図で表す作業、「UNION処理」は表の行を縦にまとめる操作であり、どちらも正規化の段階ではない。したがって、設問の段階は第一正規化である。

同じ章で確認したい用語

到達チェック

  • 正規化を一文で説明できる
  • 同じ章の似た用語と違いを説明できる
  • 問題文の具体例から、正規化に関係する論点を拾える
  • 関連問題を解き、誤答した選択肢の理由を確認できる

執筆: ミナト編集部(運営者情報を見る)