DS検定 用語解説
Dockerとは
アプリケーションと実行に必要な環境をコンテナとしてまとめて扱う技術。
この記事の目次
まず押さえる結論
Dockerは、DS検定の「第6章 データエンジニアリング基礎」で確認しておきたい用語です。定義だけでなく、どの場面で使う言葉か、何と混同しやすいか、問題文のどの表現で判断するかまで確認します。
情報源と編集区分
公式範囲を確認し、具体例・誤答例・判断手順は当サイトが編集。 一次情報確認日: 2026-07-12。
試験概要(公式)試験での問われ方
定義の言い換え
用語そのものではなく、説明文の一部を言い換えて出されることがあります。
似た概念との比較
同じ章の用語と入れ替えた選択肢に注意します。対象、目的、使う場面を分けます。
具体例からの判断
問題文の事例が、定義のどの部分に対応しているかを先に確認します。
誤答しやすいポイント
×構造化データと非構造化データの判断基準を誤る。テキスト・音声・画像・動画のような雑多な形式か、テーブル形式で管理できるかで区別する。
×第一正規化から第三正規化までの段階を混同する。各段階でどの種類の重複・従属関係を解消するのかが異なる。
×内部結合・外部結合・自己結合の使い分けを誤る。条件に一致しない行を残すかどうかで結合方式が変わる。
関連する確認問題
第6章 データエンジニアリング基礎 / 環境構築・データ収集
クラウド上で機械学習の分析環境を使いたいが、サーバーなどのインフラを自社で構築・運用する負担は抑えたい。クラウド事業者がその運用を代行するサービスはどれか。
正解は「クラウドマネージドサービス」である。設問は、分析環境を使いたいがインフラの構築・運用は自社で抱えたくないという要望に応えるサービスを尋ねている。この条件に合うのはクラウドマネージドサービスで、Dockerはアプリケーションを動かすためのコンテナ技術、SDKは開発に使う道具一式、Webクローラーはページを巡回して情報を集めるプログラムであり、いずれもインフラの運用を代行する主体ではない。何を作るための道具かではなく、誰がインフラ運用の手間を負うのかを基準に見分ける。
第6章 データエンジニアリング基礎 / データ構造・蓄積
分散処理基盤を選ぶ際、大量データをメモリ上で処理して高速な分散処理を行うエンジンとして最も適切なものはどれか。
正解は「Spark」である。設問は、大量のデータをメモリ上で処理することで高速化する分散処理エンジンを尋ねている。この条件に合うのはSparkで、Hadoopも分散処理基盤だが複数サーバーへ分散して蓄積・処理する点が特徴でありメモリ処理を前面に出す語ではない。Dockerはコンテナ技術、SFTPはファイル転送の方式であり、どちらも分散処理エンジンではない。分散処理という共通点だけで決めず、メモリ上で処理して高速化するという特徴まで一致するかを確認して見分ける。
第6章 データエンジニアリング基礎 / 環境構築・データ収集
既存のDockerイメージを活用して分析環境を効率的に構築する際に理解しておくべき技術として正しいものはどれか。
正解は「コンテナ技術」である。Dockerイメージを使うと、ライブラリや実行環境をまとめたコンテナを再現でき、分析環境を効率よく構築しやすい。「分散技術」は複数のサーバーにデータや処理を分けて扱う技術であり、単一のDockerイメージで実行環境を再現する話とは対象とする技術領域が異なる。「正規表現」は文字列のパターンを表現し検索・置換に使う技術であり、「暗号化技術」は情報を第三者に読めない形に変換する技術であって、いずれもDockerイメージを使った分析環境の構築という設問の目的とは異なる役割を持つ。
同じ章で確認したい用語
他資格でも出題される用語
到達チェック
- Dockerを一文で説明できる
- 同じ章の似た用語と違いを説明できる
- 問題文の具体例から、Dockerに関係する論点を拾える
- 関連問題を解き、誤答した選択肢の理由を確認できる
執筆: ミナト編集部(運営者情報を見る)