AI資格ドリル
資格を選ぶ↓

G検定 大項目8 AIに必要な数理・統計知識 予想問題と解説

G検定「大項目8 AIに必要な数理・統計知識」の予想問題を52問収録しています。このページでは代表39問を解説つきで掲載し、全問は演習画面で解けます。公式シラバスの範囲で作成しています。

この章の要点

確率・統計・線形代数・微分などを扱う分野です。全52問(基礎9問・標準20問・応用23問)を収録しています。

  • 確率・統計
  • 線形代数・微分

情報源と編集区分

公式範囲を確認し、問題数・難易度・確認点は当サイトが集計・編集。 一次情報確認日: 2026-07-03。

試験概要(公式)

確認しておきたいポイント

当サイトの作問時に観察した、取り違えやすい論点です(公式の統計ではありません)。

  • 相関と因果の取り違え(相関があっても因果とは限らない。第3の要因=交絡に注意)。
  • ベイズの定理(事前確率を観測で更新する)の理解。
  • 正規分布の性質(左右対称・釣鐘型・平均と標準偏差の2パラメータ)と他の概念の混同。

この章の関連用語

この分野の問題で扱う用語です。意味があいまいなものは、用語集で定義を確認できます。

よくある質問

Q大項目8 AIに必要な数理・統計知識は何問収録されていますか?

A

現在52問を収録しています。内訳は基礎9問・標準20問・応用23問です。

Q大項目8 AIに必要な数理・統計知識の頻出論点は何ですか?

A

確率・統計・線形代数・微分などが出題対象です(当サイト収録問題に基づく編集部集計)。

Q間違えた問題はどう復習すればいいですか?

A

誤答した選択肢のどこがずれていたかを解説で確認し、関連用語がある場合は用語集で定義に戻ってから再演習することをおすすめします。

第1問 ・ 確率・統計

データのばらつきの大きさを表す指標のうち、各データと平均との差を2乗して平均した値の正の平方根として定義される量はどれか。

  • ア分散
  • イ期待値
  • ウ標準偏差
  • エ条件付き確率
答えと解説を見る
ウ標準偏差正解
解説

正解は「標準偏差」である。各データと平均との差(偏差)を2乗して平均した値が分散であり、その正の平方根が標準偏差である。標準偏差は分散と同じくばらつきの大きさを表すが、平方根をとることで元のデータと同じ単位で解釈できる点で分散と使い分けられる。分散はこの定義における平方根をとる前の値であるため、「2乗して平均した値の正の平方根」という条件には合わない。期待値は起こりうる値をその起こりやすさで重み付けした平均的な値であり、ばらつきではなく代表値を表す。条件付き確率はある事象が起きた前提での別の事象の起こりやすさであり、データのばらつきの指標ではない。

https://www.jdla.org/certificate/general/ (大項目8 AIに必要な数理・統計知識)

問題番号: g8-002
問題番号 g8-002 の誤りを報告する
第2問 ・ 確率・統計

設定した仮説が正しいと仮定したとき、観測された結果と同等以上に極端なことが偶然得られる確率を表し、値が小さいほどその仮説は支持されにくいと判断するために用いる指標はどれか。

  • ア期待値
  • イ条件付き確率
  • ウp値
  • エ標準偏差
答えと解説を見る
ウp値正解
解説

正解は「p値」である。p値は、設定した仮説(帰無仮説)が正しいと仮定したときに、観測された結果と同等以上に極端な結果が偶然得られる確率を表し、統計的仮説検定において値が小さいほど仮説が支持されにくい(棄却されやすい)と判断する材料になる。期待値は起こりうる結果をその起こりやすさで重み付けした平均的な見込み値、標準偏差はデータのばらつきの大きさを表す量であり、いずれも仮説の妥当性を判断する確率ではない。条件付き確率はある事象が起きたという前提のもとで別の事象が起こる確率であり、仮説を前提とした極端さの確率という設問の定義とは対象が異なる。

https://www.jdla.org/certificate/general/ (大項目8 AIに必要な数理・統計知識)

問題番号: g8-005
問題番号 g8-005 の誤りを報告する
第3問 ・ 線形代数・微分

複数の関数が入れ子になった合成関数を微分するとき、外側の関数の微分と内側の関数の微分を掛け合わせて全体の微分を求める計算規則を指す用語はどれか。

  • ア内積
  • イ偏微分
  • ウ固有値
  • エ連鎖律
答えと解説を見る
エ連鎖律正解
解説

正解は「連鎖律」である。連鎖律は、複数の関数が入れ子になった合成関数を微分する際に、外側の関数の微分と内側の関数の微分を掛け合わせて全体の微分を求める計算規則であり、ニューラルネットワークの誤差逆伝播法で層をまたいで勾配を伝える基礎となる。内積は2つのベクトルからスカラーを求める演算であり、合成関数の微分規則ではない。偏微分は多変数関数で1つの変数についてだけ変化の割合を求める操作であって、外側と内側の微分を掛け合わせる規則そのものではない。固有値は正方行列を掛けたときの長さの倍率を表すスカラーであり、微分の計算規則とは無関係である。

https://www.jdla.org/certificate/general/ (大項目8 AIに必要な数理・統計知識)

問題番号: g8-008
問題番号 g8-008 の誤りを報告する
第4問 ・ 確率・統計

くじやサイコロのように結果が偶然で決まる試行について、起こりうる各結果の値に、それぞれの起こりやすさを重みとして掛けて合計した、長い目で見たときに見込まれる平均的な値を表すものはどれか。

  • ア正規分布
  • イ標準偏差
  • ウ期待値
  • エ確率
答えと解説を見る
ウ期待値正解
解説

正解は「期待値」である。期待値は、くじやサイコロのように結果が偶然で決まる試行について、起こりうる各結果の値をその起こりやすさで重み付けして合計した値であり、試行を多数回繰り返したときに長い目で見て見込まれる平均的な値を表す。標準偏差はデータが平均からどれだけ散らばっているかを示すばらつきの指標、正規分布は平均を中心に左右対称に広がる分布であり、いずれも重み付き平均としての見込み値ではない。確率は1つの事柄が起こりやすいかどうかの度合いを表す値そのものであり、各結果の値を重みで合計した平均的な値を表す期待値とは対象が異なる。

https://www.jdla.org/certificate/general/ (大項目8 AIに必要な数理・統計知識)

問題番号: g8-023
問題番号 g8-023 の誤りを報告する
第5問 ・ 確率・統計

赤い玉と白い玉が入った袋から玉を1つ取り出し、それが赤い玉だと確認できた。このように、ある事柄がすでに起きたとわかっている状況に限定したうえで、さらに別の事柄が起こる見込みを数値で表したものはどれか。

  • ア統計的仮説検定
  • イベイズの定理
  • ウ期待値
  • エ条件付き確率
答えと解説を見る
エ条件付き確率正解
解説

正解は「条件付き確率」である。条件付き確率は、ある事象がすでに起きたとわかっている状況に限定したうえで、さらに別の事象が起こる見込みを数値で表したものであり、設問の「赤い玉だと確認できた状況で別の事柄が起こる見込み」はこの定義に対応する。ベイズの定理はこの条件付き確率を用いて事前に見積もった確率を観測結果で事後の確率へ更新する関係式であり、確率の値そのものではなく更新の手続きを表す。期待値は起こりうる各結果をその起こりやすさで重み付けした平均的な値、統計的仮説検定は仮説とデータの食い違いを確率的に調べる手続きであり、いずれも「事象が起きたとわかっている前提での別の事象の確率」そのものを指す語ではない。

https://www.jdla.org/certificate/general/ (大項目8 AIに必要な数理・統計知識)

問題番号: g8-024
問題番号 g8-024 の誤りを報告する
第6問 ・ 線形代数・微分

2つ以上の変数を持つ関数について、注目する1つの変数以外をすべて定数とみなし、その変数の変化に対する関数の変化の割合だけを求める操作はどれか。

  • ア微分
  • イ連鎖律
  • ウ偏微分
  • エ勾配
答えと解説を見る
ウ偏微分正解
解説

正解は「偏微分」である。偏微分は、2つ以上の変数を持つ関数について注目する1つの変数以外をすべて定数とみなし、その変数の変化に対する関数の変化の割合だけを求める操作であり、勾配を構成する各成分を求める計算にあたる。微分は1つの変数だけを持つ関数についての変化の割合を求める操作であり、複数変数のうち他を固定するという条件を含まない。連鎖律は合成関数を微分するときに各段階の微分を掛け合わせる規則、勾配は各変数についての偏微分を成分として並べたベクトルであり、いずれも「他の変数を固定して1変数だけの変化率を求める操作」そのものではない。

https://www.jdla.org/certificate/general/ (大項目8 AIに必要な数理・統計知識)

問題番号: g8-026
問題番号 g8-026 の誤りを報告する
第7問 ・ 線形代数・微分

多変数関数のある点において、その値を最も急激に増加させる方向と、その増加の急さとを同時に表すものはどれか。ディープラーニングではこれを手がかりにパラメータを少しずつ更新して損失を小さくしていく。

  • ア固有値
  • イ行列
  • ウ連鎖律
  • エ勾配
答えと解説を見る
エ勾配正解
解説

正解は「勾配」である。勾配は、多変数関数の各変数についての偏微分を成分とするベクトルであり、ある点においてその関数の値を最も急激に増加させる方向と増加の急さを同時に表す。ディープラーニングでは、この勾配の逆向きにパラメータを少しずつ更新して損失を小さくする。固有値は正方行列を掛けたときに固有ベクトルの長さが何倍になるかを表す倍率であり、増加方向を示す量ではない。行列は数値を縦横に並べた対象そのものであり、方向や急さを表す量ではない。連鎖律は合成関数を微分するときに各段階の微分を掛け合わせる規則であり、関数を最も急に増加させる方向を求める計算そのものではない。

https://www.jdla.org/certificate/general/ (大項目8 AIに必要な数理・統計知識)

問題番号: g8-027
問題番号 g8-027 の誤りを報告する
第8問 ・ 線形代数・微分

大きさ(長さ)と向きの両方を持ち、複数の数値を順序づけて一列に並べて表す量で、機械学習では1件のデータが持つ複数の特徴量をまとめて表現するのに用いられる基本的な数学的対象はどれか。

  • ア微分
  • イベクトル
  • ウ行列
  • エ内積
答えと解説を見る
イベクトル正解
解説

ベクトルを選ぶ判断軸は、複数の数値をまとめて表す対象そのものを答えているか、対象に対して行う計算・操作を答えているかという点にある。ベクトルは大きさと向きを持ち、数値を一列に並べて機械学習の特徴量をひとまとめに表す土台になる。他の選択肢はこの土台とは種類が異なる。行列は同じく数値の集合だが並べ方が一列ではなく縦横の格子状(2次元)である点で次元が違い、内積と微分はいずれも何らかの対象に対して行う演算・操作であって、対象そのものを表す量ではない。

https://www.jdla.org/certificate/general/ (大項目8 AIに必要な数理・統計知識)

問題番号: g8-028
問題番号 g8-028 の誤りを報告する
第9問 ・ 確率・統計

平均を中心として左右対称の釣鐘型(ベル型)をなし、多くの自然現象や測定誤差の分布の近似に広く用いられる連続確率分布はどれか。

  • ア一様分布
  • イ二項分布
  • ウ正規分布
  • エ指数分布
答えと解説を見る
ウ正規分布正解
解説

正解は「正規分布」である。設問が求めているのは、平均を中心に左右対称の釣鐘型をなす連続確率分布で、自然現象や測定誤差の近似によく使われるという性質である。一様分布はすべての値が等しい確率で生じる分布、二項分布は試行を繰り返した際の成功回数を表す離散分布、指数分布は事象の発生間隔を表す分布であり、いずれも左右対称の釣鐘型という形の条件に当てはまらない。分布の形が釣鐘型で左右対称かどうかという観点で選択肢を見比べると、この対称性を満たすのは正規分布だけだと分かる。

https://www.jdla.org/certificate/general/ / G検定シラバス2024(第1.4版・2026-07-05照合)

問題番号: g8-101
問題番号 g8-101 の誤りを報告する
第10問 ・ 確率・統計

各データと平均との差を2乗して平均した値で、データのばらつきの大きさを表す指標はどれか。なお、この値の正の平方根が標準偏差である。

  • ア中央値
  • イ最頻値
  • ウ分散
  • エ範囲
答えと解説を見る
ウ分散正解
解説

正解は「分散」である。各データと平均との差を2乗して平均した値を分散といい、データのばらつきの大きさを表す。分散の正の平方根が標準偏差である。中央値はデータを大小順に並べた中央の値、最頻値は最も多く現れる値、範囲は最大値と最小値の差であり、いずれもばらつきを2乗平均で表す指標ではない。 選択肢ごとの差は次のように整理できる。「中央値」は誤答側で、誤答。「中央値」はデータを大小順に並べたときの中央に位置する値であり、平均との差を2乗して平均するという分散の計算方法とは異なる代表値を表す。「最頻値」は誤答側で、誤答。「最頻値」はデータの中で最も多く現れる値であり、ばらつきではなく出現頻度を表す指標である点で分散とは異なる。「分散」は正解側で、正解。「分散」は各データと平均との差を2乗して平均した値であり、データのばらつきの大きさを表す。正の平方根が標準偏差になる。「範囲」は誤答側で、誤答。「範囲」は最大値と最小値の差であり、両端の値だけで決まる。平均との差を2乗して平均するという分散の計算方法とは異なる。

https://www.jdla.org/certificate/general/ / G検定シラバス2024(第1.4版・2026-07-05照合)

問題番号: g8-102
問題番号 g8-102 の誤りを報告する
第11問 ・ 線形代数・微分

ある関数の、ある点における瞬間的な変化の割合(接線の傾き)を求める操作を何というか。

  • ア積分
  • イ内積
  • ウ微分
  • エ転置
答えと解説を見る
ウ微分正解
解説

微分を選ぶ判断軸は、値の変化そのものを求める操作か、既知の値から別の量を導く操作かという点にある。微分はある関数のある点における瞬間的な変化の割合、すなわち接線の傾きを求める操作であり、ディープラーニングでは損失関数を微分して得られる勾配を手がかりにパラメータを更新する。これに対し積分は面積などを求める操作で微分とは逆の関係にあり、内積は2つのベクトルの成分どうしを掛け合わせて総和をとる演算、転置は行列の行と列を入れ替える操作であって、いずれも瞬間的な変化の割合そのものを求めているわけではない。

https://www.jdla.org/certificate/general/

問題番号: g8-107
問題番号 g8-107 の誤りを報告する
第12問 ・ 確率・統計

確率変数が平均からどれくらい散らばっているかを二乗平均で表す量はどれか。

  • ア分散
  • イ期待値
  • ウp値
  • エ相関と因果
答えと解説を見る
ア分散正解
解説

正解は「分散」である。分散は、値が平均からどれくらい散らばっているかを二乗した偏差の平均として表す量である。期待値は平均的な値、p値は仮説検定で観測結果以上に極端な結果が出る確率に関わる指標、相関と因果は変数間の関係の見分け方に関する論点である。 選択肢ごとの差は次のように整理できる。「分散」は正解側で、正解。「分散」は、確率変数が平均からどれくらい散らばっているかを、偏差を2乗して平均した二乗平均で表す量である。「期待値」は誤答側で、誤答。「期待値」は確率変数がとる値の平均的な水準を表す量であり、平均からの散らばりの大きさを偏差の二乗平均で表す分散のような量ではない。「p値」は誤答側で、誤答。「p値」は仮説検定で観測結果以上に極端な結果が出る確率に関わる指標であり、散らばりの大きさを表す量ではない。「相関と因果」は誤答側で、誤答。「相関と因果」は2つの変数の間に見られる関係をどう解釈するかという論点であり、確率変数が平均からどれくらい散らばっているかを表す量そのものではない。

https://www.jdla.org/certificate/general/

問題番号: g8-109
問題番号 g8-109 の誤りを報告する
第13問 ・ 確率・統計

2つの変数に相関がみられても、実際には両方に影響する第三の変数(交絡因子)が背景にあるなどの理由で、直接の因果関係を示すとは限らない状態を何というか。

  • ア疑似相関
  • イ偏相関係数
  • ウ共分散
  • エ相関係数
答えと解説を見る
ア疑似相関正解
解説

疑似相関を正解として選べるかどうかは、2変数の関係を測る「指標」の話をしているのか、指標だけでは見抜けない「見かけ上の関係という現象」の話をしているのかで分かれる。共分散は各変数の平均との差の積を合計して求める指標で、符号によって2変数が同じ方向に動くか逆方向に動くかを表し、相関係数はその関係の強さを表す指標、偏相関係数は第三の変数の影響を除いたうえで測る指標である。これらはいずれも疑似相関を見分けるための道具であり、交絡因子によって生じる見かけ上の関係そのものを言い表す語ではない。

https://www.jdla.org/certificate/general/

問題番号: g8-110
問題番号 g8-110 の誤りを報告する
第14問 ・ 線形代数・微分

ニューラルネットワークの重み更新で、損失関数をどちらの方向に動かすと増減するかを表すベクトル量はどれか。

  • ア勾配
  • イ内積
  • ウ固有値・固有ベクトル
  • エ行列
答えと解説を見る
ア勾配正解
解説

勾配という答えにたどり着く決め手は、関数の値がどの方向にどれだけ変化するかを一括りに表すベクトル量を答えているかという点にある。勾配は、各変数についての偏微分を成分とするベクトルであり、ある点でその関数の値を最も急激に増加させる方向と増加の急さを同時に表す。ディープラーニングではこの勾配の逆向きにパラメータを少しずつ動かして損失を小さくする。内積・固有値固有ベクトル・行列は、いずれもベクトルの積、線形変換の性質、数値を並べた対象そのものを表す語であり、変化の方向と大きさを一括りに表す勾配とは役割が異なる。

https://www.jdla.org/certificate/general/

問題番号: g8-111
問題番号 g8-111 の誤りを報告する
第15問 ・ 確率・統計

ある事象Bが起きたという条件のもとで、事象Aが起きる確率を扱う考え方はどれか。

  • ア条件付き確率
  • イ期待値
  • ウ標準偏差
  • エ統計的仮説検定
答えと解説を見る
ア条件付き確率正解
解説

正解は「条件付き確率」である。ここで問われているのは、事象Bの発生を前提として、その範囲内で事象Aがどれだけ起こりやすいかを見積もる考え方であり、全体を対象にする通常の確率とは土台が異なる。期待値は確率変数の平均的な水準、標準偏差は散らばりの大きさ、統計的仮説検定は観測データと仮説の整合性を判断する枠組みであり、いずれも「前提となる事象で絞り込んだ確率」そのものを表す考え方ではない。母集団全体を対象に確率を考えるか、条件を満たす部分に絞って考え直すかという視点の違いに注目すると判別しやすい。

https://www.jdla.org/certificate/general/

問題番号: g8-112
問題番号 g8-112 の誤りを報告する
第16問 ・ 線形代数・微分

複数の数を縦や横に並べ、特徴量や重みをまとめて扱うときに使う数学的な表現はどれか。

  • アベクトル
  • イp値
  • ウ正規分布
  • エ期待値
答えと解説を見る
アベクトル正解
解説

この設問は、複数の数値をひとまとまりに並べて扱う「対象」を答えさせているのか、統計的な推測や分布に関わる「値・概念」を答えさせているのかを見分けさせている。ベクトルは複数の数値を順序づけて並べた量であり、特徴量や重みを一括で扱うときの表現の土台になる点で、行列と並ぶ線形代数の基本的な対象の一つである。p値・正規分布・期待値は、いずれも仮説検定や確率分布に関わる値・概念であって、数値をひとまとめに並べる表現そのものではなく、ベクトルとは答えている階層が異なる。

https://www.jdla.org/certificate/general/

問題番号: g8-114
問題番号 g8-114 の誤りを報告する
第17問 ・ 線形代数・微分

行列や線形変換の性質を表す量で、主成分分析などを理解する前提にもなるものはどれか。

  • ア固有値・固有ベクトル
  • イ内積
  • ウ連鎖律
  • エ偏微分
答えと解説を見る
ア固有値・固有ベクトル正解
解説

固有値・固有ベクトルを選ぶ根拠は、行列や線形変換そのものが持つ性質を答えているか、行列やベクトルに対して行う計算・操作を答えているかにある。固有値は正方行列を掛けたときに固有ベクトルの長さが何倍になるかを表す倍率(スカラー)であり、固有値・固有ベクトルの組は主成分分析でデータの分散が最大になる方向を求める際の前提になる。内積・連鎖律・偏微分はいずれもベクトルや関数に対して行う計算であり、行列や線形変換そのものが持つ性質を表す概念ではない。

https://www.jdla.org/certificate/general/

問題番号: g8-115
問題番号 g8-115 の誤りを報告する
第18問 ・ 確率・統計

平均を中心に左右対称の釣鐘型になり、多くの統計モデルで基本となる確率分布はどれか。

  • ア正規分布
  • イベイズの定理
  • ウp値
  • エ相関と因果
答えと解説を見る
ア正規分布正解
解説

正解は「正規分布」である。正規分布は平均を中心に左右対称の釣鐘型となる代表的な確率分布で、統計や機械学習の基礎としてよく扱われ、多くの自然現象や測定誤差の近似にも用いられる。分布の広がり方は標準偏差の大きさで決まり、平均から離れるほど出現確率が小さくなる点が特徴である。ベイズの定理は新たな情報をもとに確率を更新する考え方、p値は仮説検定で使う指標、相関と因果は変数間の関係をどう解釈するかという論点であり、いずれも左右対称の釣鐘型をなす確率分布そのものを指す語ではない。

https://www.jdla.org/certificate/general/

問題番号: g8-116
問題番号 g8-116 の誤りを報告する
第19問 ・ 確率・統計

統計的仮説検定で、帰無仮説が正しいと仮定したときに、観測結果以上に極端な結果が得られる確率に関係する指標はどれか。

  • アp値
  • イ期待値
  • ウ標準偏差
  • エ条件付き確率
答えと解説を見る
アp値正解
解説

正解は「p値」である。p値は、帰無仮説が正しいと仮定したとき、観測結果以上に極端な結果が得られる確率に関係する指標で、統計的仮説検定において帰無仮説を棄却するかどうかの判断材料として使われる。p値があらかじめ定めた基準を下回れば、帰無仮説を棄却して対立仮説を採用する判断につながる。期待値は確率変数の平均的な値、標準偏差はデータの散らばりの大きさ、条件付き確率はある事象を前提とした確率であり、いずれも帰無仮説のもとでの極端さの確率を表すp値とは異なる指標である。

https://www.jdla.org/certificate/general/

問題番号: g8-117
問題番号 g8-117 の誤りを報告する
第20問 ・ 線形代数・微分

数値を行と列に並べた表現で、画像データや重みの計算などをまとめて扱うときに使われるものはどれか。

  • ア行列
  • イベクトル
  • ウ偏微分
  • エ連鎖律
答えと解説を見る
ア行列正解
解説

正解は「行列」である。行列は数値を行と列に並べた表現で、画像データやニューラルネットワークの重み計算などをまとめて扱うときに使われ、複数のベクトルをまとめて表す土台にもなる。ニューラルネットワークの各層の重みも行列としてまとめて保持され、入力ベクトルとの積で次の層の値が計算される。ベクトルは数値を1列(または1行)に並べた量、偏微分は複数変数関数を一つの変数で微分する操作、連鎖律は合成関数の微分法則であり、いずれも数値を行と列にまとめて並べる表現である行列とは異なる。

https://www.jdla.org/certificate/general/

問題番号: g8-118
問題番号 g8-118 の誤りを報告する
第21問 ・ 線形代数・微分

合成関数を微分するときに使われ、誤差逆伝播法の理解にも関係する微分の法則はどれか。

  • ア連鎖律
  • イ内積
  • ウ固有値・固有ベクトル
  • エ標準偏差
答えと解説を見る
ア連鎖律正解
解説

連鎖律を答えに選ぶには、合成関数を微分する際の計算規則そのものを答えているかを見極める必要がある。連鎖律は、合成関数の微分を外側の関数の微分と内側の関数の微分の積として求める規則で、誤差逆伝播法において層をまたいで勾配を伝える計算の基礎になる。内積・固有値固有ベクトル・標準偏差は、いずれもベクトルの積、行列や線形変換の性質、データの散らばりという別の対象を表す語であり、微分の計算規則そのものを表す語ではないという点で、連鎖律とは答えるべき階層が異なる。

https://www.jdla.org/certificate/general/

問題番号: g8-119
問題番号 g8-119 の誤りを報告する
第22問 ・ 確率・統計

ベクトルやデータ間の距離・類似度を測る指標に関する次の説明のうち、誤っているものはどれか。

  • アコサイン類似度とは、2つのベクトルの向き(角度)の近さを測る指標であり、ベクトルの大きさの違いを無視して計算される
  • イユークリッド距離とは、2点間を直線で結んだときの最短距離を測る指標である
  • ウマハラノビス距離とは、データの相関やばらつき方を考慮せず、単純な直線距離だけで2点間の近さを測る指標である
  • エ相関係数とは、2つの量的変数の直線的な関係の強さと向きを表す指標である
答えと解説を見る
ウマハラノビス距離とは、データの相関やばらつき方を考慮せず、単純な直線距離だけで2点間の近さを測る指標である正解
解説

正解は「マハラノビス距離とは、データの相関やばらつき方を考慮せず、単純な直線距離だけで2点間の近さを測る指標である」(誤り)である。マハラノビス距離は、各変数の分散や変数間の相関(共分散)を考慮し、データ全体のばらつき方に応じて距離を測る指標であり、単純な直線距離のみを測るものではない。コサイン類似度・ユークリッド距離・相関係数の説明はいずれも正しい。データの分布を無視するか考慮するかが、ユークリッド距離とマハラノビス距離を区別する最大のポイントである。

https://www.jdla.org/certificate/general/

問題番号: g8-120
問題番号 g8-120 の誤りを報告する
第23問 ・ 確率・統計

確率分布に関する次の説明のうち、誤っているものはどれか。

  • アベルヌーイ分布とは、成功か失敗かという2択の結果を持つ、1回だけの試行についての確率分布である
  • イ二項分布とは、成功する確率が一定の試行をn回繰り返したときに、成功した回数が従う確率分布である
  • ウポアソン分布とは、成功する確率が一定の試行をn回繰り返したときに、成功した回数が従う確率分布である
  • エ正規分布とは、平均を中心として左右対称の釣鐘型をなす、連続型の確率分布である
答えと解説を見る
ウポアソン分布とは、成功する確率が一定の試行をn回繰り返したときに、成功した回数が従う確率分布である正解
解説

正解は「ポアソン分布とは、成功する確率が一定の試行をn回繰り返したときに、成功した回数が従う確率分布である」(誤り)である。この説明は二項分布の定義であり、ポアソン分布は一定期間・一定区間に稀な事象が発生する回数が従う確率分布で、平均発生回数のみによって形が決まる。試行回数と成功確率という2つのパラメータで形が決まる二項分布とは、パラメータの数が異なる。ベルヌーイ分布・二項分布・正規分布の説明はいずれも正しい。ベルヌーイ分布を同じ条件でn回繰り返すと二項分布になり、二項分布は試行回数が大きく成功確率が小さい極限でポアソン分布に近づくという関係がある。

https://www.jdla.org/certificate/general/

問題番号: g8-121
問題番号 g8-121 の誤りを報告する
第24問 ・ 確率・統計

モデルのパラメータを推定する手法に関する次の説明のうち、誤っているものはどれか。

  • ア最小二乗法とは、実際のデータとモデルによる予測値との誤差(残差)の二乗和が最小になるようにパラメータを決める方法である
  • イ最尤法とは、実際のデータとモデルによる予測値との誤差(残差)の二乗和が最小になるようにパラメータを決める方法である
  • ウ最尤法とは、観測されたデータが得られる確率(尤度)が最大になるようにパラメータを決める方法である
  • エ母集団の分布に正規分布を仮定した場合、最小二乗法と最尤法は同じ推定結果を導くことが知られている
答えと解説を見る
イ最尤法とは、実際のデータとモデルによる予測値との誤差(残差)の二乗和が最小になるようにパラメータを決める方法である正解
解説

正解は「最尤法とは、実際のデータとモデルによる予測値との誤差(残差)の二乗和が最小になるようにパラメータを決める方法である」(誤り)である。この説明は最小二乗法の定義であり、最尤法は観測されたデータが得られる確率(尤度)が最大になるようにパラメータを決める方法である。両者は出発点となる基準が異なる推定方法だが、母集団の分布に正規分布を仮定すると同じ推定結果を導くことが知られている。最小二乗法・最尤法(尤度の定義)・両者の関係の説明はいずれも正しい。

https://www.jdla.org/certificate/general/

問題番号: g8-122
問題番号 g8-122 の誤りを報告する
第25問 ・ 確率・統計

データの分布や依存関係を扱う統計の概念に関する次の説明のうち、誤っているものはどれか。

  • ア度数分布とは、データをいくつかの階級(区間)に分け、各階級に含まれるデータの個数(度数)を示したものである
  • イ確率密度関数とは、連続型の確率変数について、度数分布表の階級幅を限りなく細かくしたときに相対度数のグラフが近づく、理論上の分布を表す関数である
  • ウ外れ値とは、他の値から大きく外れた値を指し、測定ミスなどによる異常値とは概念上異なるが、実用上は明確に区別できる
  • エ相互情報量とは、2つの確率変数がどれだけ互いに依存しているかを表す尺度である
答えと解説を見る
ウ外れ値とは、他の値から大きく外れた値を指し、測定ミスなどによる異常値とは概念上異なるが、実用上は明確に区別できる正解
解説

正解は「外れ値とは、他の値から大きく外れた値を指し、測定ミスなどによる異常値とは概念上異なるが、実用上は明確に区別できる」(誤り)である。外れ値は他の値から大きく外れた値を指し、測定ミス等に起因する異常値とは概念的には異なるものの、実用上は両者を明確に区別できないことも多い。設問は「実用上は明確に区別できる」としている点で事実と逆である。度数分布・確率密度関数・相互情報量の説明はいずれも正しい。度数分布と確率密度関数は、離散的な区間で数えるか連続的な関数で表すかという点で対応関係にある概念である。

https://www.jdla.org/certificate/general/

問題番号: g8-123
問題番号 g8-123 の誤りを報告する
第26問 ・ 確率・統計

統計的仮説検定における「帰無仮説」と「対立仮説」の関係を説明したものとして、最も適切なものはどれか。

  • ア帰無仮説は棄却されるかどうかを判断する対象として立てる「差がない」などとする仮説であり、対立仮説は帰無仮説が棄却されたときに採択される、主張したい内容を表す仮説である
  • イ帰無仮説と対立仮説は同じ内容を指す言い換えであり、検定の過程でどちらの語を使っても結果は変わらない
  • ウ対立仮説は検定を行う前に必ず正しいと証明されている仮説であり、帰無仮説は検定によって初めて立てられる仮説である
  • エ帰無仮説は主張したい内容を表す仮説であり、対立仮説は棄却されるかどうかを判断する対象として立てる仮説である
答えと解説を見る
ア帰無仮説は棄却されるかどうかを判断する対象として立てる「差がない」などとする仮説であり、対立仮説は帰無仮説が棄却されたときに採択される、主張したい内容を表す仮説である正解
解説

正解は「帰無仮説は棄却されるかどうかを判断する対象として立てる『差がない』などとする仮説であり、対立仮説は帰無仮説が棄却されたときに採択される、主張したい内容を表す仮説である」である。統計的仮説検定では、まず「差がない」「効果がない」などとする帰無仮説を立て、観測データがこの帰無仮説のもとでは起こりにくいと判断できた場合に帰無仮説を棄却し、主張したい内容を表す対立仮説を採択する。同じ内容の言い換えとする説明、対立仮説が事前に証明済みとする説明、両者の役割を入れ替えた説明は、いずれも仮説検定の手続きと一致しない。

https://www.jdla.org/certificate/general/

問題番号: g8-124
問題番号 g8-124 の誤りを報告する
第27問 ・ 確率・統計

2つの変数について、それぞれの平均からの偏差の積を集計し、同じ方向または逆方向に変動する傾向を表す量はどれか。

  • ア共分散
  • イ相関係数
  • ウ分散
  • エ相互情報量
答えと解説を見る
ア共分散正解
解説

正解は「共分散」である。標本共分散は、2つの変数について各観測値とそれぞれの平均との差を求め、その積を合計して標本サイズから1を引いた値で割ることで計算する。両方が平均より大きい、または両方が小さい観測が多ければ正になりやすく、一方が大きいとき他方が小さい観測が多ければ負になりやすい。相関係数は共分散を各変数の標準偏差で調整し、尺度の影響を除いて関係の強さを表す。分散は1つの変数のばらつきであり、相互情報量は確率変数間の依存関係を情報量として捉える量である。

https://www.itl.nist.gov/div898/handbook/pmc/section5/pmc541.htm

問題番号: g8-125
問題番号 g8-125 の誤りを報告する
第28問 ・ 確率・統計

データを昇順に並べたとき、ちょうど中央に位置する値(データ数が偶数の場合は中央2つの平均)を何と呼ぶか。

  • ア中央値
  • イ平均
  • ウ最頻値
  • エ標準偏差
答えと解説を見る
ア中央値正解
解説

中央値を選ぶ視点は、データを順に並べたときの「位置」に注目する代表値かどうかである。中央値はデータを昇順に並べたときちょうど中央に位置する値(データ数が偶数なら中央2つの平均)で、極端に大きい・小さい値が少数含まれていてもその影響を受けにくい。平均は合計を個数で割る計算のため外れ値の影響を受けやすく、最頻値は出現頻度の高さ、標準偏差はばらつきの大きさに注目する指標であり、いずれもデータを並べた際の中央の位置そのものに注目する語ではない。

https://www.jdla.org/certificate/general/

問題番号: g8-126
問題番号 g8-126 の誤りを報告する
第29問 ・ 確率・統計

時系列データにおいて、一定期間の区間を少しずつずらしながら平均を計算し、短期的な変動を平滑化して傾向を把握する手法はどれか。

  • ア移動平均
  • イ標準偏差
  • ウ最尤法
  • エ二項分布
答えと解説を見る
ア移動平均正解
解説

移動平均を選ぶ決め手は、時系列データを区間ごとにずらしながら計算し、短期的な変動を平滑化する「手法」を答えているかどうかである。区間の幅を広げるほど変動は滑らかになる一方、直近の変化への反応は遅くなるというトレードオフを持つ。標準偏差・最尤法・二項分布はいずれもこの平滑化の手法ではなく、ばらつきを測る指標、パラメータを推定する方法、試行結果の分布という別の役割を担う語であり、区間をずらして傾向を把握するという移動平均の目的とは対象が異なる。

https://www.jdla.org/certificate/general/

問題番号: g8-127
問題番号 g8-127 の誤りを報告する
第30問 ・ 確率・統計

データの値をすべて合計し、データの個数で割ることで求められる代表値はどれか。

  • ア平均
  • イ中央値
  • ウ最頻値
  • エ分散
答えと解説を見る
ア平均正解
解説

正解は「平均」である。平均はデータの値をすべて合計し、データの個数で割ることで求める代表値であり、計算が単純で扱いやすい一方、極端に大きい値や小さい値が含まれると結果が大きく引っ張られやすいという性質がある。中央値はデータを順に並べたときの中央の値、最頻値は最も出現頻度が高い値、分散はデータのばらつきを表す指標であり、合計を個数で割るという計算そのものを指すのは平均である。外れ値が多いデータでは、平均だけでなく中央値と合わせて確認すると分布の実態を把握しやすい。

https://www.jdla.org/certificate/general/

問題番号: g8-128
問題番号 g8-128 の誤りを報告する
第31問 ・ 確率・統計

データの中で最も出現頻度が高い値を指す代表値はどれか。

  • ア最頻値
  • イ平均
  • ウ中央値
  • エ度数分布
答えと解説を見る
ア最頻値正解
解説

最頻値を選ぶ判断軸は、代表値を「出現回数の多さ」で決めているか、それとも「値の大小や順序」で決めているかである。最頻値はデータの中で最も出現頻度が高い値を指す代表値であり、数値だけでなく順序や間隔を持たないカテゴリカルなデータでも求められる点に他の代表値にはない特徴がある。これに対し平均(合計を個数で割った値)や中央値(順に並べたときの中央の値)はいずれも値の大小関係をもとに計算される代表値であり、出現頻度の高さそのものを基準にしてはいない。度数分布はデータを区間ごとに区切って度数を集計したものであって、1つの代表値を指すという問題の枠組みとは性質が異なる。なお、同じ最頻値が複数存在する多峰性のデータでは、最頻値だけで分布の形を十分に説明できない場合もある。

https://www.jdla.org/certificate/general/

問題番号: g8-129
問題番号 g8-129 の誤りを報告する
第32問 ・ 確率・統計

確率変数が取り得る値と、それぞれの値が生じる確率との対応関係全体を表すものはどれか。

  • ア確率分布
  • イ確率変数
  • ウ期待値
  • エ標準偏差
答えと解説を見る
ア確率分布正解
解説

確率分布を選ぶには、値そのもの・値から計算される代表値・ばらつきの指標のどれでもなく、値と確率の対応関係を「全体」として答えているかを見極める必要がある。確率分布は確率変数が取り得るすべての値それぞれに生じる確率を対応づけたもので、離散的な値でも連続的な値でも定義でき、取り得る値に対応する確率の合計は必ず1になる。確率変数はこの対応関係の中で値が定まる対象そのもの、期待値はそこから計算される平均的な値、標準偏差はそのばらつきを表す指標であり、いずれも全体像から取り出した一部にすぎない。

https://www.jdla.org/certificate/general/

問題番号: g8-130
問題番号 g8-130 の誤りを報告する
第33問 ・ 確率・統計

試行の結果に応じて値が定まり、その値ごとに確率が対応づけられる変数を何と呼ぶか。

  • ア確率変数
  • イ確率分布
  • ウ期待値
  • エ疑似相関
答えと解説を見る
ア確率変数正解
解説

確率変数という答えを導く軸は、確率という仕組みの中で「値が定まる主体」を問われているか、その主体が示しうる値と確率の全体像を問われているかにある。試行を行うたびに結果に応じて一つの値を取り、その値それぞれに生起確率が結びつく変数を確率変数と呼び、値のとびとびさ(離散)か連続性かで種類が分かれる。これに対し確率分布は同じ確率変数が取りうる値と確率の組み合わせをまとめて描いた全体像であり、期待値はその全体像から計算される代表的な一点、疑似相関は変数の話とは無関係な見かけ上の相関という別領域の現象である。いずれも確率変数という「値が定まる主体」そのものを指す語ではない。

https://www.jdla.org/certificate/general/

問題番号: g8-131
問題番号 g8-131 の誤りを報告する
第34問 ・ 確率・統計

2つの変数の関連を調べる際に、両方に影響しうる第三の変数の影響を取り除いたうえで、残る2変数間の関連の強さを表す指標はどれか。

  • ア偏相関係数
  • イ相関係数
  • ウ共分散
  • エ疑似相関
答えと解説を見る
ア偏相関係数正解
解説

正解は「偏相関係数」である。設問が求めているのは、2変数以外に影響しうる第三の変数の効果をあらかじめ取り除いたうえでの、残り2変数間の関連の強さである。相関係数はこの除去操作を行わず2変数の直線的な関係をそのまま測る指標、共分散は2変数が一緒に変動する度合いを表す指標であり、いずれも第三変数を統制する仕組みを持たない。疑似相関は指標ではなく、第三変数(交絡因子)によって見かけ上の相関が生じている状態を指す言葉である。第三変数を統制する操作を伴う指標は偏相関係数だけである。

https://www.jdla.org/certificate/general/

問題番号: g8-132
問題番号 g8-132 の誤りを報告する
第35問 ・ 確率・統計

共分散を2つの変数それぞれの標準偏差で調整することで、測定単位(尺度)の影響を取り除き、2変数の関係の強さと向きを表せるようにした指標はどれか。

  • ア相関係数
  • イ共分散
  • ウ偏相関係数
  • エ相互情報量
答えと解説を見る
ア相関係数正解
解説

正解は「相関係数」である。設問が求めているのは、共分散を各変数の標準偏差で割ることで測定単位の違いを打ち消し、2変数の関係の強さと向きを表せるようにした指標である。共分散はこの標準偏差による調整を行わないため、単位が変われば値も変わってしまう。偏相関係数は単位の調整ではなく第三の変数の影響を除く指標、相互情報量は2変数の依存の度合いを表す指標であり、いずれも共分散を標準偏差で調整して求める指標ではない。単位の影響を取り除く調整を行うのは相関係数だけである。

https://www.itl.nist.gov/div898/handbook/pmc/section5/pmc541.htm

問題番号: g8-133
問題番号 g8-133 の誤りを報告する
第36問 ・ 確率・統計

モデルによる予測値と実際のデータとの誤差(残差)の二乗和が最小になるようにパラメータを決める推定方法はどれか。

  • ア最小二乗法
  • イ最尤法
  • ウ相関係数
  • エ共分散
答えと解説を見る
ア最小二乗法正解
解説

正解は「最小二乗法」である。設問の決め手は、予測値と実測値の差である残差を二乗し、その合計を最小にするという基準である。最尤法は観測データの尤度を最大にする基準でパラメータを選ぶため、設問の基準とは異なる。相関係数と共分散はどちらも2変数の関係を捉える指標であり、モデルのパラメータを決める推定方法ではない。目的関数が残差平方和か尤度かを最初に見分ける。二つの変数の関係を要約する指標ではなく、回帰直線をデータへ当てはめる基準を問う設問である。

https://www.jdla.org/certificate/general/

問題番号: g8-134
問題番号 g8-134 の誤りを報告する
第37問 ・ 確率・統計

ベルヌーイ分布と二項分布の関係を説明したものとして、最も適切なものはどれか。

  • アベルヌーイ分布は成功か失敗かという2択の結果を持つ1回だけの試行についての確率分布であり、同じ条件の試行をn回繰り返したときの成功した回数が従う確率分布が二項分布である
  • イ二項分布は成功か失敗かという2択の結果を持つ1回だけの試行についての確率分布であり、ベルヌーイ分布は同じ条件の試行をn回繰り返したときの成功した回数が従う確率分布である
  • ウベルヌーイ分布と二項分布は同じ内容を指す言い換えであり、どちらの語を使っても表す確率分布は変わらない
  • エ二項分布は連続型の確率分布であり、ベルヌーイ分布は離散型の確率分布であるという点で異なる
答えと解説を見る
アベルヌーイ分布は成功か失敗かという2択の結果を持つ1回だけの試行についての確率分布であり、同じ条件の試行をn回繰り返したときの成功した回数が従う確率分布が二項分布である正解
解説

正解は「ベルヌーイ分布は成功か失敗かという2択の結果を持つ1回だけの試行についての確率分布であり、同じ条件の試行をn回繰り返したときの成功した回数が従う確率分布が二項分布である」である。ベルヌーイ分布は成功・失敗の2択の結果を持つ1回だけの試行についての確率分布であり、ベルヌーイ分布に従う試行を同じ条件でn回繰り返したときに成功した回数が従う確率分布が二項分布である。両者の役割を入れ替えた説明、同じ内容の言い換えとする説明、二項分布を連続型・ベルヌーイ分布を離散型とする説明は、いずれもこの関係と一致しない。二項分布・ベルヌーイ分布はどちらも離散型の確率分布である。

https://www.jdla.org/certificate/general/

問題番号: g8-135
問題番号 g8-135 の誤りを報告する
第38問 ・ 確率・統計

連続型の確率変数について、度数分布表の階級幅を限りなく細かくしたときに相対度数のグラフが近づく、理論上の分布を表すものはどれか。

  • ア確率密度
  • イ確率分布
  • ウ確率変数
  • エ度数分布
答えと解説を見る
ア確率密度正解
解説

正解は「確率密度」である。度数分布表の階級幅を限りなく細かくしていくと、実測データに基づく度数分布のグラフは理論上のなめらかな曲線に近づいていく。この極限にあたる、連続型の確率変数の分布を表す関数の値が確率密度である。確率分布は確率変数の取り得る値と確率の対応関係全体を指す、離散型・連続型どちらにも使えるより広い概念であり、確率変数はその対応関係の元になる変数そのものを指す。度数分布は階級幅を細かくする前の実測データの集計であり、いずれも「階級幅を限りなく細かくした極限」という条件そのものを表す語ではない。

https://www.jdla.org/certificate/general/

問題番号: g8-136
問題番号 g8-136 の誤りを報告する
第39問 ・ 確率・統計

変数ごとの分散と変数間の相関を考慮し、平均との差が同じでも方向によって距離を変えて外れ値を調べたい。使う距離はどれか。

  • アコサイン類似度
  • イユークリッド距離
  • ウマハラノビス距離
  • エ相関係数
答えと解説を見る
ウマハラノビス距離正解
解説

この事例では「データの分散と相関を加味する距離か」という判断軸で見ると、正解は「マハラノビス距離」である。マハラノビス距離は、各変数の分散と変数間の相関(共分散)を考慮し、データ全体のばらつき方に応じて距離を測る。したがって、平均との差が同じでも、ばらつきの大きい方向と小さい方向を区別して外れ方を評価したい設問の条件に合う。ユークリッド距離は2点間の単純な直線距離であり、分散や相関を調整しない。コサイン類似度はベクトルの向きの近さを測る指標、相関係数は2変数の直線的な関係の強さと向きを表す指標であり、どちらも設問が求める距離ではない。データの分布を考慮するかが、マハラノビス距離を選ぶ判断軸になる。

https://www.jdla.org/certificate/general/

問題番号: g8-214
問題番号 g8-214 の誤りを報告する
このページは表示速度を保つため最初の39問を掲載しています。第40問以降を読む → 全52問は演習画面でも解けます。

執筆: ミナト編集部(運営者情報を見る)