道路標識へ小さな模様を加え、画像認識モデルに別の標識と判定させた。この攻撃はどれか。
答えと解説を見る
この事例では「入力への意図的な摂動で誤認識を起こすか」を確認すると、敵対的攻撃に絞れる。敵対的攻撃は、ノイズの多い入力や想定外のデータと並んで、AIのロバスト性、すなわち乱れた入力にさらされても性能を大きく損なわず安定して動作できる性質が試される代表的な外乱として位置づけられる。設問を見分ける軸は、利用者を取り巻く情報環境が受け身に偏っていく現象なのか、それとも攻撃者が能動的に入力を細工してAIを誤らせようとする行為なのかという点にある。フィルターバブルとエコーチェンバーはいずれも前者の情報環境側の現象であり、AIそのものへ細工した入力を与える行為ではない。信頼できるAIも公平性やロバスト性を備えた状態を表す概念であって、攻撃行為そのものを指す語ではない。
https://www.jdla.org/certificate/general/