③ 機械学習・ディープラーニング

データサイエンティスト検定リテラシーレベル141

問題

大規模なデータを複数のコンピュータに分散して並列処理する技術であり、メモリ上で処理を行うことで高速化を実現しているフレームワークはどれか。

AHadoop
BSpark✓ 正解
CMySQL
DDocker

正解

BSpark

解説

SparkはHadoopと異なりメモリ上で分散処理を行うため、反復的な処理に強いという特徴があります。

分野解説:③ 機械学習・ディープラーニング

機械学習と深層学習の代表的な手法を学ぶ分野です。教師あり・教師なし学習の区別、ランダムフォレストや勾配ブースティングなどのアンサンブル学習、過学習と汎化性能、連合学習・転移学習といった学習パラダイム、そしてニューラルネットワークの基礎までが問われます。手法ごとに「何を得意とし、どんな課題があるか」を対比して押さえることが重要です。用語の丸暗記ではなく、各モデルの仕組みと使いどころを理解すると応用問題にも対応できます。

この分野の問題をすべて見る →

本番形式で問題を解いてみよう

クイズモードで挑戦 →
← 第140142問 →

データサイエンティスト検定リテラシーレベルについて

DS検定リテラシーレベルの基礎を固める

主催一般社団法人 データサイエンティスト協会
出題形式100問(CBT方式)
試験時間100分
受験料11,000円(税込)※学生5,500円
合格基準合格基準は公式サイトで要確認
難易度★★★☆☆
試験詳細を見る →
← 問題一覧へ戻る