IPA過去問ドリル

令和3年度 秋期 データベーススペシャリスト試験 午前Ⅱ 問18

テクノロジ/データベース

ビッグデータ処理基盤に利用され,オープンソースソフトウェアの一つである Apache Spark の特徴はどれか。

出典:令和3年度 秋期 データベーススペシャリスト試験 午前Ⅱ 問18

正解:イ

解説

Apache Sparkは,RDD(Resilient Distributed Dataset)と呼ばれる耐障害性をもつ分散データ集合を中心としたインメモリの分散処理フレームワークであり,RDDに対してmapやfilterなどの変換処理を行い,バッチ処理だけでなくストリーム処理や反復処理も高速に実行できます。

選択肢ごとの解説

  • 誤り。MapReduceの考え方に基づいたバッチ処理に特化しているのはHadoop MapReduceの説明であり,Apache Sparkはインメモリ処理により,バッチ処理に限らずストリーム処理や反復処理にも高速に対応できる点が特徴です。
  • 正しい。Apache Sparkは,RDD(Resilient Distributed Dataset)と呼ばれる分散データ集合に対して変換処理を行う,インメモリの分散処理フレームワークです。
  • 誤り。パブリッシュ/サブスクライブ型のメッセージングモデルを採用しているのは,Apache Kafkaなどのメッセージングシステムの説明です。
  • 誤り。マスタノードをもたない分散型のキーバリューストアは,Apache Cassandraなどの説明であり,Apache Sparkの説明ではありません。
データベーススペシャリストの過去問を演習モードで解く