빅데이터분석기사 필기 제4회 기출 · 빅데이터 기술과 제도
다음 중 아래에서 설명하는 개념으로 맞는 것은?
대표적인 빅데이터 분산처리 엔진으로, 하둡의 단점을 보완하기 위해 인메모리(In-Memory)기반의 데이터 처리 오픈소스 플랫폼
이 문제 풀어보기
정답 및 해설 보기
정답: 2번
스파크(Spark)는 디스크 기반 하둡 맵리듀스의 느린 처리 속도를 보완하기 위해 인메모리 방식으로 데이터를 처리하는 분산 처리 오픈소스 엔진이다.
1번 맵리듀스는 중간 결과를 디스크에 쓰는 분산 처리 모델, 3번 하이브는 SQL 형태 질의를 제공하는 DW 도구, 4번 피그는 데이터 흐름 스크립트 언어라서 인메모리 엔진이 아니다.
1번 맵리듀스는 중간 결과를 디스크에 쓰는 분산 처리 모델, 3번 하이브는 SQL 형태 질의를 제공하는 DW 도구, 4번 피그는 데이터 흐름 스크립트 언어라서 인메모리 엔진이 아니다.