Questão de Banco de Dados — Big Data — CESPE / CEBRASPE 2023
Banco de Dados›Big Data
Código
ce153842
Banca
CESPE / CEBRASPE
Órgão
DATAPREV
Ano
2023
Nível
Médio
Cargo
Analista de Tecnologia da Informação - Perfil: Inteligência da informação
Julgue o item a seguir, relativos ao Hadoop e ao Spark.Spark é uma arquitetura de sistema operacional para trabalhar com dados organizados de forma hierárquica, utilizando-se o módulo Spark SQL, que permite consultar arquivos pelo seu conteúdo.
CCerto
EErrado
Revelar gabarito e comentário▾
GabaritoE — Errado
Comentário gerado por IA. É um apoio ao estudo, ancorado em fontes, mas pode conter imprecisões — confira sempre na fonte oficial (lei, súmula, edital e gabarito da banca). Encontrou um erro? Use “Reportar”.
Apache Spark
Gabarito: ❌ ERRADO. A afirmativa está incorreta. O Spark não é uma arquitetura de sistema operacional; ele é um framework de processamento distribuído para Big Data. Além disso, o Spark SQL é utilizado para consultar dados estruturados (em tabelas, DataFrames), não necessariamente dados hierárquicos, e o Spark não trata dados exclusivamente de forma hierárquica. O Spark pode trabalhar com diversos formatos (JSON, Parquet, etc.) e oferece módulos como Spark SQL, MLlib, GraphX e Structured Streaming.
A afirmação confunde o Spark com um sistema operacional e atribui a ele características imprecisas. Portanto, o item está ERRADO.
Apache Spark: O que é (Framework de processamento distribuído, Para Big Data); O que NÃO é (Sistema operacional, Dados exclusivamente hierárquicos); Módulos (Spark SQL (dados estruturados), MLlib (machine learning), GraphX (grafos), Structured Streaming (fluxo contínuo))