Pular para o conteúdo principal

Questão de Banco de Dados — Big Data — CESPE / CEBRASPE 2023

Banco de DadosBig Data
Código
ce153842
Banca
CESPE / CEBRASPE
Órgão
DATAPREV
Ano
2023
Nível
Médio
Cargo
Analista de Tecnologia da Informação - Perfil: Inteligência da informação
Julgue o item a seguir, relativos ao Hadoop e ao Spark.Spark é uma arquitetura de sistema operacional para trabalhar com dados organizados de forma hierárquica, utilizando-se o módulo Spark SQL, que permite consultar arquivos pelo seu conteúdo.
  1. CCerto
  2. EErrado
Revelar gabarito e comentário

GabaritoE — Errado

Comentário gerado por IA. É um apoio ao estudo, ancorado em fontes, mas pode conter imprecisões — confira sempre na fonte oficial (lei, súmula, edital e gabarito da banca). Encontrou um erro? Use “Reportar”.

Apache Spark

Gabarito: ❌ ERRADO. A afirmativa está incorreta. O Spark não é uma arquitetura de sistema operacional; ele é um framework de processamento distribuído para Big Data. Além disso, o Spark SQL é utilizado para consultar dados estruturados (em tabelas, DataFrames), não necessariamente dados hierárquicos, e o Spark não trata dados exclusivamente de forma hierárquica. O Spark pode trabalhar com diversos formatos (JSON, Parquet, etc.) e oferece módulos como Spark SQL, MLlib, GraphX e Structured Streaming.

A afirmação confunde o Spark com um sistema operacional e atribui a ele características imprecisas. Portanto, o item está ERRADO.

1O que é
Framework de processamento distribuído
Para Big Data
2O que NÃO é
Sistema operacional
Dados exclusivamente hierárquicos
3Módulos
Spark SQL (dados estruturados)
MLlib (machine learning)
GraphX (grafos)
Structured Streaming (fluxo contínuo)
Apache Spark
LEVELsoulevel.com.br
Apache Spark: O que é (Framework de processamento distribuído, Para Big Data); O que NÃO é (Sistema operacional, Dados exclusivamente hierárquicos); Módulos (Spark SQL (dados estruturados), MLlib (machine learning), GraphX (grafos), Structured Streaming (fluxo contínuo))

Link permanente: /questoes/ce153842