Pular para o conteúdo principal

Questão de Banco de Dados — Banco de Dados — CESPE / CEBRASPE 2025

Banco de DadosBanco de Dados
Código
ce218971
Banca
CESPE / CEBRASPE
Órgão
TRF - 6ª REGIÃO
Ano
2025
Nível
Superior
Cargo
Analista Judiciário – Área: Apoio Especializado – Especialidade: Análise de Dados
Acerca da arquitetura de sistemas analíticos e do ecossistema Apache Hadoop, julgue o próximo item.O MapReduce, um dos componentes principais do Hadoop, foi projetado para atender a demandas analíticas de alta frequência e baixa latência.
  1. CCerto
  2. EErrado
Revelar gabarito e comentário

GabaritoE — Errado

Comentário gerado por IA. É um apoio ao estudo, ancorado em fontes, mas pode conter imprecisões — confira sempre na fonte oficial (lei, súmula, edital e gabarito da banca). Encontrou um erro? Use “Reportar”.

MapReduce no Hadoop

Gabarito: Errado. O MapReduce foi projetado para processamento em lote (batch) de grandes volumes de dados, com alta latência, e não para consultas analíticas de alta frequência e baixa latência.

A banca explora a confusão entre o MapReduce (paradigma de programação paralela para trabalhos batch) e ferramentas analíticas de baixa latência no ecossistema Hadoop, como Impala, Presto ou Apache Spark. O próprio material de apoio destaca que o Impala "contorna o MapReduce para acessar diretamente os dados por meio de um mecanismo de consulta distribuído especializado", obtendo desempenho muito superior ao Hive (que executa sobre MapReduce). Além disso, o Hive e outras estruturas baseadas em MapReduce são mais adequados para trabalhos em lote de execução longa, como ETL.

O Hadoop surgiu para processamento em lote escalonável, e o MapReduce é o seu motor de processamento batch. A afirmação de que ele atende a demandas de baixa latência é, portanto, incorreta.

  1. 1Batch (alta latência)MapReduce / Hive
  2. 2Interativo (baixa latência)Impala / Presto / Spark
LEVEL · soulevel.com.br
PEGA ESSA DICA!

Para consultas interativas e de baixa latência no ecossistema Hadoop, use Impala, Presto ou Apache Spark. MapReduce e Hive são indicados para processamento batch de grandes volumes.

Gabarito: Errado

Link permanente: /questoes/ce218971