Pular para o conteúdo principal

Questão de Noções de Informática — Software — CESPE / CEBRASPE 2025

Noções de InformáticaSoftware
Código
ce214856
Banca
CESPE / CEBRASPE
Órgão
SEFAZ-SE
Ano
2025
Nível
Superior
Cargo
Auditor Fiscal Tributário - Tecnologia da Informação
O Hadoop é um ecossistema para processamento distribuído de grandes volumes de dados, estruturados ou não. Sua arquitetura central é composta por módulos complementares. Considerando essas informações, assinale a opção em que são corretamente apresentados os três principais componentes do Hadoop.
  1. AHDFS para armazenamento, MapReduce para consultas OLAP e Sqoop para integração com sistemas de gerenciamento de bancos de dados (SGBDs)
  2. BHDFS para armazenamento, Spark para processamento e Hive para consultas SQL
  3. CHDFS para armazenamento, MapReduce para processamento e YARN para gerenciamento de recursos
  4. DCassandra para armazenamento, MapReduce para processamento e YARN para consultas
  5. EHDFS para armazenamento, Tez para processamento e Zookeeper para gerenciamento de recursos
Revelar gabarito e comentário

GabaritoC — HDFS para armazenamento, MapReduce para processamento e YARN para gerenciamento de recursos

Comentário gerado por IA. É um apoio ao estudo, ancorado em fontes, mas pode conter imprecisões — confira sempre na fonte oficial (lei, súmula, edital e gabarito da banca). Encontrou um erro? Use “Reportar”.

Hadoop: Componentes Principais

Gabarito: letra C. O núcleo do ecossistema Hadoop é constituído por três componentes: HDFS (Hadoop Distributed File System) para armazenamento distribuído, MapReduce para processamento em lote e YARN (Yet Another Resource Negotiator) para gerenciamento de recursos do cluster. O contexto fornecido corrobora essa arquitetura.

PEGA ESSA DICA!

Em provas, lembre-se da tríade HDFS + MapReduce + YARN. Ferramentas como Spark, Hive, Sqoop e Zookeeper são projetos do ecossistema, mas não fazem parte do núcleo obrigatório do Hadoop. O núcleo é sempre armazenamento (HDFS), processamento (MapReduce) e gerenciamento (YARN).

Componente

Função no Hadoop

É componente central do núcleo?

HDFS

Armazenamento distribuído de arquivos

✅ Sim

MapReduce

Processamento em lote (batch)

✅ Sim

YARN

Gerenciamento de recursos do cluster

✅ Sim

Spark

Motor de processamento alternativo (in-memory)

❌ Não (ecossistema)

Hive

Consultas SQL sobre HDFS

❌ Não (ecossistema)

Sqoop

Integração com bancos de dados relacionais

❌ Não (ecossistema)

Tez

Motor de processamento otimizado

❌ Não (ecossistema)

Zookeeper

Coordenação e sincronização distribuída

❌ Não (ecossistema)

Cassandra

Banco NoSQL (não é sistema de arquivos)

❌ Não (substituto, não núcleo)

1HDFS
Armazenamento distribuído
2MapReduce
Processamento em lote
3YARN
Gerenciamento de recursos
Núcleo do Hadoop
LEVELsoulevel.com.br
Núcleo do Hadoop: HDFS (Armazenamento distribuído); MapReduce (Processamento em lote); YARN (Gerenciamento de recursos)

Alternativa A — ❌ Incorreta

Atribui a função de "consultas OLAP" ao MapReduce, o que é incorreto. O MapReduce é um modelo de programação para processamento em lote (batch), não para consultas analíticas online (OLAP). Além disso, Sqoop é uma ferramenta de integração, mas não é um componente central; YARN deveria estar presente no lugar de Sqoop.

Alternativa B — ❌ Incorreta

Troca MapReduce e YARN por Spark e Hive. Embora Spark e Hive sejam tecnologias comuns no ecossistema, eles não são componentes centrais do Hadoop. O Spark é um motor de processamento alternativo, e o Hive é uma ferramenta de consulta SQL sobre o HDFS. Faltam MapReduce e YARN.

Alternativa C — ✅ Correta ⟵ GABARITO

Apresenta exatamente os três módulos essenciais: HDFS (armazenamento), MapReduce (processamento) e YARN (gerenciamento de recursos). É a definição clássica da arquitetura Hadoop.

Alternativa D — ❌ Incorreta

Substitui o HDFS pelo Cassandra, que é um banco de dados NoSQL, não um sistema de arquivos distribuído do Hadoop. O HDFS é o sistema de arquivos nativo. Além disso, coloca YARN como "consultas", quando na verdade gerencia recursos; MapReduce está correto, mas o armazenamento errado invalida a alternativa.

Alternativa E — ❌ Incorreta

Usa Tez (motor de processamento) e Zookeeper (coordenação) no lugar de MapReduce e YARN, respectivamente. O Tez é um framework de processamento, mas não é o modelo padrão do Hadoop; o Zookeeper cuida de coordenação, não de gerenciamento de recursos. Faltam MapReduce e YARN.

Gabarito: letra C — HDFS, MapReduce e YARN.

Link permanente: /questoes/ce214856