Questão de Noções de Informática — Software — CESPE / CEBRASPE 2025
Noções de Informática›Software
Código
ce214856
Banca
CESPE / CEBRASPE
Órgão
SEFAZ-SE
Ano
2025
Nível
Superior
Cargo
Auditor Fiscal Tributário - Tecnologia da Informação
O Hadoop é um ecossistema para processamento distribuído de grandes volumes de dados, estruturados ou não. Sua arquitetura central é composta por módulos complementares. Considerando essas informações, assinale a opção em que são corretamente apresentados os três principais componentes do Hadoop.
AHDFS para armazenamento, MapReduce para consultas OLAP e Sqoop para integração com sistemas de gerenciamento de bancos de dados (SGBDs)
BHDFS para armazenamento, Spark para processamento e Hive para consultas SQL
CHDFS para armazenamento, MapReduce para processamento e YARN para gerenciamento de recursos
DCassandra para armazenamento, MapReduce para processamento e YARN para consultas
EHDFS para armazenamento, Tez para processamento e Zookeeper para gerenciamento de recursos
Revelar gabarito e comentário▾
GabaritoC — HDFS para armazenamento, MapReduce para processamento e YARN para gerenciamento de recursos
Comentário gerado por IA. É um apoio ao estudo, ancorado em fontes, mas pode conter imprecisões — confira sempre na fonte oficial (lei, súmula, edital e gabarito da banca). Encontrou um erro? Use “Reportar”.
Hadoop: Componentes Principais
Gabarito: letra C. O núcleo do ecossistema Hadoop é constituído por três componentes: HDFS (Hadoop Distributed File System) para armazenamento distribuído, MapReduce para processamento em lote e YARN (Yet Another Resource Negotiator) para gerenciamento de recursos do cluster. O contexto fornecido corrobora essa arquitetura.
PEGA ESSA DICA!
Em provas, lembre-se da tríade HDFS + MapReduce + YARN. Ferramentas como Spark, Hive, Sqoop e Zookeeper são projetos do ecossistema, mas não fazem parte do núcleo obrigatório do Hadoop. O núcleo é sempre armazenamento (HDFS), processamento (MapReduce) e gerenciamento (YARN).
Componente
Função no Hadoop
É componente central do núcleo?
HDFS
Armazenamento distribuído de arquivos
✅ Sim
MapReduce
Processamento em lote (batch)
✅ Sim
YARN
Gerenciamento de recursos do cluster
✅ Sim
Spark
Motor de processamento alternativo (in-memory)
❌ Não (ecossistema)
Hive
Consultas SQL sobre HDFS
❌ Não (ecossistema)
Sqoop
Integração com bancos de dados relacionais
❌ Não (ecossistema)
Tez
Motor de processamento otimizado
❌ Não (ecossistema)
Zookeeper
Coordenação e sincronização distribuída
❌ Não (ecossistema)
Cassandra
Banco NoSQL (não é sistema de arquivos)
❌ Não (substituto, não núcleo)
Núcleo do Hadoop: HDFS (Armazenamento distribuído); MapReduce (Processamento em lote); YARN (Gerenciamento de recursos)
Alternativa A — ❌ Incorreta
Atribui a função de "consultas OLAP" ao MapReduce, o que é incorreto. O MapReduce é um modelo de programação para processamento em lote (batch), não para consultas analíticas online (OLAP). Além disso, Sqoop é uma ferramenta de integração, mas não é um componente central; YARN deveria estar presente no lugar de Sqoop.
Alternativa B — ❌ Incorreta
Troca MapReduce e YARN por Spark e Hive. Embora Spark e Hive sejam tecnologias comuns no ecossistema, eles não são componentes centrais do Hadoop. O Spark é um motor de processamento alternativo, e o Hive é uma ferramenta de consulta SQL sobre o HDFS. Faltam MapReduce e YARN.
Alternativa C — ✅ Correta ⟵ GABARITO
Apresenta exatamente os três módulos essenciais: HDFS (armazenamento), MapReduce (processamento) e YARN (gerenciamento de recursos). É a definição clássica da arquitetura Hadoop.
Alternativa D — ❌ Incorreta
Substitui o HDFS pelo Cassandra, que é um banco de dados NoSQL, não um sistema de arquivos distribuído do Hadoop. O HDFS é o sistema de arquivos nativo. Além disso, coloca YARN como "consultas", quando na verdade gerencia recursos; MapReduce está correto, mas o armazenamento errado invalida a alternativa.
Alternativa E — ❌ Incorreta
Usa Tez (motor de processamento) e Zookeeper (coordenação) no lugar de MapReduce e YARN, respectivamente. O Tez é um framework de processamento, mas não é o modelo padrão do Hadoop; o Zookeeper cuida de coordenação, não de gerenciamento de recursos. Faltam MapReduce e YARN.