Questão de Banco de Dados — Big Data — CESPE / CEBRASPE 2026
- Código
- ce229669
- Banca
- CESPE / CEBRASPE
- Órgão
- TCE-RN
- Ano
- 2026
- Nível
- Superior
- Cargo
- Auditor de Controle Externo - Especialidade: Tecnologia da Informação
- CCerto
- EErrado
GabaritoC — Certo
✅ CERTO. A afirmativa está correta porque descreve com precisão as vantagens do uso de data lakes distribuídos e de formatos colunares como Apache Parquet em arquiteturas de Big Data.
Um data lake é um repositório centralizado que armazena dados em seu formato bruto (schema-on-read), permitindo alta flexibilidade de esquemas. Quando implementado de forma distribuída (ex: HDFS, Amazon S3), oferece escalabilidade horizontal, adicionando mais nós conforme a necessidade. Essas características são essenciais para Big Data.
Já os formatos colunares (Parquet, ORC) organizam os dados por colunas, em vez de linhas. Isso traz dois benefícios principais:
Performance de leitura: consultas analíticas que acessam apenas algumas colunas leem menos dados do disco.
Compressão eficiente: dados do mesmo tipo em uma coluna comprimem melhor (ex: run-length encoding, dictionary encoding).
A combinação de data lake com Parquet é uma prática recomendada e amplamente adotada no mercado (ex: ecossistema Hadoop, Spark).
✅ CERTO — a afirmação está de acordo com os conceitos fundamentais de Big Data.
Link permanente: /questoes/ce229669