Questão de Banco de Dados — Banco de Dados — CESPE / CEBRASPE 2023
- Código
- ce152982
- Banca
- CESPE / CEBRASPE
- Órgão
- DATAPREV
- Ano
- 2023
- Nível
- Superior
- Cargo
- Analista de Processamento
- CCerto
- EErrado
GabaritoC — Certo
Gabarito: ✅ CERTO. A afirmação está correta. O data lake é a solução mais adequada quando se deseja armazenar dados sem estruturá-los previamente, ao contrário do banco relacional, que exige um esquema definido antes da inserção.
A principal diferença entre um data lake e um banco relacional está na exigência de estruturação prévia dos dados. Um banco relacional (SGBD relacional, como MySQL, PostgreSQL) requer a definição de tabelas, colunas, tipos de dados e relacionamentos antes de armazenar qualquer registro – isso é conhecido como schema-on-write. Já um data lake adota o princípio de schema-on-read: os dados são armazenados em seu formato bruto (arquivos, logs, JSON, CSV, etc.) e a estrutura é aplicada apenas no momento da leitura/consulta.
No caso da empresa de comércio eletrônico, os dados de interações dos clientes são variados e podem incluir registros de visitas, cliques, compras, avaliações, comentários – muitos desses dados são semiestruturados ou não estruturados (ex.: logs de clique, texto de comentários). Se a empresa não deseja estruturar e organizar esses dados antecipadamente, o data lake é a escolha natural, pois permite ingerir os dados sem transformação prévia, armazenando-os em sua forma original. Futuramente, quando houver necessidade de análise, podem ser aplicadas transformações e consultas.
Lembre-se da distinção: banco relacional = schema-on-write (exige planejamento prévio); data lake = schema-on-read (armazena cru, estrutura depois). Essa é uma pegadinha recorrente em provas sobre Big Data e NoSQL.
✅ CERTO. A afirmação está correta e alinhada com os conceitos fundamentais de data lake e bancos relacionais.
Link permanente: /questoes/ce152982