Questão de Banco de Dados — Big Data — CESPE / CEBRASPE 2023
Banco de Dados›Big Data
Código
ce154588
Banca
CESPE / CEBRASPE
Órgão
EMPREL
Ano
2023
Nível
Superior
Cargo
Analista de Infraestrutura e Suporte - Especialidade: Banco de Dados
No projeto de arquitetura de um data lake, a primeira etapa que deve estar prevista é a
Acriação de um ambiente virtual de captura de dados.
Bconcessão de acesso ao banco de dados (somente leitura) aos cientistas de dados, para estes realizarem experimentos e testes.
Cintegração dos dados do data lake aos data warehouses da empresa.
Datualização dos dados dos repositórios de dados da empresa a partir dos dados já consolidados disponíveis no data lake.
Evisualização de dados e otimização das principais consultas.
Revelar gabarito e comentário▾
GabaritoA — criação de um ambiente virtual de captura de dados.
Comentário gerado por IA. É um apoio ao estudo, ancorado em fontes, mas pode conter imprecisões — confira sempre na fonte oficial (lei, súmula, edital e gabarito da banca). Encontrou um erro? Use “Reportar”.
Data Lake: Arquitetura e Primeira Etapa
Gabarito: letra A. A primeira etapa no projeto de arquitetura de um data lake é a criação de um ambiente virtual de captura de dados, pois sem a ingestão inicial não há dados para armazenar, processar ou analisar. As demais alternativas referem-se a estágios posteriores do ciclo de vida do data lake.
A banca testa o conhecimento sobre a sequência lógica de implantação de um data lake. A captura de dados (ingestão) é o ponto de partida; só depois vêm armazenamento, preparação, acesso, integração e consumo.
1Captura (ingestão)
2Armazenamento
3Processamento
4Consumo
LEVEL · soulevel.com.br
Alternativa A — ✅ Correta ⟵ GABARITO
A criação de um ambiente virtual de captura de dados é a etapa inicial. Sem ela, não há dados a serem ingeridos, armazenados ou processados. É a fundação do data lake.
Alternativa B — ❌ Incorreta
A concessão de acesso de leitura a cientistas de dados presume que os dados já foram capturados e estão disponíveis. É uma etapa posterior, após a ingestão e o armazenamento.
Alternativa C — ❌ Incorreta
A integração com data warehouses ocorre após a consolidação dos dados no data lake, geralmente nas fases de processamento e consumo. Não é a primeira etapa.
Alternativa D — ❌ Incorreta
Atualizar repositórios da empresa a partir de dados do data lake pressupõe que o lake já está populado. É uma operação de saída (output), não de entrada (input).
Alternativa E — ❌ Incorreta
Visualização e otimização de consultas são atividades de consumo e refinamento, realizadas após a ingestão, armazenamento e preparação dos dados. São etapas finais do pipeline.
PEGA ESSA DICA!
Para fixar a ordem: captura → armazenamento → processamento → consumo. Em projetos de data lake, a primeira preocupação é sempre como os dados entram (ingestão). Questões assim testam a visão macro do fluxo.