Pular para o conteúdo principal

Questão de Banco de Dados — Big Data — CESPE / CEBRASPE 2023

Banco de DadosBig Data
Código
ce154588
Banca
CESPE / CEBRASPE
Órgão
EMPREL
Ano
2023
Nível
Superior
Cargo
Analista de Infraestrutura e Suporte - Especialidade: Banco de Dados
No projeto de arquitetura de um data lake, a primeira etapa que deve estar prevista é a
  1. Acriação de um ambiente virtual de captura de dados.
  2. Bconcessão de acesso ao banco de dados (somente leitura) aos cientistas de dados, para estes realizarem experimentos e testes.
  3. Cintegração dos dados do data lake aos data warehouses da empresa.
  4. Datualização dos dados dos repositórios de dados da empresa a partir dos dados já consolidados disponíveis no data lake.
  5. Evisualização de dados e otimização das principais consultas.
Revelar gabarito e comentário

GabaritoA — criação de um ambiente virtual de captura de dados.

Comentário gerado por IA. É um apoio ao estudo, ancorado em fontes, mas pode conter imprecisões — confira sempre na fonte oficial (lei, súmula, edital e gabarito da banca). Encontrou um erro? Use “Reportar”.

Data Lake: Arquitetura e Primeira Etapa

Gabarito: letra A. A primeira etapa no projeto de arquitetura de um data lake é a criação de um ambiente virtual de captura de dados, pois sem a ingestão inicial não há dados para armazenar, processar ou analisar. As demais alternativas referem-se a estágios posteriores do ciclo de vida do data lake.

A banca testa o conhecimento sobre a sequência lógica de implantação de um data lake. A captura de dados (ingestão) é o ponto de partida; só depois vêm armazenamento, preparação, acesso, integração e consumo.

  1. 1Captura (ingestão)
  2. 2Armazenamento
  3. 3Processamento
  4. 4Consumo
LEVEL · soulevel.com.br

Alternativa A — ✅ Correta ⟵ GABARITO

A criação de um ambiente virtual de captura de dados é a etapa inicial. Sem ela, não há dados a serem ingeridos, armazenados ou processados. É a fundação do data lake.

Alternativa B — ❌ Incorreta

A concessão de acesso de leitura a cientistas de dados presume que os dados já foram capturados e estão disponíveis. É uma etapa posterior, após a ingestão e o armazenamento.

Alternativa C — ❌ Incorreta

A integração com data warehouses ocorre após a consolidação dos dados no data lake, geralmente nas fases de processamento e consumo. Não é a primeira etapa.

Alternativa D — ❌ Incorreta

Atualizar repositórios da empresa a partir de dados do data lake pressupõe que o lake já está populado. É uma operação de saída (output), não de entrada (input).

Alternativa E — ❌ Incorreta

Visualização e otimização de consultas são atividades de consumo e refinamento, realizadas após a ingestão, armazenamento e preparação dos dados. São etapas finais do pipeline.

PEGA ESSA DICA!

Para fixar a ordem: captura → armazenamento → processamento → consumo. Em projetos de data lake, a primeira preocupação é sempre como os dados entram (ingestão). Questões assim testam a visão macro do fluxo.

Link permanente: /questoes/ce154588