Pular para o conteúdo principal

Questão de Banco de Dados — ETL (Extract Transform Load) — FGV 2025

Banco de DadosETL (Extract Transform Load)
Código
fg106568
Banca
FGV
Órgão
CGE-SP
Ano
2025
Nível
Superior
Cargo
Auditor Estadual de Controle - Tecnologia da Informação - tarde
O pipeline que carrega dados de execução orçamentária do sistema operacional para o Data Warehouse deve garantir que o volume de dados seja carregado no ambiente analítico de forma eficiente, seguindo todas as transformações já aplicadas.Assinale a opção que apresenta a principal responsabilidade e o desafio da fase Load no processo ETL, especialmente em relação ao design de índice e particionamento da Tabela de Fato.
  1. ACriar e gerenciar a Cloud Platform onde o ETL será executado
  2. BDefinir as regras de limpeza e padronização (transformação) dos dados.
  3. CGerenciar a Consistência Externa Forte entre diferentes regiões geográficas.
  4. DIdentificar e extrair as alterações incrementais (deltas) da fonte de dados operacional (OLTP).
  5. ERealizar o carregamento dos dados transformados para o Data Warehouse e garantir que os mecanismos de otimização sejam utilizados.
Revelar gabarito e comentário

GabaritoE — Realizar o carregamento dos dados transformados para o Data Warehouse e garantir que os mecanismos de otimização sejam utilizados.

Comentário gerado por IA. É um apoio ao estudo, ancorado em fontes, mas pode conter imprecisões — confira sempre na fonte oficial (lei, súmula, edital e gabarito da banca). Encontrou um erro? Use “Reportar”.

Fase Load no Processo ETL

Gabarito: letra E. A fase Load (carga) é a etapa final do ETL, responsável por inserir os dados já transformados no Data Warehouse. Seu principal desafio técnico é garantir a eficiência do carregamento, utilizando mecanismos de otimização como índices e particionamento da Tabela de Fato, que aceleram consultas e atualizações no ambiente analítico.

  1. 1Extract (Extração)Coleta dados brutos
  2. 2Transform (Transformação)Limpeza e padronização
  3. 3Load (Carga)Inserção no DW com índices e particionamento
LEVEL · soulevel.com.br

Alternativa A — ❌ Incorreta

Criar e gerenciar a Cloud Platform é uma tarefa de infraestrutura, não uma responsabilidade específica da fase Load. O ETL pode ser executado em nuvem, mas a administração da plataforma foge ao escopo da carga propriamente dita.

Alternativa B — ❌ Incorreta

Definir regras de limpeza e padronização é atribuição da fase de Transformação (Transform), não da Load. A transformação ocorre antes da carga, preparando os dados para o modelo dimensional.

Alternativa C — ❌ Incorreta

Gerenciar consistência externa forte entre regiões geográficas é um problema de replicação distribuída, não relacionado ao processo de carga em um Data Warehouse centralizado. A consistência no DW costuma ser eventual ou gerenciada por técnicas de ETL incremental, mas não é o foco da fase Load.

Alternativa D — ❌ Incorreta

Identificar e extrair alterações incrementais (deltas) é responsabilidade da fase de Extração (Extract). Essa etapa lida com a captura de dados das fontes OLTP, seja por log, CDC (Change Data Capture) ou timestamps.

Alternativa E — ✅ Correta ⟵ GABARITO

A descrição da alternativa E corresponde exatamente à fase Load: realizar o carregamento dos dados transformados para o Data Warehouse. O enunciado destaca que o pipeline deve ser eficiente, e isso se traduz em otimizações como a definição de índices e o particionamento da Tabela de Fato, que são decisões tomadas durante o design da carga.

SE LIGUE NESSA!

O processo ETL é composto por três fases sequenciais: Extração (coleta dos dados brutos), Transformação (limpeza, padronização e conversão) e Carga (inserção no DW). Cada alternativa incorreta troca uma dessas fases ou insere conceitos alheios ao processo.

Gabarito: letra E — a única que descreve corretamente a responsabilidade da fase Load.

Link permanente: /questoes/fg106568