Questão de Banco de Dados — Big Data — CESPE / CEBRASPE 2024
Banco de Dados›Big Data
Código
ce167020
Banca
CESPE / CEBRASPE
Órgão
ANATEL
Ano
2024
Nível
Superior
Cargo
Especialista em Regulação de Serviços Públicos de Telecomunicações – Especialidade: Ciências de Dados
A respeito de Big Data, julgue o próximo item.Pipelines de dados apresentam uma única estrutura para o recebimento dos dados originados de uma fonte não confiável.
CCerto
EErrado
Revelar gabarito e comentário▾
GabaritoE — Errado
Comentário gerado por IA. É um apoio ao estudo, ancorado em fontes, mas pode conter imprecisões — confira sempre na fonte oficial (lei, súmula, edital e gabarito da banca). Encontrou um erro? Use “Reportar”.
Big Data – Pipelines de dados
Gabarito: ❌ ERRADO. A afirmação de que pipelines de dados apresentam uma única estrutura para recebimento de dados de uma fonte não confiável é incorreta. Pipelines de dados em Big Data são projetados para lidar com múltiplas fontes heterogêneas, exigindo estruturas flexíveis e adaptáveis, especialmente quando a fonte é não confiável — nesse caso, mecanismos de validação, transformação e roteamento são comuns, e não uma única estrutura fixa.
O item tenta generalizar indevidamente. Na prática, um pipeline pode ter diversos estágios (ingestão, processamento, armazenamento) e conectar-se a diferentes sistemas, cada um com suas próprias características. Fontes não confiáveis frequentemente demandam tratamento especial (ex.: limpeza, deduplicação, normalização), o que inviabiliza uma estrutura única e padronizada.
NÃO CAIA NESSA!
A banca explora a noção simplista de que pipelines são monolíticos. Na realidade, pipelines de Big Data são altamente flexíveis e podem conter múltiplos caminhos, adaptadores e camadas de qualidade, principalmente ao lidar com dados não confiáveis. Atenção para não cair na armadilha da generalização.