Questão de Banco de Dados — Big Data — FGV 2024
- Código
- fg077068
- Banca
- FGV
- Órgão
- CGM de Belo Horizonte - MG
- Ano
- 2024
- Nível
- Superior
- Cargo
- Auditor Interno - Ciência da Computação - Manhã
- AV – V – F.
- BV – F – V.
- CF – V – V.
- DF – F – F.
GabaritoB — V – F – V.
Gabarito: letra B (V – F – V). A primeira afirmativa está correta ao descrever o pipeline de dados; a segunda é falsa, pois normalização não é técnica para valores ausentes; a terceira é verdadeira, pois a criptografia realmente dificulta a deduplicação tradicional.
A seguir, a análise de cada afirmativa e a correspondência com as alternativas.
Define corretamente o pipeline de dados em Big Data: coleta, transformação e armazenamento, transformando dados brutos em preparados. Esse é um conceito fundamental de arquiteturas de Big Data.
Normalização numérica (escalonamento para [0,1]) é uma técnica de pré-processamento para padronizar atributos, não para tratar valores ausentes. Métodos para valores ausentes incluem imputação (média, mediana, moda, regressão) ou remoção de registros.
A banca tenta confundir normalização (ajuste de escala) com imputação de valores ausentes. São técnicas distintas: normalização é para padronização de escalas; imputação é para preencher dados faltantes. Fique atento a esse tipo de troca.
A criptografia ponta a ponta converte dados em texto cifrado, impossibilitando a identificação de duplicatas por comparação direta de conteúdo. Embora existam soluções como criptografia convergente, a eficácia da deduplicação tradicional é reduzida, e a relevância dessas tecnologias legadas diminui.
A segunda afirmativa é falsa, não verdadeira. Portanto, a sequência V-V-F está incorreta.
Corresponde exatamente ao julgamento correto das três afirmativas.
A primeira afirmativa é verdadeira, não falsa. Logo, F-V-V está errada.
A primeira e a terceira afirmativas são verdadeiras, portanto F-F-F é incorreta.
Conclusão: a sequência correta é V – F – V, correspondente à alternativa B.
Link permanente: /questoes/fg077068