Questão de Banco de Dados — Big Data — Quadrix 2023
- Código
- qg026538
- Banca
- Quadrix
- Órgão
- CREF - 3ª Região (SC)
- Ano
- 2023
- Nível
- Superior
- Cargo
- Analista de Tecnologia da Informação
- CCerto
- EErrado
GabaritoC — Certo
Gabarito: letra C (Certo). A afirmativa está correta porque uma das premissas do Big Data é justamente a capacidade de armazenar grandes volumes de dados de forma indiscriminada, ou seja, sem a necessidade de tratamento ou estruturação prévia — característica típica do Data Lake, que armazena dados brutos, de todos os tipos (estruturados, semiestruturados e não estruturados). Essa premissa contrasta com o modelo relacional tradicional, que exige estruturação e modelagem antes do armazenamento.
O Big Data é um paradigma que lida com conjuntos de dados extremamente volumosos, gerados em alta velocidade e com grande variedade de formatos. Diferentemente dos bancos de dados relacionais, que exigem um esquema rígido e dados limpos, o Big Data — especialmente em arquiteturas como o Data Lake — permite armazenar os dados da forma como foram capturados, sem tratamento prévio. Essa é uma das grandes vantagens: a flexibilidade de armazenar tudo, para depois decidir como usar.
O conceito de Big Data é frequentemente resumido pelos "3 V's": Volume (grande quantidade de dados), Velocidade (rapidez na geração e processamento) e Variedade (diferentes formatos e fontes). Posteriormente, foram adicionados outros V's, como Veracidade (confiabilidade dos dados) e Valor (utilidade para o negócio). A capacidade de armazenar dados de forma indiscriminada está diretamente ligada ao Volume e à Variedade, pois permite acumular dados de todas as naturezas sem filtro inicial.
Na prática, um Data Lake é o exemplo perfeito: ele armazena dados brutos, sem limpeza ou organização, prontos para serem explorados por cientistas de dados. Já um Data Warehouse armazena apenas dados tratados e estruturados, voltados para usuários operacionais. Essa distinção é fundamental para entender a afirmativa.
A pegadinha da banca está em confundir a característica de armazenamento indiscriminado com a de processamento ou com a de modelagem. Muitos candidatos podem pensar que, por ser "indiscriminado", o armazenamento não é uma característica do Big Data, mas sim uma falha. Na verdade, é uma premissa: o Big Data aceita tudo, e a inteligência está em extrair valor depois.
A banca explora a confusão entre armazenar indiscriminadamente (característica do Big Data/Data Lake) e armazenar de forma estruturada (característica do banco relacional/Data Warehouse). O candidato que associa Big Data apenas a dados estruturados tende a marcar "Errado", mas a essência do Big Data é justamente a diversidade e a ausência de tratamento prévio.
A afirmativa está correta. O Big Data, por definição, é capaz de armazenar dados de forma indiscriminada, ou seja, sem exigir que eles sejam estruturados ou tratados antes do armazenamento. Isso é evidenciado pela existência do Data Lake, que armazena dados brutos de todos os tipos (estruturados, semiestruturados e não estruturados), e pela própria natureza do Big Data, que lida com grande volume, velocidade e variedade de dados. A capacidade de armazenar indiscriminadamente é uma premissa que permite a análise posterior de dados que, à primeira vista, não teriam valor.
A afirmativa não está errada. Ela descreve corretamente uma característica do Big Data. Quem marca "Errado" provavelmente confunde o Big Data com bancos de dados relacionais tradicionais, que exigem modelagem e estruturação prévia. No Big Data, especialmente em arquiteturas como o Data Lake, os dados são armazenados da forma como são capturados, sem tratamento, o que é exatamente o que a afirmativa diz.
Gabarito: letra C
Link permanente: /questoes/qg026538