Pular para o conteúdo principal

Questão de Banco de Dados — Big Data — FGV 2023

Banco de DadosBig Data
Código
fg070553
Banca
FGV
Órgão
SMF-RJ
Ano
2023
Nível
Superior
Cargo
Fiscal de Rendas
No contexto de Big Data, para armazenar petabytes de dados não estruturados, semiestruturados e estruturados, com alto nível de heterogeneidade, é necessário um banco de dados que:
  1. Ause SQL como padrão;
  2. Bgaranta as propriedades ACID;
  3. Ctenha esquemas de dados dinâmicos;
  4. Dutilize um SBGD central e local com estrutura sequencial de processamento;
  5. Epersista dados em tabelas relacionais como estrutura única de armazenamento.
Revelar gabarito e comentário

GabaritoC — tenha esquemas de dados dinâmicos;

Comentário gerado por IA. É um apoio ao estudo, ancorado em fontes, mas pode conter imprecisões — confira sempre na fonte oficial (lei, súmula, edital e gabarito da banca). Encontrou um erro? Use “Reportar”.

Big Data: armazenamento de dados heterogêneos

Gabarito: letra C. No Big Data, a alta heterogeneidade de dados (estruturados, semiestruturados e não estruturados) exige um banco de dados com esquemas de dados dinâmicos, ou seja, que não imponha uma estrutura rígida predefinida. Essa flexibilidade é alcançada com o conceito de schema-on-read (esquema definido no momento da leitura), ao contrário dos bancos relacionais tradicionais (schema-on-write). As demais alternativas descrevem características inadequadas para o cenário descrito.

Alternativa A — ❌ Incorreta

Afirma que o banco de dados deve usar SQL como padrão. O SQL é a linguagem padrão para bancos relacionais, que impõem rigidez de esquema. No Big Data, utilizam-se diferentes modelos de dados (NoSQL, Hadoop, etc.) que dispensam ou adaptam o SQL. A variedade de dados exige múltiplas formas de consulta, não apenas SQL.

Alternativa B — ❌ Incorreta

Afirma que o banco de dados deve garantir as propriedades ACID (Atomicidade, Consistência, Isolamento, Durabilidade). O Big Data frequentemente adota o modelo BASE (Basically Available, Soft State, Eventually Consistent) para escalabilidade e disponibilidade em sistemas distribuídos. As propriedades ACID são típicas de bancos relacionais, não adequadas para o volume e heterogeneidade do Big Data.

Alternativa C — ✅ Correta ⟵ GABARITO

A alternativa está correta: esquemas de dados dinâmicos são essenciais para acomodar dados não estruturados e semiestruturados, permitindo que a estrutura seja inferida ou definida no momento da análise (schema-on-read). Bancos NoSQL (como MongoDB, Cassandra) exemplificam essa flexibilidade.

Alternativa D — ❌ Incorreta

Afirma que o banco de dados deve utilizar um SGBD central e local com estrutura sequencial de processamento. O Big Data opera em sistemas distribuídos (cluster de máquinas) e utiliza processamento paralelo (ex.: MapReduce, Spark). Um SGBD central e sequencial não atende à escalabilidade horizontal necessária para petabytes de dados.

Alternativa E — ❌ Incorreta

Afirma que os dados devem persistir em tabelas relacionais como estrutura única de armazenamento. Tabelas relacionais são adequadas para dados estruturados, mas no Big Data há forte presença de dados semiestruturados (XML, JSON) e não estruturados (imagens, áudio, texto), que não se encaixam em esquema de tabelas fixas.

PEGA ESSA DICA!

Para fixar: Big Data ≠ Banco relacional. Palavras-chave: volume, velocidade, variedade, veracidade, valor (5 V's). Lembre-se de que o esquema dinâmico (schema-on-read) é a antítese do esquema rígido dos bancos SQL. Nas provas, associe Big Data a NoSQL, distribuição, BASE e flexibilidade.

Gabarito: letra C

Link permanente: /questoes/fg070553