Pular para o conteúdo principal

Questão de Banco de Dados — BI (Business Intelligence) — FGV 2024

Banco de DadosBI (Business Intelligence)
Código
fg077069
Banca
FGV
Órgão
CGM de Belo Horizonte - MG
Ano
2024
Nível
Superior
Cargo
Auditor Interno - Ciência da Computação - Manhã
Com relação às tecnologias relacionadas à ciência de dados, analise as afirmativas a seguir e assinale (V) para a verdadeira e (F) para a falsa.( ) Os dashboards gerados no Power BI, da Microsoft, empregando scripts do R, são gerados empregando ‘tecnologia de área restrita’ para proteger os usuários e o serviço contra riscos de segurança.( ) Na Ciência de Dados, os dados estruturados, semiestruturados e não estruturados podem ser digeridos por redes neurais recorrentes (RNN, Recurrent Neural Network), que processavam sequências inteiras em paralelo, ou por grandes modelos de linguagem (LLM, Large Language Models), que empregam processamento sequencial das entradas.( ) No aprendizado de máquina é usual o emprego de Métodos de Reamostragem, como: k-fold (que fatia os dados em k pedaços iguais), repeated k-fold (que repete o método k-fold várias vezes), PCA (Principal Components Analysis, que reduz a quantidade de variáveis) e bootstrap (que reduz os desvios e realizar amostragem dos dados de treino com repetições).As afirmativas são, respectivamente,
  1. AV – F – F.
  2. BF – F – V.
  3. CF – V – F.
  4. DV – V – V.
Revelar gabarito e comentário

GabaritoA — V – F – F.

Comentário gerado por IA. É um apoio ao estudo, ancorado em fontes, mas pode conter imprecisões — confira sempre na fonte oficial (lei, súmula, edital e gabarito da banca). Encontrou um erro? Use “Reportar”.

Tecnologias da Ciência de Dados: Power BI, RNN, LLM e Métodos de Reamostragem

Gabarito: Letra A — V, F, F. A primeira afirmativa é verdadeira: o Power BI utiliza área restrita (sandbox) para execução segura de scripts R. A segunda é falsa porque RNNs processam sequências sequencialmente, não em paralelo, enquanto LLMs (transformers) processam em paralelo, não sequencialmente. A terceira é falsa porque PCA é técnica de redução de dimensionalidade, não um método de reamostragem.

Afirmativa

Conteúdo

Classificação

Motivo

Power BI com scripts R usa “tecnologia de área restrita” (sandbox) para segurança

V

Ambiente isolado padrão em BI moderno

RNN processa sequências em paralelo; LLM processa sequencialmente

F

Inverte: RNN é sequencial; LLM (transformers) é paralelo

PCA é método de reamostragem (k-fold, repeated k-fold, PCA)

F

PCA é redução de dimensionalidade, não reamostragem

1ª afirmativa — ✅ Verdadeira

O Power BI, ao executar scripts em R ou Python, utiliza um ambiente isolado (sandbox) para proteger o serviço e os usuários contra códigos maliciosos. Essa prática é padrão em ferramentas de BI modernas, garantindo segurança sem comprometer a funcionalidade.

2ª afirmativa — ❌ Falsa

A afirmativa inverte o modo de processamento. Redes neurais recorrentes (RNN) processam sequências passo a passo, de forma sequencial — cada estado depende do anterior. Já os grandes modelos de linguagem (LLM), como os baseados em transformers, utilizam o mecanismo de atenção que permite processar toda a sequência em paralelo. Portanto, o correto é: RNN → sequencial; LLM → paralelo.

3ª afirmativa — ❌ Falsa

A PCA (Análise de Componentes Principais) é uma técnica de redução de dimensionalidade, não um método de reamostragem. Métodos de reamostragem comuns incluem k-fold, repeated k-fold e bootstrap, mas PCA não se enquadra nessa categoria. O bootstrap, citado no final, é de fato um método de reamostragem, mas a inclusão de PCA torna a afirmativa incorreta.

Conclusão: A sequência correta é V – F – F, correspondente à letra A.

Link permanente: /questoes/fg077069