Questão de Sistemas Operacionais — Apache — FGV 2024
Sistemas Operacionais›Apache
Código
fg079822
Banca
FGV
Órgão
DATAPREV
Ano
2024
Nível
Superior
Cargo
ATI - Inteligência da Informação
O Apache Spark é uma ferramenta amplamente utilizada para processamento de grandes volumes de dados.Assinale a opção que o descreve corretamente, assim como suas capacidades e suas funcionalidades.
AO Apache Spark é um sistema de armazenamento distribuído de arquivos que gerencia grandes volumes de dados por meio de replicação e fragmentação, com foco na segurança e no versionamento dos arquivos.
BO Apache Spark é um framework de computação distribuída que permite o processamento rápido de grandes volumes de dados, suportando operações em tempo real e por lote, além de fornecer bibliotecas para machine learning e gráficos.
CO Apache Spark é uma plataforma de análise de dados especializada em bancos de dados relacionais, permitindo consultas SQL em tempo real e fornecendo ferramentas de visualização integradas.
DO Apache Spark é um sistema de gerenciamento de filas que prioriza a execução de tarefas paralelas em ambientes distribuídos, garantindo que as tarefas sejam executadas de acordo com a capacidade da infraestrutura.
EO Apache Spark é um sistema de controle de versões distribuído que facilita o gerenciamento colaborativo de projetos de dados e código, permitindo a reversão de alterações e o controle detalhado de permissões.
Revelar gabarito e comentário▾
GabaritoB — O Apache Spark é um framework de computação distribuída que permite o processamento rápido de grandes volumes de dados, suportando operações em tempo real e por lote, além de fornecer bibliotecas para machine learning e gráficos.
Comentário gerado por IA. É um apoio ao estudo, ancorado em fontes, mas pode conter imprecisões — confira sempre na fonte oficial (lei, súmula, edital e gabarito da banca). Encontrou um erro? Use “Reportar”.
Apache Spark
Gabarito: letra B. O Apache Spark é um framework de computação distribuída para processamento de grandes volumes de dados, com suporte a operações batch e streaming, além de bibliotecas para machine learning (MLlib) e processamento de grafos (GraphX). A alternativa B descreve exatamente essas características. As demais alternativas confundem o Spark com outras tecnologias.
Alternativa A — ❌ Incorreta
Descreve um sistema de armazenamento distribuído de arquivos, como o HDFS (Hadoop Distributed File System). O Spark não é um sistema de arquivos, e sim um motor de processamento que pode ler de várias fontes, incluindo HDFS.
Alternativa B — ✅ Correta ⟵ GABARITO
Correta. O Spark é de fato um framework de computação distribuída que oferece processamento rápido, suporta operações em lote e em tempo real (via Spark Streaming), e inclui bibliotecas como MLlib e GraphX.
Alternativa C — ❌ Incorreta
Descreve uma plataforma de bancos de dados relacionais com SQL em tempo real. O Spark possui módulo Spark SQL, mas não é especializado em bancos relacionais; ele é um motor de processamento que pode consultar dados estruturados, mas não oferece ferramentas de visualização integradas como Power BI ou Tableau.
Alternativa D — ❌ Incorreta
Descreve um sistema de gerenciamento de filas (como RabbitMQ ou Apache Kafka). O Spark não é um gerenciador de filas; ele processa dados, não gerencia filas de tarefas.
Alternativa E — ❌ Incorreta
Descreve um sistema de controle de versão distribuído (como Git). O Spark não é um sistema de versionamento; é um motor de processamento de dados.
NÃO CAIA NESSA!
Lembre-se que o Apache Spark é um framework de processamento distribuído, focado em velocidade e facilidade de uso. Não confunda com o Apache Hadoop (que inclui HDFS e MapReduce), nem com o Apache Kafka (mensageria) ou Apache HTTP Server (servidor web). A pegadinha clássica é associar Spark a armazenamento (A) ou a SQL puro (C).