Pular para o conteúdo principal

Questão de Banco de Dados — Banco de Dados Relacionais — FGV 2023

Banco de DadosBanco de Dados Relacionais
Código
fg065320
Banca
FGV
Órgão
PGM - Niterói
Ano
2023
Nível
Superior
Cargo
Analista de Tecnologia da Informação
O analista João implementou o PStream, um fluxo de tratamento de dados em tempo real, através do Apache Kafka. O PStream é alimentado pela captura em tempo real das alterações feitas em uma base de dados relacional. Para configurar esta captura de dados relacionais para o PStream, João recorreu aos mecanismos do Apache Kafka para integração com outros sistemas.Esses mecanismos de integração utilizados por João para integrar o Apache Kafka com outros sistemas são baseados na Application Programming Interface (API) do Apache Kafka:
  1. AAdmin;
  2. BConnect;
  3. CStreams;
  4. DProducer;
  5. EConsumer.
Revelar gabarito e comentário

GabaritoB — Connect;

Comentário gerado por IA. É um apoio ao estudo, ancorado em fontes, mas pode conter imprecisões — confira sempre na fonte oficial (lei, súmula, edital e gabarito da banca). Encontrou um erro? Use “Reportar”.

Apache Kafka: APIs de Integração

Gabarito: letra B. A API Kafka Connect é a responsável por realizar a integração do Apache Kafka com sistemas externos, como bancos de dados relacionais, por meio de conectores reutilizáveis que importam ou exportam dados em tempo real. As demais APIs possuem finalidades distintas: Admin (gerenciamento), Streams (processamento de fluxos), Producer (escrita) e Consumer (leitura).

A questão exige o conhecimento das APIs do Apache Kafka, especialmente a que permite capturar alterações de um banco de dados relacional. A descrição do enunciado — "captura em tempo real das alterações feitas em uma base de dados relacional" — remete diretamente ao Kafka Connect, que disponibiliza conectores para fontes como PostgreSQL, MySQL, entre outros.

API do Apache Kafka

Função Principal

Relação com Integração Externa

Exemplo de Uso

Admin

Gerenciar e inspecionar tópicos, brokers e configurações do cluster

Não realiza integração com sistemas externos

Criar ou deletar tópicos

Connect

Criar e executar conectores reutilizáveis para importar/exportar dados

Sim, é a API específica para integração com bancos de dados e outros sistemas

Capturar alterações de um banco relacional (CDC)

Streams

Processar fluxos de dados dentro do Kafka (transformações, agregações)

Não realiza integração com fontes externas; opera sobre dados já no Kafka

Agregar eventos de um tópico em tempo real

Producer

Publicar (escrever) eventos em tópicos do Kafka

Não é voltada para integração com sistemas externos; é a interface de escrita

Enviar mensagens para um tópico

Consumer

Ler eventos de tópicos do Kafka

Não é voltada para integração com sistemas externos; é a interface de leitura

Processar mensagens de um tópico

Alternativa A — ❌ Incorreta

A API Admin é utilizada para gerenciar e inspecionar tópicos, brokers e outras configurações do cluster Kafka. Não é voltada para integração com sistemas externos, mas sim para administração do próprio Kafka.

Alternativa B — ✅ Correta ⟵ GABARITO

A API Kafka Connect permite criar e executar conectores de importação/exportação de dados reutilizáveis. Esses conectores consomem (leem) ou produzem (gravam) fluxos de eventos de e para sistemas externos — exatamente o que João precisa para capturar as alterações do banco relacional e alimentar o PStream.

Conteúdo de apoio (paráfrase): O Kafka Connect API permite criar conectores para importar/exportar dados de sistemas externos, como bancos de dados relacionais, integrando-os ao Kafka.

Alternativa C — ❌ Incorreta

A API Kafka Streams é uma biblioteca para processamento de fluxo de dados dentro do Kafka. Ela permite implementar aplicações que transformam, agregam e juntam fluxos, mas não realiza a integração com fontes externas — ela opera sobre dados já dentro do Kafka.

Alternativa D — ❌ Incorreta

A API Producer é utilizada para publicar (escrever) eventos em tópicos do Kafka. Ela é uma das pontas do sistema de mensageria, mas não é a responsável por se conectar a bancos de dados relacionais ou outros sistemas externos; é apenas a interface de escrita dos clientes.

Alternativa E — ❌ Incorreta

A API Consumer permite assinar (ler) tópicos e processar os eventos. Assim como a Producer, é uma API de comunicação com o Kafka, mas não oferece conectores para integração com sistemas externos.


PEGA ESSA DICA!

Decore as quatro APIs principais do Kafka e suas funções: Producer (escreve), Consumer (lê), Streams (processa fluxos internos) e Connect (integra com sistemas externos). A banca costuma cobrar a diferença entre elas, especialmente o Connect, que é a peça-chave para cenários de ingestão de dados de bancos relacionais, logs, etc.

Gabarito: letra B.

Link permanente: /questoes/fg065320