O analista João implementou o PStream, um fluxo de tratamento de dados em tempo real, através do Apache Kafka. O PStream é alimentado pela captura em tempo real das alterações feitas em uma base de dados relacional. Para configurar esta captura de dados relacionais para o PStream, João recorreu aos mecanismos do Apache Kafka para integração com outros sistemas. Esses mecanismos de integração utilizados por João para integrar o Apache Kafka com outros sistemas são baseados na Application Programming Interface (API) do Apache Kafka:
- A)Admin;
Errada, porque a API Admin serve para administração do cluster Kafka, não para integração com bases relacionais.
- B)Connect;
Certa, porque a API Connect é usada para integrar o Kafka com outros sistemas e fazer captura/replicação de dados de fontes externas.
- C)Streams;
Errada, porque a API Streams é voltada ao processamento de dados em fluxo dentro do ecossistema Kafka, não à integração com sistemas externos.
- D)Producer;
Errada, porque a API Producer é usada para publicar mensagens em tópicos, não para capturar alterações de banco de dados.
- E)Consumer.
Errada, porque a API Consumer é usada para consumir mensagens dos tópicos, não para integrar o Kafka com uma base relacional.
Gabarito: B
No Apache Kafka, cada API tem uma função bem definida, quase como se cada uma fosse um setor da empresa. A API Producer envia mensagens para os tópicos, a Consumer lê essas mensagens, a Streams trata processamento em fluxo, e a Admin cuida da administração da plataforma. Quando a ideia é integrar o Kafka com sistemas externos, especialmente para capturar dados de bancos, arquivos e outros repositórios, entra em cena o Kafka Connect. O Kafka Connect é justamente a camada pensada para conectar o Kafka a fontes e destinos de dados, com pouco código e muita praticidade. Ele trabalha com conectores prontos ou customizados, facilitando a ingestão de dados de um banco relacional para um fluxo em tempo real. No enunciado, isso aparece como captura das alterações de uma base relacional para o PStream, cenário típico de integração via Connect. Por isso, o gabarito é a letra B. A banca quer que você perceba que não se trata de produzir, consumir, administrar ou processar streams, mas sim de integrar o Kafka a outros sistemas. Em linguagem de prova: quando a questão fala em integração com sistemas externos e captura de dados de uma base relacional, pense em Kafka Connect. Se você lembrar dessa trilha, fica fácil: Producer publica, Consumer lê, Streams processa, Admin gerencia e Connect integra. É o tipo de associação que cai muito em prova porque a banca troca uma API pela outra para ver quem está no modo automático.