← Questões de Banco de Dados

Banco de Dados · CONSULPLAN · 2023

Questão comentada de Banco de Dados

Dados massivos são grandes grupos de dados que podem ser capturados, comunicados, agregados, armazenados e analisados. Uma das plataformas de processamento de dados massivos mais conhecidas é o Apache Hadoop. Sobre tal plataforma, assinale a afirmativa correta.

Gabarito: A

Apache Hadoop é uma plataforma de software de código aberto criada para lidar com grandes volumes de dados em ambiente distribuído. A ideia central é simples: dividir o trabalho entre várias máquinas, em vez de tentar resolver tudo em um único computador gigante. Isso traz escalabilidade horizontal, tolerância a falhas e uso de hardware comum, o que derruba o custo da operação. O Hadoop ficou famoso por seu ecossistema, especialmente pelo HDFS para armazenamento distribuído e pelo MapReduce para processamento paralelo. Na prática, ele foi pensado para dados massivos, não para arquivos pequenos e triviais, porque o ganho aparece quando o volume é realmente grande. Então, quando a questão fala em grandes grupos de dados e plataforma conhecida de processamento, ela está apontando exatamente para esse modelo. O gabarito é a letra A porque o Apache Hadoop é a implementação mais popular, de código aberto, do paradigma MapReduce. Em outras palavras, ele se tornou a referência clássica para processamento distribuído de grandes massas de dados, com execução paralela em cluster e tolerância a falhas. As demais alternativas tentam inverter características essenciais: Hadoop não é verticalmente escalável, pelo contrário, ele se destaca pela escalabilidade horizontal; também não depende de máquinas especiais, nem impede uso em nuvem. É aquele tipo de questão que testa se você conhece o “DNA” do Hadoop, e não só o nome bonito.

Continue treinando

Questões relacionadas