Considerando que o Hadoop Distributed File System (HDFS) é um sistema de arquivos distribuídos otimizados para atuar em dados não estruturados, assinale a afirmativa correta.
- A)Por se tratar de uma arquitetura segura, o componente DataNode nunca deixa de funcionar.
Errada, porque o DataNode pode falhar e o HDFS foi desenhado justamente para tolerar falhas por meio de redundância e replicação.
- B)O HDFS não utiliza replicação de blocos, uma vez que o bloco é bloqueado (lock) para leitura.
Errada, pois o HDFS utiliza replicação de blocos para aumentar a disponibilidade e a tolerância a falhas.
- C)O namespace do HDFS é replicado em um arquivo chamado EditLog, armazenado no diretório FSImage.
Errada, porque o EditLog não é o namespace replicado em FSImage; o FSImage é a imagem persistida do namespace, enquanto o EditLog registra as alterações.
- D)Trata-se de um sistema de arquivos distribuído e tolerante a falhas; não é capaz de executar sobre hardware de baixo custo, dada sua especificidade.
Errada, porque o HDFS foi pensado para rodar em hardware comum e de baixo custo, e não depende de máquinas especiais.
- E)Em um cluster HDFS, a função do NameNode é gerenciar o namespace e os metadados do sistema, além de controlar o acesso e a distribuição dos arquivos.
Certa, pois o NameNode gerencia o namespace, os metadados e a coordenação do acesso e da distribuição dos arquivos no cluster.
Gabarito: E
O HDFS (Hadoop Distributed File System) foi criado para guardar grandes volumes de dados, especialmente arquivos muito grandes e pouco estruturados, com foco em escalabilidade e tolerância a falhas. A lógica dele é simples: em vez de depender de uma máquina poderosa, ele espalha os dados por vários nós do cluster, que normalmente usam hardware comum e barato. Isso é uma das ideias centrais do Hadoop: crescer “na horizontal”, somando máquinas, e não comprando um supercomputador. No HDFS, o NameNode é o cérebro do sistema. Ele não guarda o conteúdo dos arquivos, mas controla o namespace, os metadados, as permissões, a localização dos blocos e a organização geral do armazenamento. Já os DataNodes são os responsáveis por guardar, ler e escrever os blocos de dados. Em outras palavras: o NameNode manda, os DataNodes executam. A alternativa E está correta porque descreve exatamente essa função do NameNode: gerenciar o namespace e os metadados do sistema e coordenar o acesso e a distribuição dos arquivos. Isso é clássico em qualquer resumo doutrinário sobre Hadoop. Além disso, o HDFS trabalha com replicação de blocos justamente para garantir tolerância a falhas, então não faz sentido dizer que um bloco fica “bloqueado” para leitura ou que o sistema dispensa replicação. Resumo de prova: se aparecer NameNode, pense em metadados e organização; se aparecer DataNode, pense em armazenamento físico dos blocos. Essa dupla é uma das favoritas de banca, porque confunde fácil quem mistura “onde está o arquivo” com “quem sabe onde o arquivo está”.