Construído(a) em arquitetura distribuída em grande escala, com capacidade de armazenar e processar conjuntos de dados não estruturados, a fim de agrega-los sobre clientes de diferentes fontes, enriquecê-los, limpá-los e analisa-los para entender melhor às jornadas dos clientes caracteriza um(a)
- A)virtualização de dados.
Errada, porque virtualização de dados integra e acessa fontes sem necessariamente copiar os dados para um repositório de grande escala.
- B)storage de objetos.
Errada, porque storage de objetos é uma tecnologia de armazenamento, mas não descreve a arquitetura analítica voltada a ingestão, limpeza e exploração de dados variados.
- C)data lake.
Certa, porque data lake armazena grandes volumes de dados estruturados e não estruturados para posterior tratamento e análise.
- D)desktop como serviço (DaaS).
Errada, porque DaaS é desktop como serviço, isto é, entrega de ambiente de trabalho virtual, sem relação com análise de dados de clientes.
- E)software como serviço (SaaS).
Errada, porque SaaS é um modelo de disponibilização de software pela internet, não uma arquitetura de dados para processar informações em grande escala.
Gabarito: C
A questão descreve uma solução feita para guardar e tratar dados em grande volume, inclusive dados não estruturados, com foco em integrar informações de várias fontes, limpá-las, enriquecê-las e depois analisá-las. Isso é bem a cara de um data lake: um repositório pensado para receber dados em estado bruto e permitir exploração posterior, sem a rigidez de um banco relacional tradicional. Repare no conjunto de pistas do enunciado: arquitetura distribuída em grande escala, armazenamento de dados não estruturados e uso para análise das jornadas dos clientes. Tudo isso combina com ambientes modernos de dados, nos quais a organização acontece para viabilizar analytics, e não para deixar cada dado “bonitinho” logo de início. O data lake funciona como um grande reservatório de dados de várias origens, onde você pode colocar dados estruturados, semiestruturados e não estruturados. Depois, esses dados podem ser preparados, combinados e analisados conforme a necessidade do negócio. Em prova, a palavra-chave costuma ser justamente essa mistura de volume, variedade e análise avançada. Por isso, o gabarito é a letra C. As demais alternativas descrevem outras coisas: virtualização de dados é uma camada de integração lógica, storage de objetos é um tipo de armazenamento, DaaS é desktop remoto e SaaS é modelo de entrega de software. Ou seja, a questão pede a plataforma/arquitetura de dados, não um serviço de desktop ou software pronto.