A tabela presente no código em R abaixo apresenta a quantidade de processos analisados por três analistas (denotados por A1, A2 e A3) em diferentes anos. dados = tibble::tibble(Analista=c(“A1”, “A1”, “A1”, “A2”, “A2”, “A3”, “A3”, “A3”), Ano=c(2018,2019,2020,2019,2020,2018,2019,2020), Processos=c(10,15,20,25,20,8,7,12)) Um programador roda o código abaixo em R. tidyr::pivot_wider(data=dados, names_from=”Analista”, values_from=”Processos”) Os valores esperados na primeira linha do objeto resultante do comando acima são:
- A)2018, 10, NA, 8;
Correta: na primeira linha, o ano é 2018 e os valores por analista ficam 10 para A1, NA para A2 e 8 para A3.
- B)A1, 10, 15, 20;
Errada: mistura o nome do analista com valores de processos e não respeita a estrutura produzida pelo pivot_wider().
- C)A1, 2018, 10;
Errada: o resultado não começa com o texto A1; o ano permanece como identificador da linha.
- D)2018, 18;
Errada: 2018 sozinho não representa a linha completa gerada pelo comando.
- E)A2, 2019, 25.
Errada: A2, 2019, 25 não corresponde à primeira linha do objeto resultante.
Gabarito: A
O comando pivot_wider() do tidyr faz a tabela “abrir” as categorias de uma coluna em novas colunas. Aqui, o argumento names_from="Analista" indica que os valores de Analista viram nomes de colunas, enquanto values_from="Processos" diz quais valores serão preenchidos nessas colunas. Como o Ano continua existindo na tabela, ele funciona como identificador das linhas. Em outras palavras: cada ano vira uma linha, e cada analista vira uma coluna com a quantidade de processos correspondente. Quando não existe combinação entre ano e analista, o resultado fica NA. É exatamente o que acontece na primeira linha, que corresponde a 2018: A1 tem 10 processos, A2 não aparece nesse ano, e A3 tem 8. Por isso, os valores esperados são 2018, 10, NA, 8.