Com relação às linguagens de programação para ciência de dados, linguagem Python e R, avalie cada afirmativa a seguir e assinale (V) para a verdadeira e (F) para a falsa. ( ) No Oracle R Enterprise, a execução do R incorporado (ou Embedded R) possibilita a chamada de scripts do R em sessões do R executadas no servidor do Oracle Database. ( ) A interoperabilidade entre Python e R pode ser estabelecida pelo pacote reticulate do R, que possibilita que no código R sejam utilizadas ambas as abordagens, em documentos R Markdown e no IDE RStudio. ( ) Os principais pacotes para manipulação de dados são o dplyr, para o R, e o Scikit-learn, para o Python. As afirmativas são, respectivamente,
- A)F – F – F.
Errada, porque as duas primeiras afirmativas sao verdadeiras e a terceira eh falsa.
- B)V – F – F.
Errada, porque a primeira e a segunda afirmativas sao verdadeiras, nao falsas.
- C)V – V – F.
Certa, pois a primeira e a segunda afirmativas sao verdadeiras e a terceira e falsa.
- D)F – V – V.
Errada, porque a primeira afirmativa nao eh falsa e a terceira nao eh verdadeira.
- E)V – V – V.
Errada, porque a terceira afirmativa eh falsa, ja que Scikit-learn nao eh o principal pacote de manipulacao de dados em Python.
Gabarito: C
Quando o assunto eh Python e R para ciencia de dados, a banca costuma misturar ferramentas de analise, manipulacao de dados e interoperabilidade entre linguagens. O ponto principal aqui eh separar o que cada pacote faz de verdade: nem todo pacote famoso de Python serve para manipulacao de dados, e nem toda integracao entre R e Python acontece do mesmo jeito. Na primeira afirmativa, o Oracle R Enterprise realmente permite trabalhar com R dentro do ambiente Oracle, inclusive com o Embedded R, que executa codigo R mais proximo do banco, viabilizando chamadas e processamento no servidor do Oracle Database. Em prova, isso costuma aparecer como integracao entre R e o ecossistema Oracle, e a ideia central da afirmativa esta correta. Na segunda afirmativa, o pacote reticulate eh justamente o caminho classico para integrar R e Python. Ele permite usar codigo Python dentro de scripts R, inclusive em fluxos com R Markdown e no RStudio. Essa interoperabilidade eh bem conhecida e muito cobrada em contexto de ciencia de dados. Ja a terceira afirmativa escorrega bonito: dplyr eh de fato um pacote central do R para manipulacao de dados, mas o Scikit-learn nao eh pacote de manipulacao de dados; ele eh voltado principalmente para machine learning. Para manipular dados em Python, seria mais natural pensar em pandas. Por isso, o gabarito C faz sentido: V, V e F.