Pacotes R
Escrevo pacotes que entregam dado público brasileiro arrumado, direto no R
Dado público brasileiro raramente vem pronto. Está em arquivo de largura fixa, em planilha com cabeçalho de três linhas, atrás de um formulário, ou numa API que devolve JSON aninhado com nomes em maiúsculas. O trabalho de limpar isso é sempre o mesmo, e sempre refeito por quem chega depois.
Escrevi estes pacotes para fazer esse trabalho uma vez, em R, e devolver data.frame arrumado.
No CRAN
O CRAN não é hospedagem: é um portão com revisor humano, verificação em várias plataformas e exigência de documentação e exemplos que rodam. Passei dois pacotes por ele.
educabR
Dados educacionais do INEP — Censo Escolar, IDEB, ENEM, SAEB, Censo da Educação Superior, ENCCEJA, IDD e ENADE. Baixa, descompacta e organiza.
install.packages("educabR")
Versão 1.1.0 no CRAN desde 23/08/2026 · documentação · GitHub
healthbR
Dados de saúde pública brasileiros de várias fontes do DATASUS e do Ministério da Saúde — internações, mortalidade, nascimentos, estabelecimentos, inquéritos como o VIGITEL.
install.packages("healthbR")
Versão 0.2.0 no CRAN desde 15/02/2026 · documentação · GitHub
Em desenvolvimento, no GitHub
Instaláveis com remotes::install_github(). Ainda não os submeti ao CRAN.
cvmdata
Dados abertos da CVM — informações de companhias abertas e fundos, em formato arrumado.
0.2.0.9000 · documentação · GitHub
welfarebR
Dados de assistência social brasileira — programas, benefícios e cobertura.
0.1.0 · GitHub
senado
API de Dados Abertos do Senado Federal, com interface arrumada. É o irmão em R do servidor MCP do Senado.
0.0.0.9000 · GitHub
Por que R, e por que também MCP
Os servidores MCP e estes pacotes são meu ataque ao mesmo problema por lados opostos. O pacote serve quem já está numa análise, escrevendo código, e quer o dado dentro do ambiente onde vai modelar. O servidor MCP serve quem está conversando com um assistente e quer a resposta com fonte, sem escrever código nenhum.
Nenhum dos dois substitui o outro, e os dois dependem da mesma coisa: alguém ter lido a documentação da fonte, descoberto onde ela mente, e escrito isso em código que outra pessoa possa reusar. É esse o trabalho que eu faço.