Packages

R-packages die het voor analisten en scientists makkelijker maken om met (overheids)data te werken.

Nederland heeft een schat aan open (overheids)data — maar tussen “de data bestaat” en “de data staat in mijn R-omgeving” zitten vaak veel stappen die niet in de gereedschapskist van alle data-analisten en -scientists zitten: API’s, authenticatie, geoformaten, onhandige pdf’s. Ik ontwikkel R-packages die dat gedoe wegnemen, zodat data-analisten en -scientists zich kunnen focussen op waar het om gaat: werken mét de data.

Illustratie van een datastroom die van een overheidsgebouw door een hexagon naar een laptop loopt en onderweg geordend raakt

kvkapiR — het Handelsregister in R

CRAN-versiebadge van kvkapiR

Bedrijfsgegevens uit het Handelsregister rechtstreeks in R: bedrijven zoeken, basis- en vestigingsprofielen ophalen en naamhistorie volgen via de officiële KvK-API’s. Resultaten komen terug als nette tibbles, en ingebouwde kostenbewaking voorkomt verrassingen achteraf. Mijn eerste package op CRAN.

CRAN Documentatie GitHub Blogpost

pdokr — Nederlandse geodata voor iedereen

CRAN-versiebadge van pdokr

Open geodata van PDOK — gemeente- en buurtgrenzen, gebouwen, topografie — direct in R als sf-objecten, zonder API-key. Zoeken, laden, filteren op gebied of jaargang, geocoderen en officiële achtergrondkaarten: alles zonder kennis van OGC-services of WFS-URL’s. Binnenkort ook filteren aan de bron met CQL2.

CRAN Documentatie GitHub Blogpost

pdftextclusteR — tekst uit complexe pdf’s

In ontwikkeling

Veel (beleids)documenten bestaan alleen als pdf met meerdere kolommen en tekstkaders — en dan raakt klassieke tekstextractie de samenhang kwijt. pdftextclusteR herstelt die samenhang met density-based clustering (DBSCAN), zodat de tekst per blok netjes bij elkaar blijft voor verdere analyse. Nog niet op CRAN; installeren kan via GitHub.

Documentatie GitHub

Suggesties, bugmeldingen of ideeën voor nieuwe packages? Meld het op GitHub bij het betreffende package, of neem contact op.