Plateauplanning
Plateauplanning: Nationale gezondheidsdatacatalogus
In de nationale gezondheidsdata catalogus kunnen datagebruikers bestaande gezondheidsdatasets zoeken en vinden. Datahouders kunnen gezondheidsdatasets publiceren in de catalogus met behulp van metadata aan de hand waarvan de datagebruiker de catalogus kan doorzoeken.
Werkzaamheden per plateau
-
Plateau 4
Optimalisatie catalogus:
Voor Plateau 4 wordt ingezet op de verdere integratie van de data-aanvraag service in de catalogus, het uitbreiden van de catalogus met extra functionaliteiten en front-end optimalisatie, waar mogelijk ondersteund met AI-tooling.
Voorbeelden:
- Een verdere implementatie van verschillende entiteiten in het metadatamodel (naast de
belangrijkste entiteit dataset, ook de entiteiten datasetseries en catalogus, om
samenhang tussen datasets inzichtelijk te maken) - Onderzoeken hoe beschrijvingen van EPDs in de catalogus kunnen landen
- Verbeterde zoekmethoden (verbeteringen aan zoekveld en filters, AI-toepassingen)
Aansluiting met EU
In het HDAB-NL project een pilot uitgevoerd waarin de nationale
gezondheidsdatacatalogus als MVP fungeert. Deze wordt verbonden met de HealthData@EUinfrastructuur, waarbij getest wordt of beschrijvingen van datasets vanuit de nationale gezondheidsdatacatalogus goed weergegeven worden in de centrale Europese catalogus. Dat houdt in dat de beschrijvingen van datasets goedgekeurd worden in de validaties op de Europese catalogus. Daarnaast wordt ook getest of een data-aanvraag die binnenkomt bij HealthData@EU goed doorgezet wordt naar de nationale data-aanvraagservice (HDAB-DAAMs).Metadata
Voor Plateau 4 wordt een releasemanagementcyclus voor het Health-RI metadataschema opgeleverd die afgestemd is op de HealthDCAT-AP ontwikkelingen en de HDAB-NL pilot. Daarnaast wordt een eerste aanpak ontwikkeld met betrekking tot metadata over Real World Data en wordt een analyse uitgevoerd van de beschikbare AI-tooling om efficiënt metadata te generen.
Uitbreiding vindbare data
Gedurende Plateau 4 zal onboarding verlopen via drie routes:
- vanuit regionale knooppunten, via taakgroep P4D9,
- vanuit domeinknooppunten en
- vanuit individuele projecten en/of datahouders, zoals samenwerkingen met kwaliteitsregistraties en (inter)nationale projecten. De regionale en domein knooppunten zullen gedurende het eerste kwartaal een knooppunt-specifiek plan opleveren met een meer gedetailleerde planning van de onboardingsactiviteiten, incl. data typen, aantal datasets, beoogde architectuur, metadata compliance en actualisatiefrequentie, etc.
Om meerdere datatypen uit verschillende bronnen te includeren en de schaalbaarheid van onboarding te verhogen, wordt het onboardingsproces in 2026 per knooppunt uitgebreid. Hiervoor worden meer bronsystemen (bv. zorginformatiesystemen en research data platforms)en meer databronnen (bv. datahouders uit de regio) aan de lokale onboardingsarchitectuur gekoppeld en wordt, waar mogelijk, het onboardingsproces geautomatiseerd. Voor Plateau 4 komt er een extra focus op het onboarden van zorgdata (o.a. data afkomstig uit EPD systemen) door de regionale knooppunten.
- Een verdere implementatie van verschillende entiteiten in het metadatamodel (naast de
-
Plateau 3
In Plateau 3 is de nationale gezondheidsdata-catalogus doorontwikkeld om ervoor te zorgen dat datagebruikers meer datasets kunnen vinden. Een nieuwe versie van het metadataschema is gelanceerd, waarmee datagebruikers dankzij nieuwe en verbeterde filtermogelijkheden sneller en gerichter datasets kunnen vinden. Er is ingezet op opschaalbare onboardingprocessen om de komende jaren het aantal vindbare datasets in de catalogus exponentieel te kunnen laten groeien. Na Plateau 3 bevat de catalogus ruim 450 datasets. Zo zijn er dit jaar datasets vanuit verschillende bronnen en samenwerkingen toegevoegd van nationale datacollecties zoals Nivel, IKNL, Hartwig Medical Foundation, NHR, CBS, RIVM, ZIN en Vektis.
-
Plateau 2
In de nationale catalogus zijn op basis van de minimale metadata uit plateau 1 nu 194 datasets te vinden, die onder andere door de knooppunten beschikbaar zijn gemaakt. De nationale catalogus krijgt in 2025, extra metadatavelden waarop gefilterd kan worden, onder andere op basis van de generieke Health ring.
De Catalogus bevat metadata die een beschrijving geeft over de vindbaar gemaakte data(sets) binnen de catalogus. De beschrijving bevat bijvoorbeeld de datum waarop de dataset is gemaakt, de auteurs, of een URL waar de data te vinden zijn. De metadata in de Nationale Gezondheidsdatacatalogus zijn afkomstig uit een scala aan bronnen en domeinen. Deze kunnen bestaan uit onder andere afbeeldingen, biomaterialen, omics-data, klinische data tot collecties. Onder de EHDS wordt gewerkt aan een specifieke variant van de DCAT standaard voor de gezondheidszorg, de HealthDCAT-AP. Deze zal ook verwerkt worden in de Nationale Gezondheidsdatacatalogus. Hiermee wordt het mogelijk om de datasets uit de catalogus onder de EHDS uiteindelijk ook vindbaar te maken in de Europese datacatalogus.
Het FAIR Datapoint (FDP), als een API om metadata automatisch aan te leveren, is ervaren als een nuttig mechanisme om data in de nationale catalogus te onboarden. Het FDP zal technisch en functioneel verder geoptimaliseerd worden in 2025.Het onboardingproces, inclusief ondersteuning en training, is uitgebreid, wat zorgt voor ondersteuning bij het ontsluiten van (meta)data in de catalogus. De content onboarding-strategie is geformuleerd en momenteel zitten er meer dan 25 actieve projecten in de pijplijn voor onboarding.
-
Plateau 1
De eerste stappen zijn gezet in het neerzetten van een nationale gezondheidsdata catalogus. Een datagebruiker ziet op één plek namelijk www.healthdata.nl een overzicht van beschikbare data (inclusief datasets, collecties, beelden en biomaterialen) (hierna te noemen data) en krijgt informatie waar die zijn aan te vragen.
Een datahouder kan data aanmelden op basis van de minimale vastgestelde metadataset en het beschikbare onboardingsproces. Deze staat beschreven in de wiki. De standaardwijze van omschrijven van data (metadata) en beschikbaar stellen van deze omschrijvingen wordt ook ondersteund in Europese projecten, zoals het Genomic Data Infrastructure (GDI) en EUropean Federation for CAncer IMages (EUCAIM). Daarmee is het mogelijk om de eerste data vanuit verschillende domeinen van gezondheids- en lifescience onderzoek vindbaar te maken vanuit een nationale gezondheidsdata catalogus via de vastgestelde minimale metadataset.
Er zijn nieuwe Health-RI services ter beschikking gekomen, zoals een centrale Fair Data Point (FDP) en een onboardingsproces welke een integraal onderdeel vormen van de Health-RI service catalogus. De betrokkenheid en samenwerking met de regionale knooppunten en stakeholders vanuit het Obstakel Verwijder Traject is cruciaal geweest - samen worden stappen gezet naar het einddoel: een betere gezondheid voor burgers en patiënten door herge/bruik van gezondheids-data met een geïntegreerde gezondheidsdata-infrastructuur voor onderzoek, beleid en innovatie.
Een datahouder kan data aanmelden op basis van de minimale vastgestelde metadataset en het beschikbare onboardingsproces. Deze staat beschreven in de wiki. De standaardwijze van omschrijven van data (metadata) en beschikbaar stellen van deze omschrijvingen wordt ook ondersteund in Europese projecten, zoals het Genomic Data Infrastructure (GDI) en EUropean Federation for CAncer IMages (EUCAIM). Daarmee is het mogelijk om de eerste data vanuit verschillende domeinen van gezondheids- en lifescience onderzoek vindbaar te maken vanuit een nationale gezondheidsdata catalogus via de vastgestelde minimale metadataset.
Er zijn nieuwe Health-RI services ter beschikking gekomen, zoals een centrale Fair Data Point (FDP) en een onboardingsproces welke een integraal onderdeel vormen van de Health-RI service catalogus. De betrokkenheid en samenwerking met de regionale knooppunten en stakeholders vanuit het Obstakel Verwijder Traject is cruciaal geweest - samen worden stappen gezet naar het einddoel: een betere gezondheid voor burgers en patiënten door hergebruik van gezondheids-data met een geïntegreerde gezondheidsdata-infrastructuur voor onderzoek, beleid en innovatie.