Ronde Tafel: Hoe kunnen we verantwoord omgaan met NLP rondom metadata bij informatieobjecten?
Wie: Guido Ongena en Erik Slingerland (Hogeschool Utrecht)
Waar: KINO 6
Wanneer: 15:35 - 16:05
Metadatering van informatieobjecten vormt de basis van goede informatiehuishouding. De omvang van verkeerd of ontbrekende metadata bij bestaande informatieobjecten zorgt voor onvindbare documenten en schaadt de transparantie naar de maatschappij. De afgelopen jaren is natural language processing (NLP) in meerdere domeinen toegepast om te assisteren bij het inzichtelijk maken van grote hoeveelheden data en zelfs het genereren van metadata. Tegelijk komt deze technologie ook met risico’s en ethische kwesties, zoals: hoe valideren we de uitkomsten? Hoe richten we menselijke controle effectief in? En welke vormen van biases in metadata kunnen worden versterkt door het toepassen van NLP?
Wij willen verkennen welke mogelijkheden er zijn om NLP-technieken toe te passen rondom metadata bij informatieobjecten binnen de publieke sector. Hierbij kijken wij verder dan ‘technische performance’, zoals hoe dit past in organisatieprocessen, wat dit doet met mensen die met het systeem in aanraking komen en welke randvoorwaarden spelen bij het experimenteren met NLP in overheidsprocessen. Hiervoor houden wij een rondetafelgesprek over de ervaringen met het toepassen van NLP binnen informatiehuishouding, huidige zorgen en verwachtingen van informatieprofessionals bij het toepassen van NLP en komen tot gerichte usecases waar de impact van NLP-technieken verkend kan worden.
Dr. Guido Ongena is lector Data Driven Government binnen het lectoraat Procesinnovatie en Informatiesystemen van de Hogeschool Utrecht. Hij heeft een focus op datagedreven innovaties binnen de digitale transformatie van (overheids) organisaties.
Erik Slingerland is PD kandidaat binnen het lectoraat Procesinnovatie en Informatiesystemen van de Hogeschool Utrecht. Hij doet onderzoek naar hoe publieke waarden (beter) meegenomen kunnen worden in het ontwerpen, ontwikkelen en evalueren van IT systemen binnen het publieke domein. Hij focust zich hierbij meestal op systemen waar Machine Learning een rol speelt.