Trainingsdata

Trainingsdata is de verzameling voorbeelden — tekst, beelden, geluiden — waarvan een AI-model zijn patronen leert. Het is de grondstof van machine learning, en de hoeveelheid en vooral de kwaliteit ervan bepalen rechtstreeks hoe goed het model zal werken. Zijn de gegevens onvolledig, verouderd of weerspiegelen ze menselijke vooroordelen, dan erft het model die gebreken: daar komt bias vandaan. Het roept ook belangrijke vragen op over privacy en auteursrecht, afhankelijk van waar het is verkregen. De kennis van een model is "bevroren" op het moment van de training, dus het kent latere feiten niet, tenzij er externe bronnen aan worden gekoppeld. Begrijpen van welke gegevens een AI leert, helpt je te beoordelen waarvoor het wel en niet te vertrouwen is.

Artikelen waarin het voorkomt