
Synthetische data simuleren kenmerken van relaties tussen personen en objecten (bijvoorbeeld een school of een wijk), waardoor de realiteit kan worden nagebootst zonder dat de persoon of het object geïdentificeerd wordt. Synthetische data kunnen worden gegenereerd door een algoritme of een computersimulatie. Het voordeel van synthetische data is dat er, afhankelijk van het doel van de gebruiker, een afweging wordt gemaakt tussen de analytische waarde van de dataset en het onthullingsrisico (“fidelity”). Daardoor bestaat de situatie dat wanneer een onderzoek een dataset vereist met een hoge analytische waarde (sterkere overeenkomst met de originele dataset), dit leidt tot een hoger risico op onthulling. Synthetische data worden gebruikt voor privacybescherming en gecontroleerde openbaarmaking. Het gebruik van synthetische data kwalificeert daarom als een Privacy Enhancing Technique (PET).



