Local synthesis for disclosure limitation that satisfies probabilistic k-anonymity criterion

Oganian, A; Domingo-Ferrer, J

Dades identificatives

Identificador: imarina:9282651

Handle: https://hdl.handle.net/20.500.11797/imarina9282651

Autors: Oganian, A; Domingo-Ferrer, J

Resum:
Before releasing databases which contain sensitive information about individuals, data publishers must apply Statistical Disclosure Limitation (SDL) methods to them, in order to avoid disclosure of sensitive information on any identifiable data subject. SDL methods often consist of masking or synthesizing the original data records in such a way as to minimize the risk of disclosure of the sensitive information while providing data users with accurate information about the population of interest. In this paper we propose a new scheme for disclosure limitation, based on the idea of local synthesis of data. Our approach is predicated on model-based clustering. The proposed method satisfies the requirements of k-anonymity; in particular we use a variant of the k-anonymity privacy model, namely probabilistic k-anonymity, by incorporating constraints on cluster cardinality. Regarding data utility, for continuous attributes, we exactly preserve means and covariances of the original data, while approximately preserving higher-order moments and analyses on subdomains (defined by clusters and cluster combinations). For both continuous and categorical data, our experiments with medical data sets show that, from the point of view of data utility, local synthesis compares very favorably with other methods of disclosure limitation including the sequential regression approach for synthetic data generation. © 2017, University of Skovde. All rights reserved.
Altres:

Enllaç font original: https://www.tdp.cat/issues16/vol10n01.php
Referència de l'ítem segons les normes APA: Oganian, A; Domingo-Ferrer, J (2017). Local synthesis for disclosure limitation that satisfies probabilistic k-anonymity criterion. Transactions On Data Privacy, 10(1), 61-81
Referència a l'article segons font original: Transactions On Data Privacy. 10 (1): 61-81
Any de publicació de la revista: 2017-04-01
Entitat: Universitat Rovira i Virgili
Versió de l'article dipositat: info:eu-repo/semantics/publishedVersion
Data d'alta del registre: 2026-05-09
Autor/s de la URV: Domingo Ferrer, Josep / OGANIAN, ANNA
Departament: Enginyeria Informàtica i Matemàtiques
URL Document de llicència: https://repositori.urv.cat/ca/proteccio-de-dades/
Tipus de publicació: Journal Publications
Autor segons l'article: Oganian, A; Domingo-Ferrer, J
Accès a la llicència d'ús: https://creativecommons.org/licenses/by/3.0/es/
Àrees temàtiques: Statistics and probability, Software, Computer science, theory & methods, Ciência da computação, Administração pública e de empresas, ciências contábeis e turismo
Adreça de correu electrònic de l'autor: josep.domingo@urv.cat, josep.domingo@urv.cat, josep.domingo@urv.cat, josep.domingo@urv.cat

Paraules clau:

Synthetic data generations
Synthetic data
Statistical disclosure limitations
Statistical disclosure limitation (sdl)
Sensitive informations
Probabilistic k-anonymity
Privacy
Population statistics
Mixture model
Maximum principle
K-anonymity
Expectation-maximization algorithms
Expectation-maximization (em) algorithm
Disclosure limitations
Data privacy
utility
risk
microaggregation
Computer Science
Theory & Methods
Software
Statistics and Probability
Ciência da computação
Administração pública e de empresas
ciências contábeis e turismo
Documents:

DocumentPrincipal
Cerca a google

Local synthesis for disclosure limitation that satisfies probabilistic k-anonymity criterion

Dades identificatives

Altres:

Paraules clau:

Documents:

Cerca a google