国内刊号:51-1307/TP
国际刊号:1001-9081
发布日期:
作者:黄硕, 李艳辉, 曹建秋
单位:重庆交通大学 信息科学与工程学院,重庆 400074
关键词:本地化差分隐私,隐私保护,频繁序列模式挖掘,指数机制,数据挖掘
基金:国家自然科学基金资助项目(62002036);上海市信息安全综合管理技术研究重点实验室开放课题(AGK2020006);重庆市自然科学基金资助项目(cstc2021jcyj-msxmX0859);重庆市教育委员会科学技术研究项目(KJQN202000707)
序列数据中可能包含大量敏感信息,因此直接对序列数据的频繁模式进行挖掘存在泄露用户隐私信息的风险。本地化差分隐私(LDP)能够抵御具有任意背景知识的攻击者,可以对敏感信息提供更全面的保护。序列数据内在序列性和高维度的特点为LDP应用于频繁序列模式挖掘带来了挑战。为解决这个问题,提出一种满足ε-LDP的top-k频繁序列模式挖掘算法PrivSPM。该算法结合填充和采样技术、自适应频率估计算法与频繁项预测技术来构造候选集;基于新域,利用基于指数机制的策略对用户数据进行扰动,并结合频率估计算法识别最终的频繁序列模式。理论分析证明了该算法满足ε-LDP。在3个真实数据集上的实验结果表明,PrivSPM算法在纳真率(TPR)和归一化累积排名(NCR)上明显高于对比算法,能有效提高挖掘结果的准确度。
来源:2023年第7期
《计算机应用》期刊编辑部