王欢,张云峰,张艳.一种基于CFDs规则的修复序列快速判定方法[J].计算机科学,2018,45(3):311-316
一种基于CFDs规则的修复序列快速判定方法
Rapid Decision Method for Repairing Sequence Based on CFDs
投稿时间:2016-12-03  修订日期:2017-04-22
DOI:10.11896/j.issn.1002-137X.2018.03.051
中文关键词:  数据一致性,条件函数依赖,修复序列
英文关键词:Data consistency,Conditional functional dependencies (CFDs),Repairing sequence
基金项目:本文受河北省自然科学基金(F2014409008), 河北省科技计划项目(17210336),廊坊市科技计划项目(2017011042)资助
作者单位
王欢 北华航天工业学院科学技术处 河北 廊坊065000 
张云峰 北华航天工业学院计算机与遥感信息技术学院 河北 廊坊065000 
张艳 北华航天工业学院计算机与遥感信息技术学院 河北 廊坊065000 
摘要点击次数: 266
全文下载次数: 175
中文摘要:
      数据一致性是大数据质量管理研究的一个重要内容。条件函数依赖(CFDs)是维护数据一致性的有效技术手段。然而,在修复过程中选择不同的CFDs修复顺序,会影响修复的准确性和效率。因此,如何选取一个正确且合理的修复顺序对数据修复至关重要。针对该问题,提出一种基于CFDs规则的快速判定修复序列的计算方法。首先,设计了一种数据修复框架。然后,利用CFDs之间的关联关系,提出了修复序列图的概念, 以用于CFDs修复顺序的计算。一方面,可以避免某些错误的或者不必要的数据修复,提高修复的准确性。另一方面,使用规则来判定修复顺序比使用实际数据进行判定更为快速。此外,在判定修复序列的过程中,对修复死锁进行了检测,保证了修复过程的可终止性。最后,通过在真实数据集上与现有方法进行对比实验,证明了所提方法具有更高的准确性和运行效率。
英文摘要:
      Data consistency is one central issue of big data quality management research.Conditional functional depen-dencies (CFDs) are effective techniques for maintaining data consistency.In practice,different repairing sequences may affect precision and efficiency of data repairing.It is critical to select an appropriate repairing sequence.To solve the problem,based on CFDs,this paper presented a rapid decision method for repairing sequence.Firstly,a framework is designed for consistency repairing.Then,by analyzing the association between constraints,the concept of repairing sequence graph is presented to determine repairing sequence on CFDs.It contributes to avoiding some incorrect and unnecessary repairs,which can improve the accuracy of repairing.Meanwhile,repairing sequence with rules runs faster than that with real data.Furthermore,in the process of repairing sequence decision,repairing-deadlock detection is implemented to ensure the termination of repairing.Finally,compared with the existing method,this solution is more accurate and efficient evidenced by the empirical evaluation on two real-life datasets.
查看全文  查看/发表评论  下载PDF阅读器