您的位置: 专家智库 > >

广西壮族自治区自然科学基金(09910192)

作品数:1 被引量:4H指数:1
相关作者:杨文雷张平党选举陈皓更多>>
相关机构:桂林电子科技大学更多>>
发文基金:国家自然科学基金广西壮族自治区自然科学基金更多>>
相关领域:自动化与计算机技术更多>>

文献类型

  • 1篇中文期刊文章

领域

  • 1篇自动化与计算...

主题

  • 1篇重复记录检测
  • 1篇相似重复记录
  • 1篇相似重复记录...

机构

  • 1篇桂林电子科技...

作者

  • 1篇陈皓
  • 1篇党选举
  • 1篇张平
  • 1篇杨文雷

传媒

  • 1篇传感器与微系...

年份

  • 1篇2011
1 条 记 录,以下是 1-1
排序方式:
基于熵特征优选分组聚类的相似重复记录检测被引量:4
2011年
针对目前相似重复记录检测方法不能有效处理大数据量的问题,提出一种基于熵的特征优选分组聚类的算法。该方法通过构造一个基于对象间相似度的熵度量,对原始数据集中各属性进行重要性评估,筛选出关键属性集,并依据关键属性将数据划分为不相交的小数据集,在各小数据集中用DBSCAN聚类算法进行相似重复记录的检测。理论分析和实验结果表明:该方法识别精度和检测效率较高。
张平党选举陈皓杨文雷
关键词:相似重复记录
共1页<1>
聚类工具0