[00264350]一种基于层次聚类的虚假用户检测方法
交易价格:
面议
所属行业:
分析仪器
类型:
发明专利
技术成熟度:
正在研发
专利所属地:中国
专利号:CN201710550833.9
交易方式:
技术转让
技术转让
技术入股
联系人:
四川大学
进入空间
所在地:四川成都市
- 服务承诺
- 产权明晰
-
资料保密
对所交付的所有资料进行保密
- 如实描述
技术详细介绍
摘要:本发明公布了一种基于层次聚类的虚假用户检测方法。主要包括以下步骤将网站用户数据表进行备份,将用户唯一性标识字段映射为字符串组成模式,并根据不同组成模式对海量数据进行预分类;计算每个分类中元素间的字符串相似度;设置合适的阈值对各个分类进行层次聚类,进而发现藏匿在海量注册数据中的成组的虚假账户。实验表明,本发明提出的研究方法有效,与现有的方法相比,该方法对数据维度、数据特性依赖较小。该发明可应用于当前大数据环境下的虚假用户检测。
摘要:本发明公布了一种基于层次聚类的虚假用户检测方法。主要包括以下步骤将网站用户数据表进行备份,将用户唯一性标识字段映射为字符串组成模式,并根据不同组成模式对海量数据进行预分类;计算每个分类中元素间的字符串相似度;设置合适的阈值对各个分类进行层次聚类,进而发现藏匿在海量注册数据中的成组的虚假账户。实验表明,本发明提出的研究方法有效,与现有的方法相比,该方法对数据维度、数据特性依赖较小。该发明可应用于当前大数据环境下的虚假用户检测。