《電子技術應用》
您所在的位置:首頁 > 其他 > 设计应用 > 基于约束的多维Apriori改进算法
基于约束的多维Apriori改进算法
电子技术应用
王志昊,苏明月,李东方,沈炜,杨光
(北京计算机技术及应用研究所,北京 100854)
摘要: 针对经典多维关联规则挖掘算法执行效率不高、存在冗余规则的不足,提出基于约束的多维Apriori改进算法,在多维Apriori算法的基础上,将用户约束引入挖掘过程,根据关于谓词的约束产生用户感兴趣的频繁谓词集,并以此为依据删减事务集。该算法一方面通过用户约束大大缩减了候选谓词集的产生,另一方面经过删减的事务集也降低了扫描数据库的开销,最终实现了挖掘效率的提高以及冗余规则的减少。应用该算法在FPGA代码缺陷事务集上进行对比实验,实验结果证明了该算法相比多维Apriori算法,在搜索效率以及挖掘结果的准确性方面均得到了改善,有效提高了FPGA代码缺陷分析的准确性。
中圖分類號:TP311 文獻標志碼:A DOI: 10.16157/j.issn.0258-7998.233873
中文引用格式: 王志昊,蘇明月,李東方,等. 基于約束的多維Apriori改進算法[J]. 電子技術應用,2023,49(10):100-105.
英文引用格式: Wang Zhihao,Su Mingyue,Li Dongfang,et al. Algorithm of multi-dimensional Apriori with constraints[J]. Application of Electronic Technique,2023,49(10):100-105.
Algorithm of multi-dimensional Apriori with constraints
Wang Zhihao,Su Mingyue,Li Dongfang,Shen Wei,Yang Guang
(Institute 706, Second Academy of China Aerospace Science and Industry Corporation, Beijing 100854, China)
Abstract: Aiming at the inefficiency of multi-dimensional association rules mining algorithm and the existence of redundant rules, an algorithm of multi-Dimensional apriori with constraints is proposed. Based on the multi-dimensional Apriori algorithm, the algorithm controls the mining process with user constraints. According to the predicate constraint, the frequent predicate set that is of interest to the user is generated, and the transaction set is deleted based on the predicate constraint. On the one hand, the algorithm greatly reduces the generation of candidate predicate sets through user constraints. On the other hand, the reduced transaction set also reduces the scanning database overhead. Finally, the efficiency of mining is improved and the redundant rules are reduced. This algorithm is used to compare experiments on FPGA code defect transaction sets. The experimental results show that compared with the multi-dimensional Apriori algorithm, this algorithm has improved the search efficiency of frequent predicate sets and the accuracy of mining results.
Key words : association rules mining;multi-dimensional association rule;Apriori;frequent predicate set;predicate constraint;data mining

0 引言

現代社會,生產力快速發展,通過不斷變革生產信息技術,人們大大提高了創造和收集數據的能力,迅速擴大了數據資料的規模。急劇增長的數據資料和數據庫迫使人們采用新的技術手段和工具來處理海量的數據,自動自主地幫助人們管理、提取并分析有用的信息,來發掘有價值的知識,為人們提供決策服務。由此,數據挖掘(Data Mining)[1] 在這樣的宏觀背景下誕生。將數據挖掘技術充分運用到現實的生產中,提高企業生產的效率,降低生產成本。數據挖掘的應用范圍較廣,如聚類、預測、分類、異常分析以及相互關聯性分析。

數據挖掘中,關聯規則是較為主要的研究對象。其中頻繁項集的產生是最核心、最受關注的問題。關聯規則反映了一個事物與其他事物之間的相互依存和關聯性[2]。換句話說,關聯規則是一種隱含在數據中的知識模型,其通過量化數字,從海量數據中挖掘出有價值的數據項之間的相關關系[3]。

關聯規則挖掘最初由Agrawal[4]等人于1993年提出,通過關聯規則的挖掘可以找出潛藏在數據庫中各個屬性之間的關系,輔助人們更合理地進行商業活動、金融決策和生產生活等。

目前,典型的挖掘關聯規則的算法主要是Apriori算法[5],其核心在于找到數據庫中的所有頻繁項集。Apriori算法通過逐級產生頻繁項集并利用先驗性質縮減候選項集產生。在掃描數據集的過程中,Hossain提出可使用自動遞歸連接來挖掘候選項目集[6],然后剪枝用于挖掘頻繁項集。2021年,Li等人提出基于時序約束的關聯規則挖掘,減小了系統開銷[7]。Wang等人利用MapReduce的思想改進Apriori算法,有效提高了搜索效率[8]。2022年,Dhinakaran等人集成Apriori算法和仿生算法,通過降低處理大型數據集時的低運行時性能來解決頻繁項集問題[9]。



本文詳細內容請下載:http://www.tom3567.com/resource/share/2000005721




作者信息:

王志昊,蘇明月,李東方,沈煒,楊光

(北京計算機技術及應用研究所,北京 100854)


微信圖片_20210517164139.jpg

此內容為AET網站原創,未經授權禁止轉載。
主站蜘蛛池模板: 91久久国产精品91久久性色| 国产美女久久精品| 久久天天躁狠狠躁夜夜av| 精品久久久久久无码中文野结衣| 大波视频国产精品久久| 亚洲精品乱码视频| 精品日本一区二区三区在线观看| 精品产品国产在线不卡| 久久亚洲国产精品| 国产精品一区二区免费| 亚洲国产欧美一区二区三区不卡 | 欧美一级视频一区二区| 中文字幕99| 91老司机精品视频| 欧美成人中文字幕| 日本久久精品视频| 亚洲在线观看视频网站| 精品国产拍在线观看| 色婷婷精品国产一区二区三区| 久久av中文字幕| 欧美综合在线第二页| 日本高清久久天堂| 国产九九精品视频| 久久精品ww人人做人人爽| 久久99导航| 色婷婷精品国产一区二区三区| 亚洲精品在线免费看| 欧美精品色婷婷五月综合| 日韩美女中文字幕| 久久久成人av| 日韩欧美一级在线| 一区二区三区欧美在线| 国产精品亚洲a| 久久精品国产视频| 91久久国产精品91久久性色| 日韩av一级大片| 国产成人精品电影久久久| 日韩不卡av| 国产福利久久| 欧美专区在线视频| 亚洲自拍欧美另类|