《電子技術應用》
您所在的位置:首頁 > 其他 > 设计应用 > 融合用户兴趣建模的智能推荐算法研究
融合用户兴趣建模的智能推荐算法研究
信息技术与网络安全 11期
洪志理,赖 俊,曹 雷,陈希亮
(陆军工程大学 指挥控制工程学院,江苏 南京210007)
摘要: 强化学习被越来越多地应用到推荐系统中。提出一种基于DDPG融合用户动态兴趣建模的推荐方法(DDPG-LA),使用LSTM网络提取用户的长期兴趣,利用注意力机制方法提取用户的短期兴趣,将两种兴趣结合作为智能体的状态。同时,在LSTM网络中加入状态增强单元,以加速模型对于用户长期兴趣的建模,在注意力机制中加入缓解推荐延迟的模块来解决该方法应用于推荐系统中时所产生的缺陷。在Movelines的两个数据集上对模型进行实验,同时在各种测试指标上与传统方法进行比较,结果显示所提出的算法更具优越性。
中圖分類號: TP18
文獻標識碼: A
DOI: 10.19358/j.issn.2096-5133.2021.11.006
引用格式: 洪志理,賴俊,曹雷,等. 融合用戶興趣建模的智能推薦算法研究[J].信息技術與網絡安全,2021,40(11):37-48.
Research on intelligent recommendation algorithm integrating user interest modeling
Hong Zhili,Lai Jun,Cao Lei,Chen Xiliang
(Command & Control Engineering College,Army Engineering University of PLA,Nanjing 210007,China)
Abstract: Reinforcement learning is more and more applied to recommendation system. This paper proposes a recommendation method based on DDPG and user dynamic interest modeling(DDPG-LA). It uses LSTM network to extract user′s long-term interest and attention mechanism to extract user′s short-term interest. The two kinds of interest are combined as the state of agent. At the same time, the state enhancement unit is added to LSTM network to accelerate the modeling of users′ long-term interest, and the module to alleviate the recommendation delay is added to the attention mechanism to solve the defects when the method is applied to the recommendation system. In this paper, the model is tested on two data sets of Movelines, and compared with the traditional methods in various test indexes, the results show that the proposed algorithm has more advantages.
Key words : reinforcement learning; recommendation system;DDPG;DDPG-LA;LSTM;attention mechanism;long-term interest;short-term interest

0 引言

推薦系統[1],作為大數據時代方便人們在龐大的可選項目中快速準確定位到自己感興趣物品的工具,基本思想是通過構建模型從用戶的歷史數據中提取用戶和物品的特征,利用訓練好的模型對用戶有針對地推薦物品。

近年來隨著強化學習的快速發展,將強化學習應用于推薦系統的研究越來越受到關注,首次將深度強化學習應用于推薦系統的探索模型是DRN[2],為深度強化學習在推薦系統中的應用構建了基本框架,圖1所示為基于深度強化學習的推薦系統框圖。

目前基于深度強化學習的推薦系統研究已有諸多研究成果,如童向榮[3]等人將DQN應用于以社交網絡為基礎的信任推薦系統中,應用于智能體學習用戶之間信任度的動態表示,并基于這種信任值來為用戶做推薦;劉帥帥[4]將DDQN應用于電影推薦中來解決推薦精確度低、速度慢以及冷啟動等問題;Munemasa[5]等人將DDPG算法應用于店鋪推薦,來解決用戶數據稀疏問題;Zhao[6]等人將Actor-Critic算法應用于列表式推薦,來解決傳統推薦模型只能將推薦過程建模為靜態過程的問題。上述研究成果以及未在此羅列的眾多研究均是利用強化學習本身的性質來解決推薦問題,很少從推薦角度出發考慮問題。




本文詳細內容請下載:http://www.tom3567.com/resource/share/2000003846





作者信息:

洪志理,賴  俊,曹  雷,陳希亮

(陸軍工程大學 指揮控制工程學院,江蘇 南京210007)


此內容為AET網站原創,未經授權禁止轉載。
主站蜘蛛池模板: 久久手机精品视频| 美日韩精品免费视频| 丁香六月激情网| 国产精品爽爽爽| 国产精品免费久久久久久| 久久超碰亚洲| 国产精品美女免费视频| 久久久久久久少妇| www日韩视频| 日本不卡一二三区| 欧美一区二视频在线免费观看| 日本三日本三级少妇三级66| 五月婷婷综合色| 亚洲97在线观看V| 日本一区二区三区视频免费看| 狠狠色伊人亚洲综合网站色| 91禁国产网站| 久久精品国产精品亚洲色婷婷| 99久久久久国产精品免费| 天天爱天天做天天操| 久久国产精品99国产精| 91国偷自产一区二区三区的观看方式| 日韩有码在线观看| 欧洲日韩成人av| 精品国模在线视频| 日韩在线观看成人| 国产精品自在线| 欧美国产激情视频| 91久久久久久久一区二区| 精品中文字幕在线| 一区二区视频国产| 久久久亚洲福利精品午夜| 国产精品美女www| 美女久久久久久久久久久| 91久久久久久| 啊v视频在线一区二区三区| 国产精品一区二区免费在线观看| 久久天天躁狠狠躁夜夜躁2014| 欧美激情第6页V| 午夜精品免费视频| 亚洲综合在线小说|