《電子技術應用》
您所在的位置:首頁 > 人工智能 > 设计应用 > 基于强化学习的多智能体协同任务分配与仿真验证
基于强化学习的多智能体协同任务分配与仿真验证
电子技术应用
李松,王丽绮,张祺,顾念祖
中国人民解放军91977部队
摘要: 针对协同任务分配的决策建模与求解难点,开展多智能体协同任务分配技术研究,以实现多智能体间的高效协同和动态任务分配。提出了一种基于深度强化学习的协同任务分配方法,采用深度Q网络(DQN)算法实现智能体的构建和环境的模拟,以优化任务分配的效率和效果。通过构建典型任务场景,设计了详细的决策模型训练与应用方案,验证了所提出的算法在协同任务中的有效性。实验结果表明,该方法能够兼顾多目标综合任务效能,成功概率提升约17%。基于深度Q网络的多智能体协同任务分配方法可以有效提升任务分配效能。
中圖分類號:TP183 文獻標志碼:A DOI: 10.16157/j.issn.0258-7998.257192
中文引用格式: 李松,王麗綺,張祺,等. 基于強化學習的多智能體協同任務分配與仿真驗證[J]. 電子技術應用,2026,52(5):16-23.
英文引用格式: Li Song,Wang Liqi,Zhang Qi,et al. Reinforcement learning-based multi-agent collaborative task allocation and simulation validation[J]. Application of Electronic Technique,2026,52(5):16-23.
Reinforcement learning-based multi-agent collaborative task allocation and simulation validation
Li Song,Wang Liqi,Zhang Qi,Gu Nianzu
91977 Unit of PLA
Abstract: To address the challenges in decision modeling and solution methods for collaborative task allocation, this study investigates multi-agent collaborative task allocation technologies to achieve efficient coordination and dynamic task distribution among multiple agents. A collaborative task allocation method based on deep reinforcement learning is proposed, utilizing the deep Q-network (DQN) algorithm to construct agents and simulate environments, thereby optimizing the efficiency and effectiveness of task allocation. By constructing typical task scenarios and designing detailed decision model training and application schemes, the effectiveness of the proposed algorithm in collaborative tasks is verified. Experimental results demonstrate that the method can balance multi-objective comprehensive task performance, achieving an approximate 17% increase in success probability. The multi-agent collaborative task allocation method based on deep Q-network can effectively improve the efficiency of task allocation.
Key words : task allocation;reinforcement learning;deep Q-network (DQN) algorithm

引言

近年來,智能體迅速發展[1],在各個領域都得到了廣泛應用,但是當任務環境越來越復雜時,單智能體由于其執行能力有限,無法完成大規模的任務,因此通過多智能體協同配合執行任務成為了智能體應用的主流。

國內外研究者分別從不同的角度對關于多節點的任務分配[2]問題進行了探索[3]。在靜態任務分配方面,田震等[4]基于多類型基因編碼的改進遺傳算法,實現對協同任務分配問題的求解;鄧可等[5]提出了基于改進的量子粒子群算法,在多智能體任務分配問題中,提高了任務分配的精度與尋優效率,使任務分配達到全局最優值;許可等[6]基于分布式拍賣算法,根據已知的任務情況提前進行分配,實現任務收益最大化。上述方法雖然在一定程度上能夠實現任務分配,但在動態復雜的任務環境下,難以滿足實時性和優化性的要求。因此,越來越多的學者在動態分配方面進行了大量研究。李相民等[7]提出了在時間窗口約束下,通過一致性聯盟算法解決多智能體的動態任務分配問題;孫鵬等[8]進行了基于突發事件的任務分配研究,以最小完成時間為目標函數,通過貪婪算法進行可執行任務的動態分配,但忽略了任務截止時間的約束。上述主要研究每個任務的完整分配,而不是根據任務的實際情況進行任務中的調整,并且只進行有限次數的分配。吳蔚楠等[9]主要采取分布式遺傳算法來解決環境中多智能體任務協同動態分配問題,但忽略了高動態任務場景中不斷下發新任務時,任務的完成時間約束帶來任務完成度低的問題。

隨著人工智能[10]技術的發展,強化學習[11](Reinforcement Learning, RL)逐漸被引入任務分配領域,其通過智能體與環境的交互學習,能夠在復雜場景中實現動態決策。然而,現有研究中,強化學習在任務分配中的應用仍處于初期階段,尤其是在多智能體協同任務[12]和動態任務分配問題上,研究成果較為有限。針對動態任務場景下多智能體協同任務分配效能較低的問題,本文提出了一種基于深度強化學習的協同任務分配方法,結合深度Q網絡(Deep Q-Network, DQN)[13]算法,旨在解決動態任務分配中的關鍵問題。通過構建智能體與環境的交互模型,利用DQN算法實現任務分配的動態優化,以提升確認的效率和效果。本文的研究結果將為未來節點的智能化任務分配提供理論支持和技術參考,具有重要的學術價值和應用意義。


本文詳細內容請下載:

http://www.tom3567.com/resource/share/2000007066


作者信息:

李松,王麗綺,張祺,顧念祖

(中國人民解放軍91977部隊, 北京 100036)

2.jpg

此內容為AET網站原創,未經授權禁止轉載。
主站蜘蛛池模板: 奇米影视首页 狠狠色丁香婷婷久久综合 | 亚洲制服欧美久久| 一区二区高清视频| 国产欧美欧洲在线观看| 日韩一区二区在线视频| 久久久久国色av免费观看性色| 国产精品久久久久久av福利| 国产又粗又爽又黄的视频| 精品久久久久久久免费人妻| 青青青在线观看视频| 久久天天躁狠狠躁夜夜爽蜜月| 97久久国产亚洲精品超碰热| 国产精品专区在线 | 久久精品午夜福利| 国产精品手机播放| 91久久大香伊蕉在人线| 日本免费高清一区| 国产一区福利视频| 日韩一区av在线| 欧美亚洲另类久久综合| 国产伦理久久久| 欧美日韩国产999| 国产成一区二区| 精品国产综合| 91九色国产ts另类人妖| 亚洲精品一区二区三| 在线视频一二三区| 国产私拍一区| 在线不卡视频一区二区| 国产精品免费视频久久久| 国产精品国产亚洲精品看不卡15 | 国产精品午夜视频| 欧美日韩视频在线一区二区观看视频| 国产午夜精品一区| 国产综合av一区二区三区| 久久久久亚洲精品| 久久久久久欧美| 精品国产网站地址| 国产成人精品午夜| 国产精品日韩在线| 国产精品色悠悠|