Adaptive cache policy optimization through deep reinforcement learning in dynamic cellular networksOA
Adaptive cache policy optimization through deep reinforcement learning in dynamic cellular networks
Ashvin Srinivasan;Mohsen Amidzadeh;Junshan Zhang;Olav Tirkkonen
Department of Information and Communications Engineering,Aalto University,Espoo 02150,FinlandDepartment of Information and Communications Engineering,Aalto University,Espoo 02150,FinlandDepartment of Electrical and Computer Engineering,University of California,Davis,CA 95616,USADepartment of Information and Communications Engineering,Aalto University,Espoo 02150,Finland
wireless cachingdeep reinforcement learningadvantageous actor criticlong short term memorynon-stationary Partial Observable Markov Decision Process(POMDP)
wireless cachingdeep reinforcement learningadvantageous actor criticlong short term memorynon-stationary Partial Observable Markov Decision Process(POMDP)
《智能与融合网络(英文)》 2024 (2)
81-99,19
This work was supported in part by the Academy of Finland(No.345109).
评论