异构无线网络中基于强化学习的频谱管理算法  被引量:1

Dynamic spectrum allocation algorithm for heterogeneous radio networks based on reinforcement learning

在线阅读下载全文

作  者:张文柱[1] 邵丽娜[1] 

机构地区:[1]西安电子科技大学综合业务网理论及关键技术国家重点实验室,陕西西安710071

出  处:《西安电子科技大学学报》2011年第4期32-37,共6页Journal of Xidian University

基  金:国家杰出青年科学基金资助项目(60725105);国家重点基础研究发展计划(973计划)课题资助项目(2009CB320404);长江学者和创新团队发展计划资助项目(IRT0852);国家自然科学基金资助项目(61072068;60872045);中央高校基本科研业务费专项资助项目(JY10000901031)

摘  要:提出了一种基于归一化径向基函数的自适应启发评价强化学习算法,用于异构无线网络系统中自主的动态频谱分配.该算法利用归一化径向基函数自适应构建状态空间,加快学习速度;利用自适应启发评价机制减少不必要的探索,提高学习效率.通过与无线环境交互,算法学会为不同接入网内的各个会话动态分配合适的频段.仿真结果表明,在同等网络条件下,该算法能获取更好的频谱利用率和服务质量,性能优于确定性频谱分配策略和一般的动态频谱分配策略.An adaptive heuristic critic(AHC) Reinforcement Learning algorithm is presented for the dynamic spectrum allocation in an autonomously deciding mode in heterogeneous radio networks based on the normalized radial basis function(NRBF).The algorithm accelerates the learning speed by utilizing the NRBF when constructing the state space,and improves the learning efficiency by using the AHC scheme to reduce the unnecessary exploration.Through interactions with the radio environment,it learns to allocate the proper frequency band for each session in multiple radio access networks.Simulation results show that the proposed algorithm can lead to a better spectrum efficiency and quality of service compared with to the fixed frequency planning scheme or general dynamic spectrum allocation policy.

关 键 词:异构无线网络 动态频谱分配 强化学习 归一化径向基函数 

分 类 号:TP393[自动化与计算机技术—计算机应用技术]

 

参考文献:

正在载入数据...

 

二级参考文献:

正在载入数据...

 

耦合文献:

正在载入数据...

 

引证文献:

正在载入数据...

 

二级引证文献:

正在载入数据...

 

同被引文献:

正在载入数据...

 

相关期刊文献:

正在载入数据...

相关的主题
相关的作者对象
相关的机构对象