检索规则说明:AND代表“并且”;OR代表“或者”;NOT代表“不包含”;(注意必须大写,运算符两边需空一格)
检 索 范 例 :范例一: (K=图书馆学 OR K=情报学) AND A=范并思 范例二:J=计算机应用与软件 AND (U=C++ OR U=Basic) NOT M=Visual
机构地区:[1]西安电子科技大学综合业务网理论及关键技术国家重点实验室,陕西西安710071
出 处:《西安电子科技大学学报》2011年第4期32-37,共6页Journal of Xidian University
基 金:国家杰出青年科学基金资助项目(60725105);国家重点基础研究发展计划(973计划)课题资助项目(2009CB320404);长江学者和创新团队发展计划资助项目(IRT0852);国家自然科学基金资助项目(61072068;60872045);中央高校基本科研业务费专项资助项目(JY10000901031)
摘 要:提出了一种基于归一化径向基函数的自适应启发评价强化学习算法,用于异构无线网络系统中自主的动态频谱分配.该算法利用归一化径向基函数自适应构建状态空间,加快学习速度;利用自适应启发评价机制减少不必要的探索,提高学习效率.通过与无线环境交互,算法学会为不同接入网内的各个会话动态分配合适的频段.仿真结果表明,在同等网络条件下,该算法能获取更好的频谱利用率和服务质量,性能优于确定性频谱分配策略和一般的动态频谱分配策略.An adaptive heuristic critic(AHC) Reinforcement Learning algorithm is presented for the dynamic spectrum allocation in an autonomously deciding mode in heterogeneous radio networks based on the normalized radial basis function(NRBF).The algorithm accelerates the learning speed by utilizing the NRBF when constructing the state space,and improves the learning efficiency by using the AHC scheme to reduce the unnecessary exploration.Through interactions with the radio environment,it learns to allocate the proper frequency band for each session in multiple radio access networks.Simulation results show that the proposed algorithm can lead to a better spectrum efficiency and quality of service compared with to the fixed frequency planning scheme or general dynamic spectrum allocation policy.
关 键 词:异构无线网络 动态频谱分配 强化学习 归一化径向基函数
分 类 号:TP393[自动化与计算机技术—计算机应用技术]
正在载入数据...
正在载入数据...
正在载入数据...
正在载入数据...
正在载入数据...
正在载入数据...
正在载入数据...
正在链接到云南高校图书馆文献保障联盟下载...
云南高校图书馆联盟文献共享服务平台 版权所有©
您的IP:216.73.216.229