非一致有界费用MDP的强平均最优性条件

A Condition for Strong Average Optimality of MDP with Non-uniformly Bounded Costs

机构地区：[1]中南大学数学科学与计算技术学院,长沙410075 [2]湖南商学院信息学院,长沙410205

出　　处：《运筹学学报》2010年第1期95-105,共11页Operations Research Transactions

基　　金：湖南省自然科学基金项目(08JJ3004);湖南省社会科学基金项目(08YBB187)的支持

摘　　要：研究可数状态空间任意行动空间非一致性有界费用马氏决策过程(MDP)的强平均最优,给出了使得每个常用的平均最优策略也是强平均最优的条件,并实质性的推广了Cavazos-Cadena和Fernandez-Gaucheran(Math.Meth.Oper.Res.,1996,43:281-300)的主要结果.In this paper, we consider the Markov decision processes under an average cost criterion with non-uniformly bounded cost, denumerable state and arbitrary action spaces. Some sufficient conditions are given under which every average optimal policy is strong average optimal. We improve the main results obtained by Cavazos-Cadena R.and Fernandez-Gaucheran E. （Math. Meth. Oper. Res., 1996, 43： 281-300）.

关键词：运筹学马氏决策过程(MDP) 强平均费用准则非一致有界费用充分条件

分类号：O171[理学—数学]

参考文献：

正在载入数据...

二级参考文献：

正在载入数据...

耦合文献：

正在载入数据...

引证文献：

正在载入数据...

二级引证文献：

正在载入数据...

同被引文献：

正在载入数据...

高级检索 检索式检索

时间限定

期刊范围

学科限定全选

高级检索 检索式检索

时间限定

期刊范围

学科限定全选

非一致有界费用MDP的强平均最优性条件

我的收藏

参考文献：

二级参考文献：

耦合文献：

引证文献：

二级引证文献：

同被引文献：

相关期刊文献：

相关的主题

相关的作者对象

相关的机构对象

下载全文

高级检索检索式检索

时间限定

期刊范围

学科限定全选

高级检索 检索式检索

时间限定

期刊范围

学科限定全选

非一致有界费用MDP的强平均最优性条件

我的收藏

参考文献：

二级参考文献：

耦合文献：

引证文献：

二级引证文献：

同被引文献：

相关期刊文献：

相关的主题

相关的作者对象

相关的机构对象

下载全文

用户登录

高级检索检索式检索