搜索【受限制的POMDPs】的结果

通常利用POMDPs对在部分可观测的随机环境中决策的agents建模。针对完整POMDP的求解方法扩展能力弱的问题，提出把多元POMDP分解成多个受限制的POMDPs，然后独立求解每个模型，以获得值函数，并将这些受限制的POMDPs的值函数结合起来以便获得完整POMDP策略。该方法主要阐述识别与独立任务相关的状态变量的过程，以及如何构造被限制在单独任务上的模型。将该方法应用到两个不同规模的岩石采样问题中，实验结果表明，该方法能够获得很好的策略。

2021-05-07 11:16:01 1.22MB POMDP 基于点的算法 相互独立的任务 多元POMDP 受限制的POMDPs