multiagent-sac:在网球多主体Unity环境上实施集中培训,对软演员关键(SAC)进行集中执行

上传者: 42175516 | 上传时间: 2022-08-24 18:57:52 | 文件大小: 1.23MB | 文件类型: ZIP
多代理SAC 介绍 环境。 在这种环境下,两名特工控制球拍在球网上弹跳球。 如果探员将球击中网,则得到+0.1的奖励。 如果探员让一个球击中地面或将球击出界外,则其获得的奖励为-0.01。 因此,每个特工的目标是保持比赛中的球权。 观察空间由8个变量组成,分别对应于球和球拍的位置和速度。 每个代理都会收到自己的本地观察结果。 有两个连续的动作可用,分别对应于朝向(或远离)网络的运动和跳跃。 该任务是情节性的,并且为了解决环境,您的特工必须获得+0.5的平均分数(在两个特工均取得最高分后,连续100次以上)。 具体来说, 在每个情节之后,我们将每个代理商获得的奖励加起来(不打折),以获得每个代理商的得分。 这将产生2个(可能不同)的分数。 然后,我们取这两个分数中的最大值。 这为每个情节产生一个单一的分数。 当这些分数的平均值(超过100集)至少为+0.5时,就认为环境已解决。

文件下载

资源详情

[{"title":"( 22 个子文件 1.23MB ) multiagent-sac:在网球多主体Unity环境上实施集中培训,对软演员关键(SAC)进行集中执行","children":[{"title":"multiagent-sac-master","children":[{"title":".gitignore <span style='color:#111;'> 1.81KB </span>","children":null,"spread":false},{"title":"requirements.txt <span style='color:#111;'> 1.65KB </span>","children":null,"spread":false},{"title":"model_weight","children":[{"title":"mactor.pt <span style='color:#111;'> 287.31KB </span>","children":null,"spread":false},{"title":"mqf1.pt <span style='color:#111;'> 286.02KB </span>","children":null,"spread":false},{"title":"mqf2.pt <span style='color:#111;'> 286.02KB </span>","children":null,"spread":false},{"title":"mvf.pt <span style='color:#111;'> 284.02KB </span>","children":null,"spread":false}],"spread":true},{"title":"buffers","children":[{"title":"buffer.py <span style='color:#111;'> 1.59KB </span>","children":null,"spread":false}],"spread":true},{"title":"models","children":[{"title":"mactor_critic.py <span style='color:#111;'> 2.79KB </span>","children":null,"spread":false},{"title":"actor_critic.py <span style='color:#111;'> 2.79KB </span>","children":null,"spread":false},{"title":"network.py <span style='color:#111;'> 532B </span>","children":null,"spread":false}],"spread":true},{"title":"LICENSE <span style='color:#111;'> 1.05KB </span>","children":null,"spread":false},{"title":"utils.py <span style='color:#111;'> 21B </span>","children":null,"spread":false},{"title":"README.md <span style='color:#111;'> 6.35KB </span>","children":null,"spread":false},{"title":"agents","children":[{"title":"masac_agent.py <span style='color:#111;'> 9.89KB </span>","children":null,"spread":false},{"title":"dqn_agent.py <span style='color:#111;'> 7.24KB </span>","children":null,"spread":false},{"title":"sac_agent.py <span style='color:#111;'> 9.13KB </span>","children":null,"spread":false}],"spread":true},{"title":"plots","children":[{"title":"masac_result1.png <span style='color:#111;'> 62.25KB </span>","children":null,"spread":false},{"title":"masac_loss1.png <span style='color:#111;'> 34.13KB </span>","children":null,"spread":false},{"title":"masac_result.png <span style='color:#111;'> 73.40KB </span>","children":null,"spread":false},{"title":"masac_loss.png <span style='color:#111;'> 34.98KB </span>","children":null,"spread":false}],"spread":true},{"title":"TennisEnvironment","children":[{"title":"__init__.py <span style='color:#111;'> 0B </span>","children":null,"spread":false}],"spread":true},{"title":"main.py <span style='color:#111;'> 1.10KB </span>","children":null,"spread":false}],"spread":false}],"spread":true}]

评论信息

免责申明

【只为小站】的资源来自网友分享,仅供学习研究,请务必在下载后24小时内给予删除,不得用于其他任何用途,否则后果自负。基于互联网的特殊性,【只为小站】 无法对用户传输的作品、信息、内容的权属或合法性、合规性、真实性、科学性、完整权、有效性等进行实质审查;无论 【只为小站】 经营者是否已进行审查,用户均应自行承担因其传输的作品、信息、内容而可能或已经产生的侵权或权属纠纷等法律责任。
本站所有资源不代表本站的观点或立场,基于网友分享,根据中国法律《信息网络传播权保护条例》第二十二条之规定,若资源存在侵权或相关问题请联系本站客服人员,zhiweidada#qq.com,请把#换成@,本站将给予最大的支持与配合,做到及时反馈和处理。关于更多版权及免责申明参见 版权及免责申明