阅读安全强化学习100篇第一篇State-wise Safe Reinforcement Learning: A Survey
·
State-wise Safe Reinforcement Learning: A Survey
本文主要将安全强化学习分成了在收敛后安全的保证以及训练期间的安全性的保证,本文作者深入探讨了针对这两方面研究方法以及其优缺点。图片是其思维导图

魔乐社区(Modelers.cn) 是一个中立、公益的人工智能社区,提供人工智能工具、模型、数据的托管、展示与应用协同服务,为人工智能开发及爱好者搭建开放的学习交流平台。社区通过理事会方式运作,由全产业链共同建设、共同运营、共同享有,推动国产AI生态繁荣发展。
更多推荐


所有评论(0)