RL的主要结构种类好的,这是一个非常核心的问题。强化学习(RL)的算法世界看似纷繁复杂,但它们大多可以根据几个关键的维度进行划分和理解。 我们可以将强化学习算法的结构主要分为三大类,这三类回答了“算法学习的核心是什么?”这个问题。此外,还有两个重要的正交维度,它们描述了“算法如何学习?”。 核心三大算法结构 (学习什么?)Aaron L9/10/25About 6 minMachine LearningMachine Learningreinforcement learning