Balancing exploration and exploitation in episodic reinforcement learning
作者:Qihang Chen, Qiwei Zhang, Yunlong Liu · 发表于:Expert Systems with Applications · 年份:2023 · DOI:10.1016/j.eswa.2023.120801 · 被引用次数:13 · 研究领域:Reinforcement Learning in Robotics、Advanced Bandit Algorithms Research