A novel policy based on action confidence limit to improve exploration efficiency in reinforcement learning
['Fanghui Huang', 'Xinyang Deng', 'Yixin He', 'Wen Jiang']
/
Information Sciences
/ Vol. 640
まだレビューは投稿されていません。あなたが最初のレビューを書きませんか?