
Francisco Serra
Followers: 0 Following: 0
統計
MATLAB Answers
1 質問
0 回答
ランク
of 157,897
コントリビューション
0 問題
0 解答
スコア
0
バッジ数
0
コントリビューション
0 投稿
コントリビューション
0 パブリック チャネル
平均評価
コントリビューション
0 ハイライト
平均いいねの数
Feeds
質問
Why is my DDPG agent converging to a state where it gets continuous penalization, while having a state it can go with 0 penalization?
I am training a Reinforcement Learning DDPG agent to drive a vehicle to a reference. The vehicle dynamics are: x_dot = v*cos(...
約1年 前 | 1 件の回答 | 0