行動結果の報酬を手掛かりに、望ましい方策を試行錯誤で学ぶ手法。
導入・研究で確認するポイント
- 対象タスクと必要な性能を先に定義する
- 対応する機体、センサー、SDK、計算環境を確認する
- 評価指標、データ取得条件、安全条件を決める
- PoC後の保守、更新、法規対応まで含めて判断する
関連用語
模倣学習 データ収集 ロボットデータセット Cross-Embodiment Domain Randomization 用語集へ戻る
行動結果の報酬を手掛かりに、望ましい方策を試行錯誤で学ぶ手法。
模倣学習 データ収集 ロボットデータセット Cross-Embodiment Domain Randomization 用語集へ戻る