Up 運転脳 (運動脳運転の自動化) 作成: 2026-06-13
更新: 2026-06-15

4足歩行ロボット他律型運転脳

1 primitive-based
 1.1 primitive-based の運転脳
 1.2 離散行動空間
  
  訓 練
0 概要
1 訓練
 1.1 シミュレーション環境
 1.2 試行
 1.3 試行初期状態はランダム設定
 1.4 概念学習
2 標準的な状態・報酬設定
 2.1 状態
 2.2 報酬
3 訓練アルゴリズム
 3.1 Q学習
 3.2 DQN
 3.3 行動の導出
 3.4 パラメータ値の更新
 3.5 運動脳の場合と比べて簡単