Up
運転脳 (運動脳運転の自動化)
作成: 2026-06-13
更新: 2026-06-15
4足歩行ロボット
>
他律型
>
運転脳
1 primitive-based
1.1
primitive-based の運転脳
1.2
離散行動空間
訓 練
0
概要
1 訓練
1.1
シミュレーション環境
1.2
試行
1.3
試行初期状態はランダム設定
1.4
概念学習
2 標準的な状態・報酬設定
2.1
状態
2.2
報酬
3 訓練アルゴリズム
3.1
Q学習
3.2
DQN
3.3
行動の導出
3.4
パラメータ値の更新
3.5
運動脳の場合と比べて簡単