本文へ移動
10/7(水) 14:09
あとで読む
出典
研究Berkeley AI Research一次· 2025年11月1日(土)

Berkeley、TD 学習なしの RL を解説

Berkeley AI Research
要

AI要約

Berkeley の研究が TD 学習なしの RL を解説しました。 分割統治で Bellman 再帰を対数的に削減します。 ゴール条件付き RL で複雑なタスクに適用できます。

AI要約です。詳しくは出典へ。誤りを報告

典

出典

1ソース · 一次情報
Berkeley AI Research一次RL without TD learningbair.berkeley.edu
出典を読む