本文へ移動
10/7(水) 12:09
あとで読む
出典
研究Apple Machine Learning Research一次· 10/1(木)

Apple、自己改善の新手法を発表

Apple Machine Learning Researchこの話題 1ソース →
要

AI要約

3行で
  • Apple が強化学習の新手法 RLTL;DR を発表しました。
  • 失敗のたびに方策が TL;DR の洞察を書きます。
  • 難問で Pass@1 が 12〜13% に向上しました。

AI要約です。詳しくは出典へ。誤りを報告

Karunews が選んだ理由失敗時に方策が自らフィードバックを書いて内面化する手法で、学習が進まない難題への対処法として参考になります。

典

出典

1ソース · 一次情報
Apple Machine Learning Research一次RLTL;DR: Self-Improvement by Internalizing Self-Generated Feedbackmachinelearning.apple.com
出典を読む
この話題を見る