Google、 検索の 推論ボトルネックを 公開
Google が検索の推論ボトルネックを回避する手法を公開しました。 Retrieve-for-Train はオフライン RL で探索を学習します。 53.9M パラメータの拡散モデルが 1 回で検索語を生成します。
Google Research
Google が検索の推論ボトルネックを回避する手法を公開しました。 Retrieve-for-Train はオフライン RL で探索を学習します。 53.9M パラメータの拡散モデルが 1 回で検索語を生成します。
Hugging Face がベンチマーク監査手法 BenchMIRT を公開しました。 BBQ や WMDP のスコアは安全性より一般推論と強く関連します。
ABEJA が SensorLLM で人間行動認識を検証しました。 SensorLLM は Chronos でセンサーを埋め込み LLM に入力します。 異常検知は学習しておらずスパイクを指摘できません。
Dharma が AI の専門特化の必然性を解説しました。 Wolpert と Macready の定理は汎用の優位を否定します。
Mistral が Emmi AI を買収し物理 AI を強化しました。 航空宇宙や自動車、半導体、エネルギー分野が対象です。 3D 翼の CFD データセットなど研究成果を公開しています。
Berkeley の研究が TD 学習なしの RL を解説しました。 分割統治で Bellman 再帰を対数的に削減します。 ゴール条件付き RL で複雑なタスクに適用できます。