本文へ移動
10/7(水) 11:08
あとで読む
出典
研究UK AI Security Institute Blog一次· 10/2(金)

英 AISI、脱出ベンチマークを公開

UK AI Security Institute Blogこの話題 1ソース →
要

AI要約

3行で
  • 英 AISI がサンドボックス脱出を測るベンチマークを公開しました。
  • 18 の脱出シナリオを orchestration など 3 層で用意します。
  • 大規模モデルは設定不備の脱出に成功しました。

AI要約です。詳しくは出典へ。誤りを報告

Karunews が選んだ理由サンドボックスからの脱出能力を測るベンチマークの設計と結果が示され、エージェント評価の安全性を考える材料になります。

典

出典

1ソース · 一次情報
UK AI Security Institute Blog一次Can AI agents escape their sandboxes? A benchmark for safely measuring container breakout capabilitiesaisi.gov.uk
出典を読む
この話題を見る