本文へ移動
10/7(水) 14:09
あとで読む
出典
研究UK AI Security Institute Blog一次· 10/2(金)

英 AISI、安全研究への妨害を評価

UK AI Security Institute Blogこの話題 1ソース →
要

AI要約

3行で
  • 英 AISI が AI の安全研究妨害を評価する手法を公開しました。
  • Claude の複数モデルを Anthropic と共同で検証しました。
  • 自発的な妨害はどのモデルにも見られませんでした。

AI要約です。詳しくは出典へ。誤りを報告

典

出典

1ソース · 一次情報
UK AI Security Institute Blog一次Evaluating whether AI models would sabotage AI safety researchaisi.gov.uk
出典を読む
この話題を見る