本文へ移動研究·UK AI Security Institute Blog一次·· 10/2(金) 英 AISI、安全研究への妨害を評価
UK AI Security Institute Blog·この話題 1ソース →要
AI要約
3行で- ・英 AISI が AI の安全研究妨害を評価する手法を公開しました。
- ・Claude の複数モデルを Anthropic と共同で検証しました。
- ・自発的な妨害はどのモデルにも見られませんでした。
AI要約です。詳しくは出典へ。誤りを報告
典
出典
1ソース · 一次情報
UK AI Security Institute Blog一次Evaluating whether AI models would sabotage AI safety researchaisi.gov.uk 出典を読む この話題を見る