本文へ移動研究·UK AI Security Institute Blog一次·· 10/2(金) 英 AISI、アライメント評価を公開
UK AI Security Institute Blog·この話題 1ソース →要
AI要約
3行で- ・英 AISI がアライメント評価の新手法を公開しました。
- ・Anthropic の 3 モデルを対象に検証しました。
- ・研究妨害の事例は確認されませんでした。
AI要約です。詳しくは出典へ。誤りを報告
典
出典
1ソース · 一次情報
UK AI Security Institute Blog一次Investigating models for misalignmentaisi.gov.uk 出典を読む この話題を見る