本文へ移動
10/7(水) 13:08
あとで読む
出典
研究UK AI Security Institute Blog一次· 10/2(金)

AISI、白箱制御の研究を公開

UK AI Security Institute Blogこの話題 1ソース →
要

AI要約

AISI が白箱制御チームを立ち上げました。 白箱制御はモデル内部の活性化を監視・改変します。 Llama-3.1-8B ではサンドバッギング検出が高精度でした。

AI要約です。詳しくは出典へ。誤りを報告

典

出典

1ソース · 一次情報
UK AI Security Institute Blog一次Why we're working on white box controlaisi.gov.uk
出典を読む
この話題を見る