METR、 gpt-oss の 評価手法を 検証
要
AI要約
METR が gpt-oss-120b の評価手法を検証しました。 悪意あるファインチューニング実験を対象としています。 17 件の提言のうち OpenAI は 9 件を採用しました。
AI要約です。詳しくは出典へ。誤りを報告
典
METR が gpt-oss-120b の評価手法を検証しました。 悪意あるファインチューニング実験を対象としています。 17 件の提言のうち OpenAI は 9 件を採用しました。
AI要約です。詳しくは出典へ。誤りを報告