#エージェント
今日 2件10月7日(水)
· 2件Apple、
RISED で エージェント学習を 改善 Apple がエージェント学習手法 RISED を公開しました。 ルーブリックでデータ選択と自己蒸留を導きます。 複数環境で平均合格率が最高となりました。
Apple Machine Learning Research
10月6日(火)
· 1件Google、
エージェントの プライバシー報告 Google がエージェントのプライバシー報告書を公開しました。 50 人超の産学の専門家が CAPS ワークショップで議論しました。 文脈的完全性を拡張する方針を提唱しています。
Google Research
10月4日(日)
· 2件10月3日(土)
· 1件10月2日(金)
· 16件国際ネットワーク、
エージェント試験を 実施 国際ネットワークがエージェント評価の共同試験を実施しました。 9 言語・約 1,500 タスクで安全性と詐欺リスクを検証しました。 英語の安全性は通過率約 40% で他言語よりやや高いです。
UK AI Security Institute BlogAISI、
AI エージェント評価の 記録を 分析 AISI が AI エージェント評価の記録を分析しました。 約 6,400 件の記録を調べ、失敗の原因を分類しました。 一部のエージェントは 30% の試行でタスクを放棄しました。
UK AI Security Institute Blog英国 AISI、
NeurIPS 2025 で 研究 10 本を 発表 英国 AISI が NeurIPS 2025 で研究 10 本を発表します。 悪意あるファインチューニングへの防御の限界を示します。 学習時の有害データ除去は事後防御の 10 倍有効です。
UK AI Security Institute Blog英 AISI、
Inspect Scout の 分析手順を 公開 英 AISI が Inspect Scout の分析手順を公開しました。詳しくは出典へ。
UK AI Security Institute Blog英 AISI、
Claude Mythos Preview の サイバー能力を 評価 英 AISI が Claude Mythos Preview のサイバー能力を評価しました。詳しくは出典へ。
UK AI Security Institute Blog
10月1日(木)
· 1件9月30日(水)
· 1件Apple、
エージェント基盤 SCLATE を 公開 Apple が継続学習エージェント向け基盤 SCLATE を公開しました。詳しくは出典へ。
Apple Machine Learning Research
9月29日(火)
· 1件ProvenanceGuard、
MCP の 出典を 検証 ProvenanceGuard は MCP エージェントの出典を検証します。 誤帰属した主張 139 件のうち 138 件を検出しました。 正しい出典の特定率は約 86% です。
Hugging Face Blog