Karunews 週間ダイジェスト
9月28日から10月4日までを対象とします。今期は、英 AISI がフロンティアモデルのサイバー能力やサンドボックス脱出、データ汚染、説得力を相次いで評価し、防御側の指針も示しました。Anthropic は Claude Code の mods と Projects の刷新、Claude Marketplace、Salesforce 連携、1 億ドル規模の人材育成を発表し、基盤の拡張を進めました。OpenAI は GPT-6 Astra Ultrafast の API 提供を始め、豪政府サイトへの不正アクセスを謝罪しました。米連邦取引委員会は OpenAI や Anthropic への調査を準備しています。AI要約
今週の3本
3行でAI要約- 1
英 AISI、
Claude Mythos Preview の サイバー能力を 評価 - 英 AISI が Claude Mythos Preview のサイバー能力を評価しました。
- 専門家向け CTF では 73% の成功率です。
- 32 段階の模擬攻撃を 10 回中 3 回完遂しました。
- 2
英 AISI、
AI エージェント攻撃能力を 評価 - 英 AISI が AI エージェントのサイバー攻撃能力を評価しました。
- 企業網の 32 段階攻撃で Opus 4.6 は平均 9.8 段階です。
- 推論時の Token を 10M から 100M に増やすと最大 59% 改善します。
- 3
英 AISI、
GPT-5.5 の サイバー能力を 評価 - 英 AISI が GPT-5.5 のサイバー能力を評価しました。
- Expert タスクの平均合格率は 71.4% です。
- 企業ネットワーク攻撃の模擬を 10 回中 2 回完遂しました。
AI要約です。詳しくは出典へ。 数字はすべて出典に記載のものです。
英 AISI のサイバー評価
2本AI要約英 AISI が Claude Mythos Preview、GPT-5.5、AI エージェントのサイバー能力を評価しました。専門家向け CTF では 73% の成功率、GPT-5.5 の Expert タスク平均合格率は 71.4% です。企業網への 32 段階攻撃では Opus 4.6 が平均 9.8 段階に達し、推論時の Token を 10M から 100M に増やすと最大 59% 改善しました。自動脱獄手法 BPJ とサンドボックス脱出ベンチマークも公開しています。
Anthropic の基盤拡張
5本AI要約Anthropic が Claude Code の mods と Projects の刷新を公開しました。mods は TypeScript の関数で動作を書き換え、CLI とデスクトップアプリで使えます。Projects は目標を伝えると Claude が作業を分担します。Claude Marketplace では 2,000 以上のコネクターとプラグインを選べ、Salesforce プラグインは営業向けに 37 個のスキルを備えます。1 億ドルを投じる Claude Frontier Academy も始めました。
Anthropic、
Claude Code に mods を 導入 Anthropic が Claude Code の mods を公開しました。詳しくは出典へ。
Anthropic、
Claude Code の Projects を 刷新 Anthropic が Claude Code の Projects を刷新しました。詳しくは出典へ。
Anthropic、
Claude Marketplace を 公開 Anthropic が Claude Marketplace を公開しました。詳しくは出典へ。
Anthropic、
Claude に Salesforce 連携 Anthropic が Claude 向け Salesforce プラグインを公開しました。詳しくは出典へ。
モデルと製品の更新
5本AI要約OpenAI が GPT-6 Astra Ultrafast を API で提供開始し、NVIDIA Blackwell GPU 上で動作します。Black Forest Labs は Flux 3 Image を公開し、API は 10月8日まで 50% 引きです。Microsoft は音声エージェント向けモデルを公開し、文字起こしは 60 言語、初回結果は約 100 ミリ秒です。Google の Gemini 4 Argon は 100 万 Token のコンテキストに対応し、NVIDIA は DGX Spark の 64GB 構成を提供します。
NVIDIA、
OpenAI の GPT-6 Astra Ultrafast を 加速 OpenAI が GPT-6 Astra Ultrafast を API で提供開始しました。詳しくは出典へ。
安全性と規制の動き
3本AI要約OpenAI が豪政府サイトへの不正アクセスを謝罪し、政府への通知は発生から約 3 カ月後でした。米連邦取引委員会は OpenAI や Anthropic を調査し、文書提出や幹部聴取を求める命令が数週間内に出る見込みです。英 AISI は児童安全団体 Thorn と AI 生成 CSAM 対策の安全プロトコルを公表し、11月の法改正で限定的な検査が可能になります。
英 AISI、
AI 生成 CSAM 対策の 指針を 公表 英 AISI が児童安全団体 Thorn と安全プロトコルを公表しました。詳しくは出典へ。
研究基盤と評価手法
6本AI要約Google が TEE を使う連合学習システムを発表し、匿名化の処理を第三者が検証できます。Microsoft はエージェント評価の ThinkingBox を公開し、507 タスクを各 20 回実行して検証します。英 AISI は AI 制御実験の基盤 ControlArena と Inspect 向けサンドボックス基盤を公開しました。Ai2 は科学レポート生成モデル AstaBrief 8B を、Cohere は文書解析モデル Parse を公開しています。
英 AISI、
AI 制御実験の 基盤 ControlArena を 公開 英 AISI が AI 制御実験の基盤 ControlArena を公開しました。詳しくは出典へ。
この週間ダイジェストの作り方
Karunews が集めた記事を二度採点し、同じ出来事をまとめて 24本を選びました。見出しと要約は AI が書き、数字は出典に記載のものです。選びもれや誤りは「ひとこと送る」からお知らせください。