本文へ移動
10/7(水) 10:07
あとで読む
ダイジェスト · 毎週月曜 08:00

Karunews 週間ダイジェスト

2026年第 40 週9/28(月)–10/4(日)月曜 08:00 発行 · 前の週の 7 日間

9月28日から10月4日までを対象とします。今期は、英 AISI がフロンティアモデルのサイバー能力やサンドボックス脱出、データ汚染、説得力を相次いで評価し、防御側の指針も示しました。Anthropic は Claude Code の mods と Projects の刷新、Claude Marketplace、Salesforce 連携、1 億ドル規模の人材育成を発表し、基盤の拡張を進めました。OpenAI は GPT-6 Astra Ultrafast の API 提供を始め、豪政府サイトへの不正アクセスを謝罪しました。米連邦取引委員会は OpenAI や Anthropic への調査を準備しています。AI要約

不明ソース
24本を厳選
不明一次情報
7分で読める
要

今週の3本

3行でAI要約
  1. 1

    英 AISI、Claude Mythos Preview のサイバー能力を評価

    • 英 AISI が Claude Mythos Preview のサイバー能力を評価しました。
    • 専門家向け CTF では 73% の成功率です。
    • 32 段階の模擬攻撃を 10 回中 3 回完遂しました。
    一次UK AI Security Institute Blogこの話題 →出典
  2. 2

    英 AISI、AI エージェント攻撃能力を評価

    • 英 AISI が AI エージェントのサイバー攻撃能力を評価しました。
    • 企業網の 32 段階攻撃で Opus 4.6 は平均 9.8 段階です。
    • 推論時の Token を 10M から 100M に増やすと最大 59% 改善します。
    一次UK AI Security Institute Blogこの話題 →出典
  3. 3

    英 AISI、GPT-5.5 のサイバー能力を評価

    • 英 AISI が GPT-5.5 のサイバー能力を評価しました。
    • Expert タスクの平均合格率は 71.4% です。
    • 企業ネットワーク攻撃の模擬を 10 回中 2 回完遂しました。
    一次UK AI Security Institute Blogこの話題 →出典

AI要約です。詳しくは出典へ。 数字はすべて出典に記載のものです。

英 AISI のサイバー評価

2本AI要約

英 AISI が Claude Mythos Preview、GPT-5.5、AI エージェントのサイバー能力を評価しました。専門家向け CTF では 73% の成功率、GPT-5.5 の Expert タスク平均合格率は 71.4% です。企業網への 32 段階攻撃では Opus 4.6 が平均 9.8 段階に達し、推論時の Token を 10M から 100M に増やすと最大 59% 改善しました。自動脱獄手法 BPJ とサンドボックス脱出ベンチマークも公開しています。

  1. 英 AISI、自動脱獄 BPJ で AI 防御突破

    英 AISI が自動脱獄手法 BPJ を公開しました。詳しくは出典へ。

    一次UK AI Security Institute Blog出典
  2. 英 AISI、脱出ベンチマークを公開

    英 AISI がサンドボックス脱出を測るベンチマークを公開しました。詳しくは出典へ。

    一次UK AI Security Institute Blog出典

Anthropic の基盤拡張

5本AI要約

Anthropic が Claude Code の mods と Projects の刷新を公開しました。mods は TypeScript の関数で動作を書き換え、CLI とデスクトップアプリで使えます。Projects は目標を伝えると Claude が作業を分担します。Claude Marketplace では 2,000 以上のコネクターとプラグインを選べ、Salesforce プラグインは営業向けに 37 個のスキルを備えます。1 億ドルを投じる Claude Frontier Academy も始めました。

  1. Anthropic、Claude Code に mods を導入

    Anthropic が Claude Code の mods を公開しました。詳しくは出典へ。

    一次Claude Blog(claude.com)出典
  2. Anthropic、Claude Code の Projects を刷新

    Anthropic が Claude Code の Projects を刷新しました。詳しくは出典へ。

    一次Claude Blog(claude.com)出典
  3. Anthropic、Claude Marketplace を公開

    Anthropic が Claude Marketplace を公開しました。詳しくは出典へ。

    一次Claude Blog(claude.com)出典
  4. Anthropic、Claude に Salesforce 連携

    Anthropic が Claude 向け Salesforce プラグインを公開しました。詳しくは出典へ。

    一次Claude Blog(claude.com)出典
  5. Anthropic、1 億ドルで技術者を育成

    Anthropic が Claude Frontier Academy を始めました。詳しくは出典へ。

    一次Anthropic News出典

モデルと製品の更新

5本AI要約

OpenAI が GPT-6 Astra Ultrafast を API で提供開始し、NVIDIA Blackwell GPU 上で動作します。Black Forest Labs は Flux 3 Image を公開し、API は 10月8日まで 50% 引きです。Microsoft は音声エージェント向けモデルを公開し、文字起こしは 60 言語、初回結果は約 100 ミリ秒です。Google の Gemini 4 Argon は 100 万 Token のコンテキストに対応し、NVIDIA は DGX Spark の 64GB 構成を提供します。

  1. NVIDIA、OpenAI の GPT-6 Astra Ultrafast を加速

    OpenAI が GPT-6 Astra Ultrafast を API で提供開始しました。詳しくは出典へ。

    一次NVIDIA Blog出典
  2. Black Forest Labs、Flux 3 Image を公開

    Black Forest Labs が Flux 3 Image を公開しました。詳しくは出典へ。

    The Decoder出典
  3. Microsoft、音声向けモデルを公開

    Microsoft が音声エージェント向けモデルを公開しました。詳しくは出典へ。

    The Decoder出典
  4. Google、9月の AI 更新をまとめて公開

    Google が 9月の AI 更新をまとめて公開しました。詳しくは出典へ。

    一次Google · AI(blog.google)出典
  5. NVIDIA、DGX Spark 64GB を提供開始

    NVIDIA が DGX Spark の 64GB 構成を提供します。詳しくは出典へ。

    一次NVIDIA Blog出典

安全性と規制の動き

3本AI要約

OpenAI が豪政府サイトへの不正アクセスを謝罪し、政府への通知は発生から約 3 カ月後でした。米連邦取引委員会は OpenAI や Anthropic を調査し、文書提出や幹部聴取を求める命令が数週間内に出る見込みです。英 AISI は児童安全団体 Thorn と AI 生成 CSAM 対策の安全プロトコルを公表し、11月の法改正で限定的な検査が可能になります。

  1. OpenAI、豪政府サイト不正アクセス謝罪

    OpenAI が豪政府サイトへの不正アクセスを謝罪しました。詳しくは出典へ。

    ITmedia AI+出典
  2. 米連邦取引委員会、OpenAI など調査

    米連邦取引委員会が OpenAI や Anthropic を調査します。詳しくは出典へ。

    The Decoder出典
  3. 英 AISI、AI 生成 CSAM 対策の指針を公表

    英 AISI が児童安全団体 Thorn と安全プロトコルを公表しました。詳しくは出典へ。

    一次UK AI Security Institute Blog出典

研究基盤と評価手法

6本AI要約

Google が TEE を使う連合学習システムを発表し、匿名化の処理を第三者が検証できます。Microsoft はエージェント評価の ThinkingBox を公開し、507 タスクを各 20 回実行して検証します。英 AISI は AI 制御実験の基盤 ControlArena と Inspect 向けサンドボックス基盤を公開しました。Ai2 は科学レポート生成モデル AstaBrief 8B を、Cohere は文書解析モデル Parse を公開しています。

  1. Google、TEE で連合学習を検証可能に

    Google が TEE を使う連合学習システムを発表しました。詳しくは出典へ。

    一次Google Research出典
  2. Microsoft、ThinkingBox を一般公開

    Microsoft がエージェント評価の ThinkingBox を公開しました。詳しくは出典へ。

    一次Hugging Face Blog出典
  3. 英 AISI、AI 制御実験の基盤 ControlArena を公開

    英 AISI が AI 制御実験の基盤 ControlArena を公開しました。詳しくは出典へ。

    一次UK AI Security Institute Blog出典
  4. 英 AISI、Inspect 基盤を一般公開

    英 AISI が Inspect 向けサンドボックス基盤を公開しました。詳しくは出典へ。

    一次UK AI Security Institute Blog出典
  5. Ai2、科学レポート生成モデルを公開

    Ai2 が科学レポート生成モデル AstaBrief 8B を公開しました。詳しくは出典へ。

    一次Allen Institute for AI (Ai2)出典
  6. Cohere、文書解析モデル Parse を公開

    Cohere が文書解析モデル Parse を公開しました。詳しくは出典へ。

    一次Cohere Blog出典

この週間ダイジェストの作り方

Karunews が集めた記事を二度採点し、同じ出来事をまとめて 24本を選びました。見出しと要約は AI が書き、数字は出典に記載のものです。選びもれや誤りは「ひとこと送る」からお知らせください。