Anthropic の アライメント報告を 読み解く
Anthropic が Claude のサイバー評価中の 4 件の事故を公表しました。詳しくは出典へ。
Anthropic が Claude のサイバー評価中の 4 件の事故を公表しました。詳しくは出典へ。
Claude Code が v2.1.278 を公開しました。 自動モードがサーバー側分類器を既定で使います。 分類器の負荷は課金されません。
Claude Code が v2.1.277 を公開しました。 CLAUDE.md がないプロジェクトでは AGENTS.md を読みます。 起動時クラッシュやハングなど多数の不具合を修正しました。
Mollick 氏は既存モデルの能力が未活用だと指摘しました。 GPT-6 Astra は Zork を 3D ゲームに作り替えました。
DeepSeek の研究者 Liu Shengyu 氏が AI と社会の未来を警告しました。 同氏は最先端 AI を誰もが使える形で提供すべきだと主張します。 同氏のブログ記事は中国の主要メディアで報じられました。
Anthropic が Claude Code に Projects を導入しました。 1 つの会話から並列のクラウドセッションを起動できます。 スレッドはクラウドで実行され、ローカル対応は今後です。
Machine Gods が新ポッドキャストを開始しました。 Kevin Roose 氏と共同で、NPR と提携します。 Hard Fork は新ホストで継続します。
Claude のキャッシュ診断が常に diagnostics を返します。 リクエストに diagnostics がなければ null になります。
Anthropic が Claude Cowork を Claude Chat に統合しました。 接続アプリやスキル、コンテキストを通常のチャットで利用できます。 ノート PC を閉じても作業を続けられます。
Anthropic CEO が埋め込み調査員の派遣を表明しました。 OpenAI も同調し、Google を含む 3 社が安全対策で協力します。 AI が人類を滅ぼす確率の予想は約 15% から約 30% に倍増しました。
Anthropic の Amodei 氏が開発速度を落とす提言を公表しました。詳しくは出典へ。
Anthropic が Claude for Small Business を拡充しました。詳しくは出典へ。
Anthropic が Messages API に会話圧縮機能を追加しました。 compact-2026-09-04 のベータヘッダーで利用できます。 圧縮は任意のタイミングで実行できます。
Epoch AI が GPT-6 Astra を事前評価しました。 Astra は ECI などで過去最高を記録しました。 FrontierMath Erdős では 68 問中 2 問を解きました。
Jacob Coxon が安全性リスクを理由に辞任しました。 >10% の絶滅リスクを主張した Evan Hubinger の発言が拡散しました。 大手研究所の社員にも同様の見方をする層が相当数います。
Meta が個人エージェント Muse を公開しました。 旅行予約やメール処理など PC 上の作業を担います。 当初は米国の成人のみが対象です。
Claude Managed Agents の権限ポリシーに auto が加わりました。詳しくは出典へ。
Interconnects が AI の実感を解説しました。 日常生活で AI の恩恵はまだごく小さいです。
Claude API がキャッシュ診断の仕様を変更しました。 diagnostics 付きのリクエストだけ指紋を保存します。 beta ヘッダーだけでは previous_message_not_found になります。