#安全性・アライメント
今日 12件10月2日(金)
· 7件AISI、
AI ロボティクスの 評価ガイドを 公開 AISI が AI ロボティクスの評価ガイドを公開しました。 物理・心理・社会の 3 類型でリスクを整理しています。 カフェ搬送など 2 例で確認観点を 9 項目に整理しました。
AIセーフティ・インスティテュート(J-AISI)AI 情報通、
9月14日 15時の 情報を 報告 Anthropic が Claude の悪用事例をまとめた報告書を公表しました。 Moonshot AI が Kimi のリクエストを Claude へ転送していました。
AIセーフティ・インスティテュート(J-AISI)AISI、
AI セーフティ評価 TF 総会を 開催 AISI が AI セーフティ評価タスクフォース総会を開催します。 評価環境の概要や今年度の活動内容を紹介します。 10月7日開催で参加費は無料、誰でも参加できます。
AIセーフティ・インスティテュート(J-AISI)国連、
AI 開発速度への 懸念を 公表 国連が AI 開発速度への懸念と国際協力を公表しました。 Microsoft AI が人間の管理を重視する指針の初稿を公表しました。
AIセーフティ・インスティテュート(J-AISI)国連、
AI 管理の 国際枠組みを 提言 国連が AI 管理の国際枠組みの必要性を示しました。 グテーレス事務総長は AI が統治能力を超えると警告しました。 生死を左右する判断を AI に委ねるべきでないと強調しました。
AIセーフティ・インスティテュート(J-AISI)
10月1日(木)
· 15件RFK Jr.、
医療の 専門知は 「専制」と 主張 RFK Jr. 氏が AI で医療の専門知から解放されると主張しました。 同氏は医療上の事実と専門性を「専制」と表現しました。 AI は完全ではないが Kennedy 氏より誤りが少ないとしています。
Ars Technica · AI生物兵器の
脅威、 AI 抜きでも 深刻 生物兵器は核に次ぐ脅威で、参入の敷居が低いとされます。 Anthropic は今月、Claude の制限回避を試みた 5 件を公表しました。 米国防総省の文書は生物兵器を脅威の 2 番目に位置づけています。
WIRED · AIGoogle、
AI タンパク質の 透かし 手法を 開発 Google が AI 設計タンパク質への透かし手法を開発しました。 バイオセキュリティ対策を目的としています。 人気の AI タンパク質設計ツールで機能します。
Ars Technica · AI
9月30日(水)
· 10件Anthropic、
AI 体験の 公開調査を 開始 Anthropic が AI 体験の聞き取り調査を始めました。 回答は公開を選べば誰でも読めます。 昨年 12月の調査には 81,000 人が参加しました。
Anthropic Research
9月29日(火)
· 8件Timnit Gebru、
AI の 存在脅威論を 批判 Timnit Gebru が AI の存在脅威論を有害な逸らしと批判しました。 同氏は Anthropic の出資者らが脅威論を広めていると指摘します。 同氏は著書 Deep Unlearning を来年初めに刊行予定です。
WIRED · AI欧州委員会、
著作権の 意見募集を 開始 欧州委員会が著作権環境の改善に向けた意見募集を始めました。 募集は 9月29日に始まり、11月3日に締め切られます。 創造性とイノベーションのための著作権の取り組みを準備します。
EU Digital Strategy(含 AI Office)