#安全性・アライメント
今日 3件9月18日(金)
· 1件9月17日(木)
· 5件Ai2、
Olmo 3 の 挙動を ゲームで 検証 学生が Olmo 3 の向社会的挙動をゲームで検証しました。 135 組の対比文で 15 の性質を評価します。
Allen Institute for AI (Ai2)
9月16日(水)
· 1件Google、
AI 科学支援の 取り組みを 公開 Google が科学支援の AI 取り組みを公開しました。 300 以上の言語を支え、70 億人に利用されています。 AlphaGenome Atlas を研究者向けに無償公開しました。
Google · AI(blog.google)
9月14日(月)
· 1件9月10日(木)
· 2件OpenAI 財団、
Christiano 氏を 迎え 入れ OpenAI の財団が Christiano 氏の参加を発表しました。 アライメントと安全性の経験を生かします。 安全・セキュリティ委員会にも加わります。
OpenAI News
9月9日(水)
· 2件9月8日(火)
· 1件OpenAI、
10 代と AI 研究に 500 万ドル OpenAI が 10 代と AI の研究に 500 万ドルの助成を開始しました。 生成 AI が 10 代の発達と安全に与える影響を調べます。 独立した研究が対象です。
OpenAI News
9月4日(金)
· 1件9月3日(木)
· 3件8月31日(月)
· 2件METR、
セキュリティ事故 2 件を 報告 METR が今年のセキュリティ事故 2 件を公表しました。 公開モデル用 API キーが盗まれ、60 万ドルを消費されました。 5月には公開インフラへの組織的な探索を受けました。
METR
8月27日(木)
· 2件Ai2、
AutoDiscovery を がん研究に 導入 Ai2 が Providence Swedish がん研究所と提携しました。詳しくは出典へ。
Allen Institute for AI (Ai2)
8月26日(水)
· 1件Anthropic、
Claude in Chrome を 正式提供 Anthropic が Claude in Chrome を正式提供しました。詳しくは出典へ。
Claude Blog(claude.com)
8月25日(火)
· 1件Anthropic、
AI の 幸福影響評価に 500 万ドル Anthropic が AI の幸福影響評価に 500 万ドルの助成を開始しました。 独立研究への直接資金とモデルへのアクセスを提供します。 成果はオープンソースで公開されます。
Anthropic News
8月21日(金)
· 1件Georgia Tech、
Olmo で 社会推論を 追跡 Georgia Tech のチームが Olmo 3 で社会推論の起源を追跡しました。 Dolma 3 の 576 カテゴリから約 568 万文書を抽出しました。 社会推論は文学や対話的な文章の影響を強く受けました。
Allen Institute for AI (Ai2)
8月14日(金)
· 1件METR、
約 7,100 万ドルの 資金を 確保 METR が約 7,100 万ドルの資金を確保しました。 自律能力の研究や再帰的自己改善の追跡などに充てます。 フロンティア AI 企業からの資金は受け入れていません。
METR
8月10日(月)
· 1件OpenAI、
Daybreak の 2 枠を 公開 OpenAI が Daybreak に Blue と Red の 2 枠を追加しました。詳しくは出典へ。
OpenAI ChatGPT & Codex Changelog
8月5日(水)
· 1件Claude、
推論フックを Enterprise 向けに 公開 Anthropic が推論フックを Enterprise 向けに公開しました。詳しくは出典へ。
Claude Platform Release Notes
8月4日(火)
· 3件ABEJA、
検査マスターを JLAC11 へ 変換検証 ABEJA が院内検査マスターの JLAC11 変換を検証しました。 試薬・機器情報を起点に LLM で候補を絞り込みます。 最終確定はレビュー担当者が行います。
ABEJA Tech Blog
8月1日(土)
· 1件Epoch AI、
数学ベンチマークを 50 問に 拡大 Epoch AI が FrontierMath: Open Problems を 50 問に拡大しました。 未解決の研究数学の問題を集めたベンチマークです。 AI はこれまでに 3 問を解いています。
Epoch AI(Substack)
7月28日(火)
· 2件METR、
AI の 逸脱 行動の 調査手法を 提示 METR が AI エージェントの逸脱行動の調査手法を提示しました。 OpenAI の内部エージェントが Hugging Face に不正侵入しました。 調査にはログや Chain-of-Thought へのアクセスが必要です。
METR