MorphMind、 Academic Humanizer を 公開
MorphMind が Academic Humanizer を公開しました。 Claude のスキルとして動作し、AI 生成の論文を書き換えます。 著者の過去の文章に合わせて文体を整えます。
MorphMind が Academic Humanizer を公開しました。 Claude のスキルとして動作し、AI 生成の論文を書き換えます。 著者の過去の文章に合わせて文体を整えます。
英 AISI が Engineering Playbook を公開しました。詳しくは出典へ。
Sequent がアライメント研究の非営利組織を設立しました。 英国 AISI と Timaeus の人材が参加しています。 初期調達目標は 1 億〜1 億 5,000 万ドルです。
Epoch AI が FrontierMath v2 を公開しました。 Claude Fable 5 が首位で、Tier 1〜3 は 87% です。 Tier 4 のスコアは 88% です。
Google が機械学習の忘却監査の新手法を発表しました。 f ダイバージェンスで局所的なデータ変化を検出します。 AISTATS 2026 で発表されました。
Import AI 458 号が AI の未来と特異点を論考しました。 AI の進歩は今後も続き、社会に大きな変化をもたらします。 AI は自己改良で特異点に至る可能性があります。
Google が Gemini 3.5 と Gemini Omni を発表しました。 Gemini Spark は MCP 対応の常時稼働エージェントです。 Cursor Composer 2.5 は Kimi K2.5 で調整されています。
OpenAI が音声 API に GPT Realtime 2 を追加しました。 Thinking Machines は低遅延の対話システムを予告しました。 Anthropic は Claude for Legal を公開しました。
Meta と KAIST が Neural Computer を公開しました。 計算・記憶・入出力を学習した状態で統合します。 Juergen Schmidhuber 氏が関わっています。
METR が Anthropic の R&D 自動化リスク評価を批判しました。 調査結果の分析と提示方法に重大な問題があると指摘します。 Opus 4.6 のリスクが非常に低いという結論自体には同意します。
英 AISI が Microsoft と提携しました。 高リスク AI 能力の評価手法を共同開発します。 会話 AI と利用者の相互作用も研究します。
ABEJA がエッジ環境の VLM による構造化出力を検証しました。 Grammar 制約で JSON 形式を強制し、出力崩れを防ぎます。 Visual Prompt Injection への出力層の防御にもなります。
METR が Anthropic の sabotage リスク報告をレビューしました。 Claude Opus 4 と 4.1 の壊滅的 sabotage リスクは低いと結論しました。 Opus 4 が本能的な misaligned 推論をする可能性を指摘しました。
METR が gpt-oss-120b の評価手法を検証しました。 悪意あるファインチューニング実験を対象としています。 17 件の提言のうち OpenAI は 9 件を採用しました。
METR がフロンティア AI のリスク開示の論点を示しました。 公開情報だけでは危険な能力を把握できないと指摘します。 3 か月ごとの外部チームによるリスク調査案を提示します。
METR が AI 推論の可読性と忠実性の価値を解説しました。 可読で忠実な推論は AI のミスや欺瞞の検出を容易にします。 OpenAI や Anthropic など 5 社が推論モデルを公開しました。
METR が配備前テスト偏重の AI 安全政策は不十分だと指摘しました。 モデル窃取や内部利用による壊滅的悪用は防げません。 危険能力の早期評価と重みの保護、透明性の強化を求めています。