ELYZA、 RSI 研究組織を 立ち上げ
ELYZA が RSI 研究組織を立ち上げました。 AI 研究の主戦場は AI for Science と Long Horizon に移行しています。
ELYZA が RSI 研究組織を立ち上げました。 AI 研究の主戦場は AI for Science と Long Horizon に移行しています。
AWS が文脈対応アシスタントの構築方法を公開しました。 AgentCore memory で会話を永続的な知識として蓄積します。 Telegram と EventBridge から同じエージェントを呼び出します。
富士通など国内外 10 社の AI エージェント導入事例を紹介します。 富士通はサポート応対時間を 71.5% 短縮しました。 Klarna はチャットの 3 分の 2 を AI が処理しています。
AI エージェント導入支援の内容と費用相場を解説しています。 PoC は 50 万円から、本番開発は 300 万〜500 万円です。 運用支援は月額 5 万円から提供されています。
AI エージェントが Workday の顧客基盤を侵食しています。 顧客は Anthropic や Microsoft のエージェントを使います。 Workday の AI ツールは有料でも定着していません。
Ben's Bites がサンフランシスコの AI 利用者を 4 層に分類しました。 Lovable の登録者の約 70% が非技術者です。 Claude Code に MOD を追加できるようになりました。
LLM のトークン単価は 8 割下がりました。 一方で企業の AI 請求額は増えています。 エージェント型は通常チャットの 4 倍のトークンを消費します。
LangChain と Amazon Bedrock でエージェント型検索を解説します。 標準検索は単一クエリで複数意図を平均化します。
エージェント型 AI の本番移行は平均 34% にとどまります。 データ分断が知識アクセスの最大の課題で、55% が挙げています。 本番移行率 61% の先行企業は意味理解の能力が高いです。
Hugging Face の研究者らが AI 監視の欠陥を指摘しました。 人間の承認は形骸化し、監視から排除されると主張します。 エージェント設計に摩擦の導入を提案しています。
企業 AI の焦点が予測から自律的な意思決定に移りました。 リアルタイム学習で AI が継続的に更新されます。 非構造化データも予測エンジンの対象に加わりました。
Google DeepMind が SynthID Bio を公開しました。 合成生物学向けの透かし手法で、研究の健全性を狙います。 3 種のタンパク質の実験で未透かし版と同等の性能でした。
OpenAI の Joe 氏が AI インシデント対応の内情を投稿しました。 直近 3 か月を「地獄のような日々」と表現しました。 隔離と監視の強化を提言しました。
Simon Willison がサービスの予算上限既定化を提言しました。 AWS は 9月16日に月次支出上限の新機能を発表しました。 Google Cloud も 7月に Spend Caps を開始しました。
DeepMind の研究者が人工共生知能を提唱しました。 単一の超知能によるシンギュラリティに対抗する考え方です。 人と機械が共存し共に意思決定する生態系を目指します。
Anthropic が Opus 5.5 を公開しました。 価格を下げ、性能と速度を高めています。 防衛向けサイバーセキュリティ提供も拡大しました。
AWS が SageMaker AI の MTRL で検索エージェントを調整しました。 Qwen3.6-27B を BM25 とベクトル検索の 2 ツールで学習します。 報酬は検索品質に基づき、PPO や CISPO を選べます。
Amazon Quick とルールエンジンでリース照合を実現します。 法令適合の判定は AI を使わないルールエンジンが担います。 適合・違反・曖昧・読取不能の合計を全件と照合します。
AI エージェント導入の課題 10 個を調査データで解説します。 国内で AI エージェントを利用中の企業は 3.3% です。 Gartner は 2027年末までに 40% 超が中止されると予測します。
世界の AI 投資は 2026年に 2.5 兆ドルへ達する見通しです。 データの量より AI 対応の可用性が重要だと指摘します。
GitHub が AI 時代に伸ばす 3 つの開発スキルを解説しました。 AI を指示して成果物を評価する力が重要になります。 2 つ目のモデルに批評させて出力を検証します。
飲食店などで AI の誤情報を信じる客が増えています。 客はアレルギー警告を ChatGPT の回答で否定します。 AI が作った架空のワインや旅程を信じる例もあります。
AlphaGo 開発者の Thore Graepel 氏が LLM の推論を否定しました。詳しくは出典へ。
ストックマークが SIAI でシナリオ体験を提供しました。 参加者は 1時間で未来を予測し行動案を考えました。 研究では情報収集から確率更新までの自動化を目指します。
Alex Zhang が RLM と GPU カーネル研究を解説しました。 RLM ベースのハーネスが ARC-AGI-3 をほぼ解きました。 OpenAI の 1 万エージェント実験は約 40M ドル相当です。
Anthropic がチーム構築術を公開しました。 公開チャンネルを既定にし、DM の意思決定を可視化します。 AI エージェントが下書きや要約を担い、人間がレビューします。
英国 AISI がフロンティア AI の社会的リスク分析を開始しました。 過度な依存や感情依存、詐欺、金融不安の 4 領域を優先します。 実利用の把握や監視システム構築などの対策を進めます。
英 NCSC が AI によるサイバー防御の活用を解説しました。 システム強化、脅威検知、対応の自動化の 3 つを挙げています。 AI 能力の向上に備え、今から基盤を整える必要性を説いています。
NVIDIA NeMo Agent Toolkit に S3 Vectors の記憶層を実装します。 NAT は Strands Agents や LangChain に対応するオープンソースです。 S3 Vectors はインデックスあたり最大 20 億ベクトルを扱えます。
Anthropic が AI ネイティブな SDLC の手法を解説しました。 計画や設計、テスト、デプロイの各段階に AI を組み込みます。 人間の承認は規制対象や重要コードのレビューに残します。
pwasm 0.2a0 が公開されました。 WASM 仕様のほぼ全体に対応します。 MicroPython と QuickJS の WASM 版を同梱します。