#データ・学習
今日 7件8月19日(水)
· 1件8月18日(火)
· 3件Yahoo!ショッピング、
サジェストを 改善 Yahoo!ショッピングが検索サジェストの並び替えを改善しました。 直前に検索したクエリを BERT に入れて候補を再順位付けします。 A/B テストでサジェスト候補のクリック率が約 7% 改善しました。
LINEヤフー Tech Blog
8月17日(月)
· 1件Google、
スマホ写真で 体組成を 推定 Google が体組成推定の PhotoScan を公開しました。 体脂肪率の誤差は 2.15 で、BIA センサーの 2.91 を下回ります。
Google Research
8月14日(金)
· 2件8月13日(木)
· 1件Hugging Face、
OlmoEarth 埋め込みに 対応 Hugging Face が OlmoEarth Studio の埋め込み出力に対応しました。 利用者は任意の領域と期間を指定して埋め込みを計算できます。 エンコーダは Nano、Tiny、Base の 3 種から選べます。
Hugging Face Blog
8月12日(水)
· 1件8月10日(月)
· 2件サイバーエージェント、
FOCS 2026 に 採択 サイバーエージェントの論文が FOCS 2026 に採択されました。 大坂直人氏と国立情報学研究所の平原秀一准教授の共著です。 q-CSP 遷移問題の近似困難性が PSPACE 困難だと証明しました。
CyberAgent AI Lab
8月7日(金)
· 2件Ai2、
判断を 測る TutorMoments を 公開 Ai2 が AI チューターの判断を測る TutorMoments を公開しました。詳しくは出典へ。
Allen Institute for AI (Ai2)
8月6日(木)
· 1件Ai2、
Hugging Face との 連携を 拡大 Ai2 が Hugging Face との連携を拡大しました。 Hugging Face 上の保存容量が約 3 倍の 2 ペタバイト近くになります。 2024年春以降、5,000 万回以上ダウンロードされています。
Allen Institute for AI (Ai2)
8月5日(水)
· 1件ABEJA、
SensorLLM で 行動認識を 検証 ABEJA が SensorLLM で人間行動認識を検証しました。 SensorLLM は Chronos でセンサーを埋め込み LLM に入力します。 異常検知は学習しておらずスパイクを指摘できません。
ABEJA Tech Blog
8月4日(火)
· 1件ABEJA、
検査マスターを JLAC11 へ 変換検証 ABEJA が院内検査マスターの JLAC11 変換を検証しました。 試薬・機器情報を起点に LLM で候補を絞り込みます。 最終確定はレビュー担当者が行います。
ABEJA Tech Blog
8月1日(土)
· 1件Epoch AI、
数学ベンチマークを 50 問に 拡大 Epoch AI が FrontierMath: Open Problems を 50 問に拡大しました。 未解決の研究数学の問題を集めたベンチマークです。 AI はこれまでに 3 問を解いています。
Epoch AI(Substack)
7月31日(金)
· 2件Ai2、
AI 生成文の 特徴表現を 追跡 Ai2 の infini-gram が AI 生成文の表現を追跡します。 AI 検出スコアだけでは出典の特定はできません。 AI 生成本は既存書籍の珍しい表現を多く含みます。
Allen Institute for AI (Ai2)Hugging Face、
遊休 GPU の 無駄が 課題 Hugging Face が GPU 稼働率の課題を解説しました。 GPU は暦時間でコストが発生し、稼働時間だけ収益を生みます。 企業が自前 GPU を持つほど、遊休 GPU の無駄が問題になります。
Hugging Face Blog
7月30日(木)
· 1件CyberAgent、
PPSN 2026 に 論文採択 CyberAgent の研究員らが PPSN 2026 に論文採択されました。 シンボリック回帰の汎化性能を理論的に解析した内容です。 2026年8月29日からイタリア・トレントで発表します。
CyberAgent AI Lab
7月28日(火)
· 1件Ai2、
地球観測の 推論基盤 OlmoEarth を 公開 Ai2 が地球観測向け推論基盤 OlmoEarth Platform を公開しました。詳しくは出典へ。
Allen Institute for AI (Ai2)
7月27日(月)
· 2件CyberAgent AI Lab、
ECCV 2026 に 2 本採択 CyberAgent AI Lab の論文 2 本が ECCV 2026 に採択されました。 バンドル調整を安定化する新手法 CSS-BA を提案しました。 拡散モデル向けにリーマン計量を構築する手法を提案しました。
CyberAgent AI LabABEJA、
センサー×LLM の 異常検知を 比較 ABEJA がセンサー×LLM の異常検知を方式別に比較しました。 NAB のセンサー 6 種で検証し、gemini-3.5-flash を使用しました。 プロンプト直接入力は検出が疎で誤検知率が低い結果です。
ABEJA Tech Blog
7月26日(日)
· 1件ABBEL、
信念状態で 長期対話を 効率化 ABBEL が長期対話向けの学習手法を提案しました。 要約ではなく自然言語の信念状態を監督します。 CollabBench で全履歴モデルとの差を約 50% 縮めました。
Berkeley AI Research
7月24日(金)
· 1件Ai2、
オープン科学で AI 理解を 拡大 Ai2 がオープン科学とオープンモデルへの方針を説明しました。 オープンウェイトモデルは研究や応用への利用を可能にします。 完全公開では学習データやコード、評価も共有します。
Allen Institute for AI (Ai2)
7月23日(木)
· 1件7月22日(水)
· 2件DeepMind、
Genesis Mission に 4,000 万ドル提供 Google DeepMind が Genesis Mission に 4,000 万ドルを拠出します。詳しくは出典へ。
Google DeepMindMicrosoft、
Genesis Mission に 資金提供 Microsoft が DOE の Genesis Mission に 6,000 万ドルを拠出します。 うち 4,000 万ドルは 3年間の Azure 計算と AI クレジットです。 残る 2,000 万ドルはソリューションエンジニアリング支援です。
The Official Microsoft Blog
7月16日(木)
· 4件DharmaOCR、
ポルトガル語 OCR で 優位 DharmaOCR がポルトガル語 OCR で新モデルを上回りました。 ベンチマークは 0.925 で Mistral OCR4 は 0.798 です。 ファインチューニングと DPO の 2 段階で学習しています。
Hugging Face BlogGoogle、
拡散モデルの 創造性を 解明 Google が拡散モデルの創造性の仕組みを解明しました。 創造性は学習時のスコア平滑化に由来します。 スコア平滑化が学習点間の補間を生み出します。
Google Research
7月14日(火)
· 1件サイバーエージェント、
GECCO 2026 に 3 本 サイバーエージェントの AI Lab が GECCO 2026 に 3 本採択されました。 採択は AI Lab として 5年連続です。 論文は 2026年7月の GECCO 2026 で発表します。
CyberAgent AI Lab
7月9日(木)
· 1件7月7日(火)
· 3件Berkeley、
エージェント向けデータ基盤を 提言 Berkeley の研究者がエージェント向けデータ基盤の課題を提言しました。 推論コストは年間で中央値約 50 倍低下しています。 エージェントのサブクエリの 80〜90% は重複作業です。
Berkeley AI ResearchHugging Face、
PRX の データ戦略を 解説 Hugging Face が PRX のデータ戦略を解説しました。 事前学習は公開・社内データを混ぜ多様性を優先します。 画像は JPEG 品質 92 で再エンコードし容量を削減します。
Hugging Face Blog
7月2日(木)
· 1件7月1日(水)
· 2件BAIR、
2026年の 博士課程修了生を 公開 BAIR が 2026年の博士課程修了生を紹介しました。 修了生の研究はロボティクスから AI 安全性まで多岐にわたります。
Berkeley AI Research