新着
今日 7件8月12日(水)
· 1件8月11日(火)
· 1件Hugging Face、
ALTK-Evolve を 公開 Hugging Face が ALTK-Evolve を公開しました。 AppWorld で ACE より少ない Token で高い精度です。 DeepSeek-V3.2 では推論コストが ACE の約 40% です。
Hugging Face Blog
8月10日(月)
· 2件サイバーエージェント、
FOCS 2026 に 採択 サイバーエージェントの論文が FOCS 2026 に採択されました。 大坂直人氏と国立情報学研究所の平原秀一准教授の共著です。 q-CSP 遷移問題の近似困難性が PSPACE 困難だと証明しました。
CyberAgent AI Lab
8月7日(金)
· 1件Ai2、
判断を 測る TutorMoments を 公開 Ai2 が AI チューターの判断を測る TutorMoments を公開しました。詳しくは出典へ。
Allen Institute for AI (Ai2)
8月5日(水)
· 1件ABEJA、
SensorLLM で 行動認識を 検証 ABEJA が SensorLLM で人間行動認識を検証しました。 SensorLLM は Chronos でセンサーを埋め込み LLM に入力します。 異常検知は学習しておらずスパイクを指摘できません。
ABEJA Tech Blog
8月4日(火)
· 1件8月1日(土)
· 1件Epoch AI、
数学ベンチマークを 50 問に 拡大 Epoch AI が FrontierMath: Open Problems を 50 問に拡大しました。 未解決の研究数学の問題を集めたベンチマークです。 AI はこれまでに 3 問を解いています。
Epoch AI(Substack)
7月31日(金)
· 2件Ai2、
AI 生成文の 特徴表現を 追跡 Ai2 の infini-gram が AI 生成文の表現を追跡します。 AI 検出スコアだけでは出典の特定はできません。 AI 生成本は既存書籍の珍しい表現を多く含みます。
Allen Institute for AI (Ai2)
7月30日(木)
· 1件CyberAgent、
PPSN 2026 に 論文採択 CyberAgent の研究員らが PPSN 2026 に論文採択されました。 シンボリック回帰の汎化性能を理論的に解析した内容です。 2026年8月29日からイタリア・トレントで発表します。
CyberAgent AI Lab
7月29日(水)
· 1件7月28日(火)
· 1件Unslop、
主要 AI モデルの 政治傾向を 調査 Unslop が主要 16 モデルの政治傾向を調査しました。 全モデルがリバタリアン左派に分類されました。 Grok 4.5 は実行の半数で経済右派に振れました。
The Register · AI + ML
7月27日(月)
· 2件Import AI 466、
長期的コーディングと ロボット研究 Epoch と METR が長期的なプログラミング課題のベンチマーク MirrorCode を公開しました。詳しくは出典へ。
Import AICyberAgent AI Lab、
ECCV 2026 に 2 本採択 CyberAgent AI Lab の論文 2 本が ECCV 2026 に採択されました。 バンドル調整を安定化する新手法 CSS-BA を提案しました。 拡散モデル向けにリーマン計量を構築する手法を提案しました。
CyberAgent AI Lab
7月26日(日)
· 1件ABBEL、
信念状態で 長期対話を 効率化 ABBEL が長期対話向けの学習手法を提案しました。 要約ではなく自然言語の信念状態を監督します。 CollabBench で全履歴モデルとの差を約 50% 縮めました。
Berkeley AI Research
7月23日(木)
· 6件CyberAgent AI Lab、
IROS 2026 に 採択決定 CyberAgent AI Lab の論文が IROS 2026 に採択されました。 AI Lab からの採択は 3年連続です。 非言語行動を認識し自発的に接客するロボットの研究です。
CyberAgent AI Lab
7月22日(水)
· 1件7月21日(火)
· 1件7月17日(金)
· 2件7月16日(木)
· 3件DharmaOCR、
ポルトガル語 OCR で 優位 DharmaOCR がポルトガル語 OCR で新モデルを上回りました。 ベンチマークは 0.925 で Mistral OCR4 は 0.798 です。 ファインチューニングと DPO の 2 段階で学習しています。
Hugging Face BlogGoogle、
拡散モデルの 創造性を 解明 Google が拡散モデルの創造性の仕組みを解明しました。 創造性は学習時のスコア平滑化に由来します。 スコア平滑化が学習点間の補間を生み出します。
Google Research
7月15日(水)
· 1件Hugging Face、
音声 AI 評価の VoiceEQ を 公開 Hugging Face が音声 AI 評価の Real World VoiceEQ を公開しました。詳しくは出典へ。
Hugging Face Blog
7月14日(火)
· 1件サイバーエージェント、
GECCO 2026 に 3 本 サイバーエージェントの AI Lab が GECCO 2026 に 3 本採択されました。 採択は AI Lab として 5年連続です。 論文は 2026年7月の GECCO 2026 で発表します。
CyberAgent AI Lab
7月9日(木)
· 2件Epoch AI、
ベンチマーク EBR-bench 公開 Epoch AI がベンチマーク EBR-bench を公開しました。 盤ゲーム Earthborne Rangers で経験からの学習を試します。 現時点で AI が経験から学ぶ証拠はほとんど見られません。
Epoch AI(Substack)
7月8日(水)
· 1件7月7日(火)
· 2件Hugging Face、
PRX の データ戦略を 解説 Hugging Face が PRX のデータ戦略を解説しました。 事前学習は公開・社内データを混ぜ多様性を優先します。 画像は JPEG 品質 92 で再エンコードし容量を削減します。
Hugging Face Blog
7月2日(木)
· 3件CyberAgent AI Lab、
INTERSPEECH 2026 に 4 本採択 CyberAgent AI Lab の 4 本の論文が INTERSPEECH 2026 に採択されました。 音声合成の転移学習では、元モデルの発音知識は寄与しません。 日本語の書記素音素変換では、最適な LLM が 0.52% 未満を達成しました。
CyberAgent AI Lab