#推論
今日 3件5月20日(水)
· 1件5月12日(火)
· 2件Anthropic、
Opus 4.7 の 高速モード提供 Anthropic が Claude Opus 4.7 の高速モードに対応しました。 fast 指定と beta ヘッダーで出力生成が高速になります。 価格とレート制限は Opus 4.6 の高速モードと同じです。
Claude Platform Release Notes
5月8日(金)
· 1件並列推論、
適応制御の 新段階を 分析 適応的並列推論が効率的な新手法として注目されています。 逐次推論はコンテキスト上限と遅延の増大を招きます。 既存手法は並列構造を固定しており、適応制御が課題です。
Berkeley AI Research
5月6日(水)
· 1件5月1日(金)
· 1件4月30日(木)
· 1件4月28日(火)
· 1件4月22日(水)
· 1件4月20日(月)
· 1件GRASP、
長期計画を 並列最適化 GRASP は学習した世界モデル向けの勾配ベースプランナーです。 軌道を仮想状態に持ち上げ、時間方向の最適化を並列化します。 状態に確率性を加え、行動への勾配を整形します。
Berkeley AI Research
3月27日(金)
· 1件3月25日(水)
· 1件3月23日(月)
· 1件ABEJA、
エッジ VLM の 構造化出力を 検証 ABEJA がエッジ環境の VLM による構造化出力を検証しました。 Grammar 制約で JSON 形式を強制し、出力崩れを防ぎます。 Visual Prompt Injection への出力層の防御にもなります。
ABEJA Tech Blog
3月17日(火)
· 2件3月13日(金)
· 1件SPEX、
LLM の 相互作用を 分析 SPEX が LLM の重要な相互作用を特定します。 ProxySPEX は約 10 倍少ないアブレーションで同等の性能です。 SPEX は数千特徴の入力でも忠実度を維持します。
Berkeley AI Research
3月10日(火)
· 1件ABEJA、
Agentic RL の 知見を 公開 ABEJA が Agentic RL の取り組みと知見を公開しました。 SFT と強化学習でエージェント能力を強化しています。 検索ツールに OpenSearch を採用しています。
ABEJA Tech Blog
3月2日(月)
· 1件Stockmark、
NLP2026 の 論文 5 本を 公開 Stockmark が NLP2026 で発表する論文を公開しました。 シーズとニーズを知識グラフで結ぶ手法を提案します。 専門家評価付きの製品アイデアデータセットも公開します。
Stockmark Tech Blog
1月30日(金)
· 1件Differential Transformer V2 が
登場 Hugging Face が Differential Transformer V2 を発表しました。 V2 は KV キャッシュを増やさずデコード速度を改善します。 V1 は推論速度が約 6〜12% 低下する課題がありました。
ABEJA Tech Blog
1月22日(木)
· 1件Mistral AI、
vLLM の メモリリークを 調査 Mistral AI が vLLM のメモリリークを調査しました。 リークは P/D 分離構成の decode 側でのみ発生しました。 システムメモリが毎分 400 MB 増加しました。
Mistral AI
2025年12月24日(水)
· 3件DeepSeek-R1 の
論文、 学習手法を 読み解く DeepSeek-R1 は DeepSeek-V3-Base をベースにしています。 少数の CoT データでファインチューニングします。 強化学習には GRPO とルールベース報酬を使います。
ABEJA Tech BlogABEJA、
gpt-oss-120b の 推論を 検証 ABEJA が gpt-oss-120b の推論能力を検証しました。 論理クイズや数学の問題を解かせて思考過程を観察しました。 設定は temperature 1.0、reasoning effort は high です。
ABEJA Tech Blogπ0 の
action expert、 実装を 理解 ABEJA の大谷氏が π0 の action expert をコードで解説しました。 action expert は VLM に後付けし連続アクションを生成します。 Flow Matching の基礎を三日月データで確認します。
ABEJA Tech Blog
2025年12月19日(金)
· 1件Gemini API、
フィールド名の 改名を 実施 Gemini API が v1beta でフィールド名を変更しました。 total_reasoning_tokens が total_thought_tokens になります。 思考モデルの「thoughts」の概念に合わせるためです。
Gemini API Changelog
2025年12月3日(水)
· 1件2025年12月1日(月)
· 1件2025年11月1日(土)
· 1件Berkeley、
TD 学習なしの RL を 解説 Berkeley の研究が TD 学習なしの RL を解説しました。 分割統治で Bellman 再帰を対数的に削減します。 ゴール条件付き RL で複雑なタスクに適用できます。
Berkeley AI Research
2025年9月29日(月)
· 1件DeepSeek、
V3.2-Exp に API を 更新 DeepSeek が API の 2 モデルを DeepSeek-V3.2-Exp に更新しました。詳しくは出典へ。
DeepSeek API Change Log
2025年6月10日(火)
· 1件2025年5月28日(水)
· 1件DeepSeek、
reasoner を R1-0528 に 更新 DeepSeek が deepseek-reasoner を R1-0528 に更新しました。詳しくは出典へ。
DeepSeek API Change Log
2025年4月9日(水)
· 1件Mistral、
RAG 評価の 3 指標を 提供 Mistral が RAG 評価の手法を解説しました。 RAG Triad は文脈関連性・根拠性・回答関連性で評価します。 構造化出力で判定用 LLM の評価を安定させます。
Mistral AI
2025年3月24日(月)
· 1件DeepSeek、
deepseek-chat を V3-0324 に 更新 DeepSeek が deepseek-chat を DeepSeek-V3-0324 に更新しました。詳しくは出典へ。
DeepSeek API Change Log
2025年3月11日(火)
· 1件METR、
可読で 忠実な 推論の 価値を 説明 METR が AI 推論の可読性と忠実性の価値を解説しました。 可読で忠実な推論は AI のミスや欺瞞の検出を容易にします。 OpenAI や Anthropic など 5 社が推論モデルを公開しました。
METR
2025年1月20日(月)
· 1件2024年12月10日(火)
· 1件DeepSeek、
deepseek-chat を 更新 DeepSeek が deepseek-chat を DeepSeek-V2.5-1210 に更新しました。詳しくは出典へ。
DeepSeek API Change Log
2024年6月28日(金)
· 1件DeepSeek、
deepseek-chat を V2-0628 に 更新 DeepSeek が deepseek-chat を DeepSeek-V2-0628 に更新しました。詳しくは出典へ。
DeepSeek API Change Log