#画像生成
今日 1件10月7日(水)
· 1件10月2日(金)
· 3件Meta の
AI モデル、 支援ロボットを 変革 Meta の AI モデルがピッツバーグ大の支援ロボットを変革します。 DINOv3 と SAM を端末上で動かし、周囲を認識します。 RAMMP は RF-DETR と DINOv2 で 360 度の物体検出を実現します。
Meta AI Blog
9月30日(水)
· 1件Google Research、
Diffusion Controller を 発表 Google Research が Diffusion Controller を発表しました。詳しくは出典へ。
Google Research
9月29日(火)
· 1件SageMaker AI、
vLLM-Omni で 画像生成 SageMaker AI 上で vLLM-Omni を使い画像と動画を生成します。 FLUX.2-klein-4B が画像、Wan2.1-VACE-1.3B が動画を担当します。 画像はリアルタイム、動画は非同期エンドポイントで処理します。
AWS Machine Learning Blog
9月23日(水)
· 1件9月18日(金)
· 2件Google、
Flow で デザイナー支援ツール Google が Flow でデザイナー向けツールを開発しました。 Jane Wade の Styling Suite はデジタルモデルで検証します。 Sergio Hudson の Runway Visualization は会場と照明を検証します。
Google · AI(blog.google)Apple AI、
ステアリング手法 DSAS を 公開 Apple AI が活性化ステアリング手法 DSAS を公開しました。 不要な介入を抑え、有害性低減と性能維持の両立を改善します。 テキスト生成と画像拡散モデルの両方に適用できます。
Apple Machine Learning Research
9月10日(木)
· 2件Google DeepMind、
記憶を AI で 映像化 Google DeepMind が短編映画で夫妻の記憶を AI 再現しました。 未記録の出会いの日を写真復元と演技捕捉で映像化しました。 Gemini アプリで古い写真の復元と着色ができます。
Google · AI(blog.google)
9月8日(火)
· 1件9月2日(水)
· 1件8月25日(火)
· 1件Google、
東京藝術大学と AI 創作を 支援 Google が東京藝術大学と AI 創作プログラムを実施しました。 学生が Gemini や Veo、Lyria を使い作品を制作しました。 学長賞や Google 賞などが選出されました。
Google Japan Blog
7月27日(月)
· 1件CyberAgent AI Lab、
ECCV 2026 に 2 本採択 CyberAgent AI Lab の論文 2 本が ECCV 2026 に採択されました。 バンドル調整を安定化する新手法 CSS-BA を提案しました。 拡散モデル向けにリーマン計量を構築する手法を提案しました。
CyberAgent AI Lab
7月23日(木)
· 1件Hugging Face、
Nunchaku Lite を 統合 Hugging Face が Nunchaku Lite を Diffusers に統合しました。詳しくは出典へ。
Hugging Face Blog
7月22日(水)
· 1件LINE ヤフー、
8月の 技術イベント公開 LINE ヤフーが 8月の技術イベント予定を公開しました。 MIRU2026 に協賛します。 イベントは主催と協賛を含みます。
LINEヤフー Tech Blog
7月16日(木)
· 1件Google、
拡散モデルの 創造性を 解明 Google が拡散モデルの創造性の仕組みを解明しました。 創造性は学習時のスコア平滑化に由来します。 スコア平滑化が学習点間の補間を生み出します。
Google Research
7月7日(火)
· 1件Hugging Face、
PRX の データ戦略を 解説 Hugging Face が PRX のデータ戦略を解説しました。 事前学習は公開・社内データを混ぜ多様性を優先します。 画像は JPEG 品質 92 で再エンコードし容量を削減します。
Hugging Face Blog
7月1日(水)
· 1件6月30日(火)
· 1件6月15日(月)
· 1件Google、
Imagen 4 など 画像モデルを 終了 Google が Imagen 4 など画像生成モデルを終了します。 対象は imagen-4.0 系の 3 モデルで、8月17日に停止します。 Veo 2.0 と Veo 3.0 系も 6月30日に停止します。
Gemini API Changelog
5月28日(木)
· 1件4月23日(木)
· 1件3月18日(水)
· 1件2月26日(木)
· 1件1月10日(土)
· 1件Berkeley、
画像設計の 情報指標を 発表 Berkeley が画像システムの情報量評価手法を発表しました。 相互情報量で解像度やノイズをまとめて評価します。 色写真や電波天文など 4 領域で有効性を確認しました。
Berkeley AI Research
2025年8月1日(金)
· 1件Mistral、
Pixtral-12B を 衛星画像で 調整 Mistral が Pixtral-12B を衛星画像で調整しました。 LoRA でモデル全体を再学習せず効率的に適応できます。 AID の分類で基本モデルを上回る精度を達成しました。
Mistral AI
2025年7月17日(木)
· 1件2025年5月13日(火)
· 1件4 社共催、
マルチモーダル LT を 開催 ストックマークなど 4 社が LT イベントを開催しました。 Algomatic は画像を 3D 風へ変換する手法を紹介しました。 サイバーエージェントは漫画を自動ローカライズします。
Stockmark Tech Blog