#マルチモーダル
今日 7件10月7日(水)
· 7件Apple、
録音の 定義を 巡り議論 Apple が映像を保存しないスマートホームカメラを開発中です。 AI が映像をテキストに変換し、顔認識も支える見通しです。 Google も録画しないスマートグラスを検討しています。
The Verge · AIClaude Opus 5.5、
ゲーム音楽を 生成 Claude Opus 5.5 でゲーム音楽の作曲を試みました。 テキスト形式の音楽データと再生用 artifact を生成します。 Monkey Island 風の曲が予想外に高品質でした。
Simon Willison
10月6日(火)
· 5件Pinterest、
美容 Pins を 行動計画に 変換 Pinterest が美容 Pins を行動計画に変換する機能を公開しました。 所要時間や価格帯、メンテナンス頻度も示します。
TechCrunch · AI
10月5日(月)
· 2件NVIDIA、
乳がん診療の AI 活用を 紹介 NVIDIA が乳がん診療を支える AI 活用を紹介しました。 iSono Health の ATUSA は 3D 超音波を約 2分で撮影します。
NVIDIA Blog
10月3日(土)
· 3件10月2日(金)
· 6件Google、
Gemini Live に Guided Vision を 追加 Google が Gemini Live に Guided Vision を追加しました。詳しくは出典へ。
The Verge · AI
10月1日(木)
· 4件9月30日(水)
· 2件Condé Nast、
動画検索を AI で 高速化 Condé Nast が動画検索を AI で高速化しました。 検索時間は 250分から 2分未満に短縮されます。 Amazon Bedrock と TwelveLabs Marengo を使います。
AWS Machine Learning Blog
9月29日(火)
· 1件Microsoft、
生物学向け AI 研究基盤 Quine を 発表 Microsoft Research が生物学向け AI 研究基盤 Quine を発表しました。詳しくは出典へ。
Microsoft Research
9月25日(金)
· 2件DeepMind、
Gemini 3.8 Live を 発表 DeepMind が Gemini 3.8 Live with Live Avatar を発表しました。詳しくは出典へ。
Google DeepMind
9月24日(木)
· 3件Google Beam、
6 か国に 新たに 展開 Google Beam が 6 か国に展開します。 10月から Industrious の拠点で体験できます。
Google · AI(blog.google)
9月23日(水)
· 1件NVIDIA、
東南アジアで AI 導入を 加速 NVIDIA が東南アジアで AI 導入を加速します。 シンガポール HTX は Nemotron 3 Super を研究に使用します。 iApp Technology は Nemotron 3 Nano をタイ語で調整します。
NVIDIA Blog
9月22日(火)
· 1件9月19日(土)
· 1件AI の
能力過剰、 Mollick 氏が 指摘 Mollick 氏は既存モデルの能力が未活用だと指摘しました。 GPT-6 Astra は Zork を 3D ゲームに作り替えました。
One Useful Thing(Ethan Mollick)
9月17日(木)
· 1件Anthropic、
Claude Cowork を Chat に 統合 Anthropic が Claude Cowork を Claude Chat に統合しました。 接続アプリやスキル、コンテキストを通常のチャットで利用できます。 ノート PC を閉じても作業を続けられます。
Ben's Bites