Apple、 録音の 定義を 巡り議論
Apple が映像を保存しないスマートホームカメラを開発中です。 AI が映像をテキストに変換し、顔認識も支える見通しです。 Google も録画しないスマートグラスを検討しています。
Apple が映像を保存しないスマートホームカメラを開発中です。 AI が映像をテキストに変換し、顔認識も支える見通しです。 Google も録画しないスマートグラスを検討しています。
Claude Opus 5.5 でゲーム音楽の作曲を試みました。 テキスト形式の音楽データと再生用 artifact を生成します。 Monkey Island 風の曲が予想外に高品質でした。
Mollick 氏は既存モデルの能力が未活用だと指摘しました。 GPT-6 Astra は Zork を 3D ゲームに作り替えました。
ABEJA が手の動きを 3D 復元するモデルを自作しました。 手の形の誤差は 17〜19mm、手首の位置は 80〜95mm です。 出力はロボット学習用の LeRobotDataset v3.0 です。
Sentence Transformers v6.0 が MultiVectorEncoder を追加しました。詳しくは出典へ。
ABEJA がセンサー×LLM の異常検知を方式別に比較しました。 NAB のセンサー 6 種で検証し、gemini-3.5-flash を使用しました。 プロンプト直接入力は検出が疎で誤検知率が低い結果です。
LINE ヤフー社員が Google I/O 2026 に初参加しました。 Intelligent Eyewear は Gemini と連携するオーディオグラスです。 Gemma 4 はライセンスが Apache 2.0 に変更されました。
ABEJA がエッジ環境の VLM による構造化出力を検証しました。 Grammar 制約で JSON 形式を強制し、出力崩れを防ぎます。 Visual Prompt Injection への出力層の防御にもなります。
Ethan Mollick 氏が AI 能力のギザギザを解説しました。 記憶や視覚など伸びない弱点がボトルネックになります。
ストックマークなど 4 社が LT イベントを開催しました。 Algomatic は画像を 3D 風へ変換する手法を紹介しました。 サイバーエージェントは漫画を自動ローカライズします。
レイアウト解析は物体検出をベースに要素を検出します。 PubLayNet は約 36 万枚の文書画像を持つデータセットです。