DeepMind、 音声認識 Gemini 3.5 を 公開
要
AI要約
3行で- DeepMind が音声認識モデル Gemini 3.5 Transcribe を公開しました。
- ストリーミングの単語誤り率は 4.0% です。
- 最終文字起こしまでの時間は 70% 改善しました。
AI要約です。詳しくは出典へ。誤りを報告
Karunews が選んだ理由音声認識モデルの精度と遅延の改善幅が数字で示されており、音声エージェントや文字起こしの構成を見直す材料になります。
典