本文へ移動
10/7(水) 13:08
あとで読む
出典
モデルGoogle DeepMind一次· 8/27(木)

DeepMind、音声認識 Gemini 3.5 を公開

Google DeepMind
要

AI要約

3行で
  • DeepMind が音声認識モデル Gemini 3.5 Transcribe を公開しました。
  • ストリーミングの単語誤り率は 4.0% です。
  • 最終文字起こしまでの時間は 70% 改善しました。

AI要約です。詳しくは出典へ。誤りを報告

Karunews が選んだ理由音声認識モデルの精度と遅延の改善幅が数字で示されており、音声エージェントや文字起こしの構成を見直す材料になります。

典

出典

1ソース · 一次情報
Google DeepMind一次Intelligent transcription with Gemini 3.5 Transcribedeepmind.google
出典を読む