本文へ移動
10/7(水) 11:08
あとで読む
出典
モデルThe Decoder· 10/2(金)

Microsoft、音声向けモデルを公開

The DecoderMaximilian Schreinerこの話題 3ソース →
要

AI要約

3行で
  • Microsoft が音声エージェント向けモデルを公開しました。
  • 文字起こしは 60 言語に対応し、初回結果は約 100 ミリ秒です。
  • 音声合成は 23 言語を同一の声で話せます。

AI要約です。詳しくは出典へ。誤りを報告

Karunews が選んだ理由音声エージェント向けに文字起こしと音声合成の新モデルが揃い、遅延や料金の具体値から実運用への影響を判断できます。

典

出典

3ソース
The DecoderMicrosoft AI releases new transcription and text-to-speech models for voice agentsthe-decoder.com
出典を読む
この話題を見る