Microsoft、低遅延のストリーミング文字起こしと多言語音声合成モデルを公開

ITmedia AI+

Microsoft AIが、低遅延のストリーミング文字起こしと多言語音声合成の新モデルを公開しました。これらのモデルは、人と音声で自然に対話する次世代の音声エージェント構築を加速させることが期待されます。

この記事は外部メディアの内容を要約したものです。詳細は元記事をご覧ください。

元記事を読む →
Microsoft、低遅延のストリーミング文字起こしと多言語音声合成モデルを公開 | プロナビAI