- プロダクト
- ツール・利用法
Metaの「Muse Voice Transcribe」登場、20人超の話者識別と多言語混在に対応
ITmedia AI+

Metaは、20人以上の話者識別と多言語混在に対応する初のリアルタイム音声認識モデル「Muse Voice Transcribe」を発表しました。Meta Model APIを通じて提供され、高精度な文字起こしと話者分離を単一モデルで実現し、ビジネスにおける音声データ活用の可能性を広げます。
この記事は外部メディアの内容を要約したものです。詳細は元記事をご覧ください。
元記事を読む →