Meta、リアルタイム音声モデル「Muse Voice Transcribe」公開 20人超の話者分離と日本語対応
Metaは2026年9月1日(現地時間)、Meta Superintelligence Labs(MSL)初のリアルタイム音声知覚モデル「Muse Voice Transcribe」を発表した。ストリーミング音声認識に加え、話者分離と発話終了検出を単一モデルで処理し、同日から提供を始めた。
本ページでは「話者識別」をテーマとした記事を一覧で掲載しています。
Metaは2026年9月1日(現地時間)、Meta Superintelligence Labs(MSL)初のリアルタイム音声知覚モデル「Muse Voice Transcribe」を発表した。ストリーミング音声認識に加え、話者分離と発話終了検出を単一モデルで処理し、同日から提供を始めた。