TrendScope

Meta、初のリアルタイム音声認識モデル「Muse Voice Transcribe」 20人超の話者識別と多言語混在に対応

情報元:ITmedia AI+ 2026-09-02T04:18:44.000Z

情報元による記事紹介

Metaは、リアルタイム音声認識モデル「Muse Voice Transcribe」を発表した。単一モデルで音声認識、話者分離、発話終了検知を処理し、20人以上の話者識別や日本語を含む多言語に対応する。「Meta Model API」で提供するほか、Mac版「Meta AI」」アプリや「Muse Code」でも利用可能だ。

AIによる記事の要点

情報元の記事をもとに自動生成しています。誤りや省略が含まれる場合があります。詳細は元記事で確認してください。

この記事の要約はまだ用意されていません。元記事で内容をご確認ください。

元記事を読む

編集・出典方針 · ニュースの読み方 · 記事一覧