Meta、リアルタイム音声認識モデル「Muse Voice Transcribe」を発表/最高峰のパフォーマンス、多言語対応で日本語も検証済み
情報元:窓の杜 2026-09-02T04:30:16.000Z
情報元による記事紹介
米Metaは9月1日(現地時間)、 「Muse Voice Transcribe」 を発表した。同社のMeta Superintelligence Labsが手掛ける「Muse Spark」ファミリー初のリアルタイム音声知覚(audio perception)モデルで、流れてくる音声の終わりを待たずに逐次テキストへ変換するストリーミングASR(Automatic Speech Recognition、自動音声認識)に加え、以下の機能を備える。
AIによる記事の要点
情報元の記事をもとに自動生成しています。誤りや省略が含まれる場合があります。詳細は元記事で確認してください。
この記事の要約はまだ用意されていません。元記事で内容をご確認ください。