AINEWS

Metaが発表したMuse Voice Transcribe:リアルタイム音声認識の新時代

💡 Metaが新たに発表したMuse Voice Transcribeは、リアルタイム音声認識を実現し、多言語対応や話者分離機能を備えています。

Metaが新たに発表したMuse Voice Transcribe

2026年9月1日、Metaは新しい音声認識技術「Muse Voice Transcribe」を発表しました。この技術は、Meta AI for MacやMuse Codeに組み込まれており、すでにディクテーション機能として利用されています。さらに、2026年9月2日には、Muse Voice TranscribeがMeta Model APIを通じても利用可能であることが確認されました。

Muse Voice Transcribeの特徴

Muse Voice Transcribeは、以下のような先進的な機能を備えています:

  • リアルタイムのストリーミング文字起こし:音声を即座にテキストに変換し、スムーズなコミュニケーションをサポートします。
  • 話者分離:複数の話者がいる場合でも、それぞれの発言を識別し、正確に記録します。
  • エンドポイント検出:話の区切りを自動的に認識し、より自然な形での文字起こしを実現します。
  • 多言語対応:異なる言語での音声認識が可能で、国際的な利用にも対応しています。
これらの機能により、Muse Voice Transcribeはビジネスシーンや教育現場など、さまざまな場面での活用が期待されています。

価格と利用方法

Muse Voice TranscribeのAPIは、音声1000分あたり3ドル、1時間あたり0.18ドルという価格設定がされています。この価格は、特にビジネス用途でのコストパフォーマンスを考慮したものとなっており、手軽に導入できることが魅力です。

まとめ

MetaのMuse Voice Transcribeは、リアルタイム音声認識の新たなスタンダードを打ち立てる可能性を秘めています。多機能でありながら、手頃な価格で提供されるこの技術は、今後のコミュニケーションのあり方を大きく変えるかもしれません。

📤 この記事をシェア