Metaが新たに発表したMuse Voice Transcribe
2026年9月1日、Metaは新しい音声認識技術「Muse Voice Transcribe」を発表しました。この技術は、Meta AI for MacやMuse Codeに組み込まれており、すでにディクテーション機能として利用されています。さらに、2026年9月2日には、Muse Voice TranscribeがMeta Model APIを通じても利用可能であることが確認されました。
Muse Voice Transcribeの特徴
Muse Voice Transcribeは、以下のような先進的な機能を備えています:
- リアルタイムのストリーミング文字起こし:音声を即座にテキストに変換し、スムーズなコミュニケーションをサポートします。
- 話者分離:複数の話者がいる場合でも、それぞれの発言を識別し、正確に記録します。
- エンドポイント検出:話の区切りを自動的に認識し、より自然な形での文字起こしを実現します。
- 多言語対応:異なる言語での音声認識が可能で、国際的な利用にも対応しています。
価格と利用方法
Muse Voice TranscribeのAPIは、音声1000分あたり3ドル、1時間あたり0.18ドルという価格設定がされています。この価格は、特にビジネス用途でのコストパフォーマンスを考慮したものとなっており、手軽に導入できることが魅力です。
まとめ
MetaのMuse Voice Transcribeは、リアルタイム音声認識の新たなスタンダードを打ち立てる可能性を秘めています。多機能でありながら、手頃な価格で提供されるこの技術は、今後のコミュニケーションのあり方を大きく変えるかもしれません。