Meta випустила модель Muse Voice Transcribe для розпізнавання мовлення в реальному часі
Meta Superintelligence Labs Releases Muse Voice Transcribe: One Real-Time Model for Streaming ASR, Diarization, and Endpointing
Meta Superintelligence Labs представила Muse Voice Transcribe — модель, яка в реальному часі поєднує розпізнавання мовлення, розділення на понад 20 спікерів та визначення завершення репліки в одному проході. Модель доступна лише як хмарний API за 3 долари за 1000 хвилин аудіо, ваги моделі не відкриті. За даними компанії, вона очолює рейтинги Artificial Analysis за точністю та швидкістю розпізнавання серед конкурентів на кшталт Cartesia та ElevenLabs.
Мовою оригіналу · EN
Meta Superintelligence Labs has released Muse Voice Transcribe, a single real-time model combining streaming speech recognition, diarization for 20+ speakers, and endpointing in one pass. It is…
Читати оригінал на MarkTechPost →
Чому в стрічці: Конкретний технічний реліз ШІ-моделі, що відповідає активному інтересу до продуктових новин у сфері AI.