Gradium AI випустила нову TTS-модель за замовчуванням із точністю 81% і затримкою 216 мс
Gradium AI Releases New Default TTS Model: 81.0% Hard-Case Pass Rate at 216 ms Time-to-First-Audio
Компанія Gradium AI зробила нову модель синтезу мовлення дефолтною у своєму API та Studio, повідомляє MarkTechPost. За даними компанії, модель показує 81,0% точності розпізнавання складних елементів (номери, е-мейли, дати) на 500 тестових реченнях п'ятьма мовами, випереджаючи Cartesia Sonic 3.6 (75,1%) та ElevenLabs v3 (65,4%). Час до першого звуку становить 216 мс, що на 170 мс швидше за попередню модель. Оновлення застосовується автоматично, без міграції для наявних користувачів.
Мовою оригіналу · EN
Gradium AI made its new text-to-speech model the default across its API and Studio, reporting an 81.0% human-rated pass rate on a 500-sentence hard-case set in five languages, ahead of Cartesia Sonic…
Читати оригінал на MarkTechPost →
Чому в стрічці: Конкретне оновлення AI-продукту (нова модель, бенчмарки) — саме такий формат, який користувач раніше відкривав через MarkTechPost.