M**a представила ИИ-модель для расшифровки речи Muse Voice Transcribe
Компания M**a выпустила первую собственную ИИ-модель для обработки аудио в реальном времени.
Компания M**a выпустила Muse Voice Transcribe — первую собственную ИИ-модель для расшифровки речи. Она анализирует аудиопоток без задержек и поддерживает более 20 голосов в одном сеансе.
Система работает с несколькими языками одновременно. Это позволяет использовать её в международных переговорах или мультиязычных конференциях без ручного переключения между языками.
Muse Voice Transcribe не требует предварительной загрузки аудиофайлов. Модель обрабатывает речь прямо во время разговора и выводит текст в реальном времени.
Технология пока не раскрывает точный список поддерживаемых языков и уровень точности. Разработчики обещают адаптировать модель для нишевых диалектов и акцентов в будущих обновлениях.
Первые тесты показывают, что Muse Voice Transcribe справляется с фоновым шумом и перекрывающейся речью. Но в сложных акустических условиях возможны ошибки.
M**a не уточняет, будет ли модель доступна как отдельный сервис или войдёт в состав других продуктов компании. Релиз запланирован на ближайшие месяцы.