SonataNeuralVoices (Нейронные голоса Sonata)
Авторы:- Исходный код дополнения: Посетить Web-сайт sonata_neural_voices
Краткое описание
Дополнение SonataNeuralVoices добавляет в NVDA нейронные голоса синтеза речи на основе движка Piper.
Все вычисления выполняются локально на вашем компьютере без подключения к интернету.
Дополнение поставляется без встроенных голосов, их необходимо загрузить через менеджер голосов.
Менеджер голосов позволяет предварительно прослушивать голоса перед загрузкой.
Вы можете выбрать стандартный или быстрый вариант голоса для каждого языка.
Голоса доступны в трёх вариантах качества: low, medium и high.
Более низкое качество обеспечивает лучшую отзывчивость и скорость работы.
После установки голоса появляются в настройках речи NVDA для выбора.
В настройках доступны параметры выбора голоса, варианта и диктора.
Для голосов с несколькими дикторами можно выбрать конкретного диктора.
Дополнительные параметры позволяют точно настроить звучание каждого голоса.
Коэффициент длины управляет длительностью произнесения звуков.
Коэффициент шума влияет на выразительность и вариативность интонаций.
Параметр Noise w регулирует ритмичность и естественность речи.
Все параметры легко возвращаются к значениям по умолчанию.
Дополнение поддерживает установку голосов из локальных архивов.
Вы можете удалять ненужные голоса и управлять установленными.
Все особенности дополнения описаны в справочном руководстве.
Основная информация
| Название | Версия | Совместимость с API NVDA | Последняя протестированная версия NVDA | Минимальная версия NVDA | Дата загрузки в каталог | Размер | Лицензия |
|---|---|---|---|---|---|---|---|
| sonata_neural_voices | 3.2.1 | 2026.1 | 2026.1 | 2025.1 | 01-08-2026 18:37:05 | 16886 Кб. | GPL v2 |
Журнал изменений
Подробнее
Исправлена проблема с потерей звука NVDA после перезагрузки профилей конфигурации (двойное нажатие NVDA+Control+R). Общий фоновый цикл обработки событий больше не завершается при завершении экземпляра синтезатора, а его запуск и остановка теперь потокобезопасны.
Скачать
SonataNeuralVoices-V.3.2.1.nvda-addon
⬇ Перейти к истории версий 🔝 Назад к оглавлениюИнформация о локализации на русский язык
🔝 Назад к оглавлениюРазделы
🔝 Назад к оглавлениюСправка
Подробнее
Sonata нейронные голоса для NVDA
Уведомление о поддерживаемой ветке
Оригинальный автор, Musharraf Omer (@mush42), объявил в списке рассылки NVDA Add-ons, что конфликты с коммерческими контрактами не позволяют ему продолжать поддержку этого дополнения с открытым исходным кодом. Эта ветка продолжает проект, чтобы дополнение работало в актуальных версиях NVDA, и включает обновления совместимости, а также исправления ошибок в менеджере голосов и драйвере синтезатора. Вся заслуга за оригинальную работу принадлежит Musharraf Omer.
Это дополнение добавляет нейронные голоса синтеза речи в NVDA. Оно предоставляет драйвер синтезатора для голосовых моделей Piper, которые работают полностью на вашем компьютере, а также менеджер голосов для загрузки и установки голосов. Для загрузки голосов требуется подключение к интернету, но для их воспроизведения оно не нужно.
Piper — это быстрая, локальная нейронная система синтеза речи, которая звучит отлично и оптимизирована для маломощных устройств, таких как Raspberry Pi. Вы можете послушать образцы голосов на странице Piper voice samples. Речь генерируется движком Sonata — кроссплатформенным движком на Rust для нейронных моделей TTS, разработанным Musharraf Omer.
Требования
- NVDA 2025.1 или новее (протестировано до версии 2026.1).
- Распространяемый пакет Microsoft Visual C++ 2015-2022 (x64). Движок синтеза речи, входящий в дополнение, собран с помощью MSVC и не может запуститься без него. Если он отсутствует, дополнение покажет сообщение со ссылкой для загрузки; установите его и перезапустите NVDA. На большинстве компьютеров с Windows он уже установлен.
Установка
Загрузка дополнения
Вы можете найти пакет дополнения в разделе Assets на странице релизов.
Добавление голосов
Дополнение является только драйвером и по умолчанию не содержит голосов. Вам необходимо загрузить и установить нужные голоса через менеджер голосов.
После установки дополнения и перезапуска NVDA дополнение предложит загрузить и установить хотя бы один голос, а также предоставит возможность открыть менеджер голосов.
Вы также можете открыть менеджер голосов из главного меню NVDA.
Обратите внимание, что мы рекомендуем выбирать голоса качества low или medium для ваших целевых языков, так как они обычно обеспечивают лучшую отзывчивость. Для дополнительной отзывчивости вы можете выбрать загрузку варианта fast для голоса, но это может немного снизить качество речи.
Вы также можете устанавливать голоса из локальных архивов. Получив файл голоса, откройте менеджер голосов, перейдите на вкладку «Установленные» и нажмите кнопку «Установить из локального файла». Выберите файл голоса и дождитесь его установки.
Использование менеджера голосов
Откройте менеджер голосов из главного меню NVDA, выбрав пункт «Менеджер голосов Sonata...». Он содержит две вкладки: «Загрузка» и «Установленные».
Вкладка «Загрузка»
Выберите язык из раскрывающегося списка «Язык», чтобы отфильтровать список «Доступные голоса», затем выберите голос для работы с ним.
- «Прослушать» воспроизводит короткий образец выбранного голоса, чтобы вы могли его услышать перед загрузкой. Образец транслируется из интернета, и ничего не устанавливается. Во время воспроизведения эта же кнопка становится кнопкой «Остановить прослушивание».
- «Диктор» рядом с кнопкой просмотра доступен только для голосов, обученных с несколькими дикторами. Он позволяет выбрать, какой диктор используется для предпросмотра.
- «Загрузить стандартный вариант» и «Загрузить быстрый вариант» загружают голос. Каждая кнопка отключена, когда соответствующий вариант уже установлен, а кнопка быстрого варианта также отключена для голосов, у которых нет быстрого варианта.
- «Обновить список голосов» загружает каталог заново, вместо использования копии, сохранённой в кэше для этой сессии.
Вкладка «Установленные»
Список «Установленные голоса» показывает каждый установленный голос с его вариантом, качеством и языком.
- «Карточка модели голоса...» отображает файл
MODEL_CARD, поставляемый с голосом, в котором указано, откуда взяты данные для обучения и как он лицензирован. Не каждый голос включает такой файл. - «Удалить голос...» удаляет выбранный голос после запроса подтверждения. Кнопка остаётся неактивной, если у вас не установлено как минимум два голоса, и не позволит удалить голос, который используется в данный момент.
- «Установить из локального файла» устанавливает голос из архива
.tar.gzили.tgz, который у вас уже есть.
После установки из локального архива или удаления голоса дополнение автоматически перезагружает синтезатор, поэтому изменения применяются немедленно. После загрузки новый голос сразу появляется в менеджере голосов; если список голосов NVDA не обновился, перезапустите NVDA.
Настройки голоса
Когда в качестве синтезатора выбран «Нейронные голоса Sonata», в настройках речи NVDA (меню NVDA > Параметры > Настройки > Речь) появляются следующие параметры.
«Голос» отображает установленные голоса в формате «имя (язык) — качество».
«Вариант» переключает между стандартной и быстрой сборкой текущего голоса. Отображаются только те варианты, которые у вас действительно установлены.
«Диктор» применяется к голосам, обученным с несколькими дикторами; для голосов с одним диктором он не действует. Этот параметр также доступен в кольце настроек синтезатора.
«Скорость», «Громкость» и «Высота тона» работают так же, как и для любого синтезатора NVDA. Когда параметр «Ускорение темпа» выключен, ползунок скорости покрывает только нижнюю часть диапазона скоростей движка; его включение расширяет ползунок на весь диапазон, что позволяет достичь гораздо более быстрой речи.
Точная настройка звучания голоса
«Коэффициент длины», «Коэффициент шума» и «Noise w» предоставляют доступ к собственным параметрам вывода модели Piper. Все три работают одинаково: ползунок имеет диапазон от 0 до 100, а значение 50 означает значение по умолчанию, заданное для голоса при обучении, поэтому возврат ползунка на 50 отменяет ваши изменения. Из этих трёх параметров только «Коэффициент длины» доступен в кольце настроек синтезатора.
- «Коэффициент длины» определяет, как долго произносится каждый звук речи. Более высокие значения растягивают речь, более низкие — сжимают. Это отдельный механизм от «Скорости», и они действуют вместе, поэтому обычно проще всего настроить скорость с помощью «Скорости» и прибегать к этому параметру только если естественный темп голоса вас не устраивает.
- «Коэффициент шума» определяет, насколько сильно модель варьирует тон и интонацию. Более высокие значения звучат более выразительно, но менее предсказуемо.
- «Noise w» определяет, насколько варьируется длительность отдельных звуков речи, что воспринимается как ритм. Более высокие значения звучат менее механически, но могут размывать артикуляцию.
Выше 50 ползунки масштабируются до удвоенного значения по умолчанию для «Коэффициента длины» и до трёхкратного значения по умолчанию для «Коэффициента шума» и «Noise w». Поскольку значение 50 всегда означает «значение по умолчанию для этого голоса», определённое положение ползунка сохраняет своё значение при переключении на другой голос.
Замечание о качестве голосов
Доступные в настоящее время голоса обучены с использованием свободно доступных наборов данных TTS, которые обычно имеют низкое качество (в основном аудиокниги из общественного достояния или записи исследовательского качества).
Кроме того, эти наборы данных не являются всеобъемлющими, поэтому некоторые голоса могут демонстрировать неправильное или странное произношение. Обе проблемы могут быть решены путём использования более качественных наборов данных для обучения.
К счастью, разработчик Piper и некоторые разработчики из сообщества слепых и слабовидящих работают над созданием голосов лучшего качества.
Устранение неполадок
Sonata отсутствует в списке синтезаторов NVDA или не загружается. Две основные причины — отсутствие распространяемого пакета Visual C++, описанное в разделе «Требования» выше, и отсутствие установленных голосов — драйвер сознательно отказывается загружаться, если не находит хотя бы один голос. Откройте менеджер голосов из главного меню NVDA, установите голос и перезапустите NVDA.
Только что загруженный голос не отображается в списке голосов NVDA. Перезапустите NVDA. Загрузка обновляет собственный список менеджера голосов, но NVDA всё ещё может использовать набор голосов, загруженный при запуске.
Предпросмотр или список голосов завершается ошибкой подключения. Оба запроса выполняются через интернет. Проверьте своё подключение, затем используйте «Обновить список голосов» на вкладке «Загрузка», чтобы повторить попытку.
«Вы не можете удалить активный голос!» Переключите NVDA на другой голос или другой синтезатор, а затем удалите его.
Речь запускается медленно или заикается. Используйте голоса качества low или medium, а также рассмотрите вариант fast для вашего голоса. Модели более высокого качества требуют заметно больше времени на обработку каждой фразы.
Сообщение о проблемах
Для любых других проблем журнал NVDA обычно сообщает, что пошло не так: меню NVDA > Сервис > Просмотр журнала.
Пожалуйста, сообщайте об ошибках и запросах на новые функции в системе отслеживания проблем этой ветки и прилагайте журнал вместе с версией NVDA и голосом, который вы использовали.
Лицензия
Авторские права © 2024, Musharraf Omer. Авторские права © 2026, Ali Ustek и участники этой ветки. Это программное обеспечение распространяется под лицензией GNU GENERAL PUBLIC LICENSE Version 2 (GPL v2).
История версий
История версий
| Версия файла | Тестируемая версия NVDA | Минимальная версия NVDA | Размер файла (КБ) | Ссылка на загрузку |
|---|---|---|---|---|
| 3.2.1 | 2026.1 | 2025.1 | 16886 | SonataNeuralVoices-V.3.2.1.nvda-addon |
| 3.2.0 | 2026.1 | 2025.1 | 16832 | SonataNeuralVoices-V.3.2.0.nvda-addon |
| 3.1 | 2025.1 | 2025.1 | 15135 | SonataNeuralVoices-V.3.1.nvda-addon |
| 3.0-beta.3 | 2024.1 | 2024.1 | 15123 | SonataNeuralVoices-V.3.0-beta.3.nvda-addon |
| 3.0-beta.2 | 2024.1 | 2024.1 | 15122 | SonataNeuralVoices-V.3.0-beta.2.nvda-addon |
| 3.0-beta.1 | 2024.1 | 2024.1 | 15390 | SonataNeuralVoices-V.3.0-beta.1.nvda-addon |
| 3.0 | 2024.3 | 2024.1 | 15123 | SonataNeuralVoices-V.3.0.nvda-addon |