VoicePulse (Голосовой ввод через Gemini)
Автор:- Исходный код дополнения: Посетить Web-сайт voicepulse
Краткое описание
VoicePulse превращает ваш микрофон в ИИ-машинистку.
Нажмите жест, говорите на одном или сразу нескольких языках — и текст вставится в активное поле с автоматической расстановкой знаков препинания.
Диктовка работает на Gemini (быстрый Live-поток с автоматическим запасным каналом записи).
Требует бесплатный ключ API и не нуждается в особых настройках.
Все особенности дополнения подробно описаны в справочном руководстве.
Основная информация
| Название | Версия | Совместимость с API NVDA | Последняя протестированная версия NVDA | Минимальная версия NVDA | Дата загрузки в каталог | Размер | Лицензия |
|---|---|---|---|---|---|---|---|
| voicepulse | 3.8.3 | 2026.1 | 2026.2 | 2024.3 | 07-09-2026 11:44:53 | 53 Кб. | GPL v2 |
Журнал изменений
Подробнее
3.8.3
- Исправлена критическая ошибка остановки из режима ожидания. Когда сеанс находился в режиме ожидания и ждал кодовое слово («старт» / <
>), а вы останавливали его с помощью сочетания клавиш, не пробуждая предварительно, текст, который вы произнесли в спящий микрофон — разговор или озвучивание синтезатором текста во время его просмотра — добавлялся к диктовке и вводился в редактор (а также сохранялся в историю речи) в момент остановки. Речь, произнесённая во время сна сеанса, никогда не является диктовкой: теперь она полностью игнорируется, включая финальное сообщение, которое распознаватель отправляет при остановке. Только фраза, которая была продиктована непосредственно перед тем, как сеанс перешёл в режим сна, может корректно завершиться, если вы остановите диктовку именно в этот момент — ни одно продиктованное слово не будет потеряно.
Скачать
⬇ Перейти к истории версий 🔝 Назад к оглавлениюИнформация о локализации на русский язык
- Локализация от: Разработчик или другой переводчик
- Перевод: Да
- Перевод интерфейса: Да
- Перевод справки: Да
Разделы
🔝 Назад к оглавлениюСправка
Подробнее
VoicePulse
Голосовой ввод Gemini
Что нового!
Добавлена история речи.
Теперь весь надиктованный текст записывается в историю по типу speech history.
Можем открыть и просмотреть, что мы диктовали?
Для открытия нужно назначить горячие клавиши в жестах ввода.
Для копирования текста можно нажать на тексте Enter, и текст скопируется в буфер.
Можно выделить несколько кусков текста.
Встаём на нужный, нажимаем Ctrl + пробел, синтезатор говорит выделено.
Идём на следующий, также Ctrl + пробел.
Когда всё выделили, нажимаем Enter, всё копируется в буфер.
В истории речи на тексте кнопка delete удаляет текст под курсором.
История автоматически очищается после перезагрузки NVDA.
Теперь дополнение работает и без текстового редактора.
То есть если фокус находится не в текстовом редакторе, вся наша речь записывается в историю.
Можем просто на рабочем столе запустить дополнение, что-то наговорить, и текст запишется в историю.
Можем сохранить всю историю в текстовый файл, Стандартная функция Ctrl+S.
В настройках добавлено два пункта.
выбор микрофона
позволяет выбрать микрофон, с которого мы будем диктовать.
Также.
Печатать текст в редакторе по мере речи (живая диктовка)
Ну, это такая себе функция.
Так и так, приходится нажимать горячую клавишу для запуска и остановки речи.
Модель обрабатывает речь с микрофона и так быстро.
Без этой функции текст практически вставляется моментально.
в режиме Печатать текст в редакторе по мере речи (живая диктовка) Есть следующая фишка.
Запускаем микрофон, диктуем текст.
Молчим несколько секунд, слышим звуковой сигнал.
Микрофон нас не слышит.
Для того, чтобы микрофон нас услышал, нужно сказать слово активатор старт.
Задержка может быть несколько секунд.
После очередного звукового сигнала говорим снова.
Опять по окончанию речи молчим несколько секунд, диктовка уходит в сон.
Говорим опять слово активатор, сигнал, продолжаем диктовать.
и так до бесконечности
Когда текст полностью надиктован, нажимаем сочетание горячих клавиш, которыми запускали этот режим.
На этом всё.
Данное дополнение предназначено для быстрого голосового ввода.
Используется ключ API от Gemini.
Требуется подключение к интернету.
В России из-за санкций требуются обходные пути.
Дополнение простое и не требует сложных настроек.
Получаем ключ API в Google AI Studio. Как его получить, можно найти информацию через поиск в браузере.
После получения ключа открываем настройки NVDA.
В настройках находим это дополнение.
Вводим ключ Нажимаем Ok.
Дальше идём в пункт жесты ввода.
В этом пункте находим ветку этого дополнения, назначаем сочетание клавиш, сохраняем.
Это сочетание клавиш работает как и для запуска, так и для остановки.
Текст автоматически вставляется в текстовый редактор.
При этом не копируется в буфер обмена.
Скорость обработки радует, дополнение отрабатывает шустро.
Для корректной расстановки знаков препинания говорите с паузами, не торопитесь.
На этом всё.
Приятного использования.
История версий
История версий
| Версия файла | Тестируемая версия NVDA | Минимальная версия NVDA | Размер файла (КБ) | Ссылка на загрузку |
|---|---|---|---|---|
| 3.8.3 | 2026.2 | 2024.3 | 53 | VoicePulse-V.3.8.3.nvda-addon |
| 3.6.2 | 2026.2 | 2024.3 | 41 | VoicePulse-V.3.6.2.nvda-addon |
| 3.1.3 | 2026.2 | 2024.3 | 25 | VoicePulse_-V.3.1.3.nvda-addon |
| 3.1.1 | 2026.2 | 2024.3 | 25 | VoicePulse-V.3.1.1.nvda-addon |