Перейти к основному содержимому Главная страница каталога дополнений для NVDA от русскоязычного сообщества NVDA.RU.

Официальный русскоязычный каталог дополнений NVDA

Крупнейший каталог дополнений для программы экранного доступа NVDA, доступный в Интернете

Каталог дополнений от «🇷🇺 Русскоязычного сообщества NVDA.RU.»

AiVoiceDictation (Голосовая диктовка с использованием ИИ)

Автор:

Краткое описание

AI voice dictation — это комплексный, универсальный голосовой инструмент для NVDA на базе Google Gemini, который превращает вашу речь в отточенный текст и повышает повседневную производительность.
• Диктуйте естественно в любое поле редактирования, используя микрофон и Google Gemini.
• Транскрибируйте аудиофайлы прямо из Проводника.
• Улучшайте текст в буфере обмена с проверкой орфографии и грамматики.
• Обогащайте свои тексты уместным оформлением эмодзи.
• Мгновенно переводите более чем на 100 языков.
Единая многоуровневая система команд NVDA+Alt+Space делает весь инструментарий доступным под рукой.
Несколько ключей API Gemini автоматически чередуются, когда один из них исчерпан.
Диктовку можно приостановить и возобновить, не теряя место.
Любую выполняющуюся операцию можно отменить одним нажатием клавиши.
Текущий статус всегда доступен одним нажатием.
Последнюю запись диктовки можно запустить повторно, если сеть или API прервали её.
Все особенности дополнения подробно описаны в справочном руководстве.

⬇ Перейти к подробной справке 🔝 Назад к оглавлению

Основная информация

Название Версия Совместимость с API NVDA Последняя протестированная версия NVDA Минимальная версия NVDA Дата загрузки в каталог Размер Лицензия
aivoicedictation 2026.1 2026.1 2026.1.0 2026.1.0 12-09-2026 07:21:20 55 Кб. GPL v2
🔝 Назад к оглавлению

Журнал изменений

Подробнее

Первоначальный выпуск.
Все особенности описаны в справке.

🔝 Назад к оглавлению

Скачать

AiVoiceDictation-V.2026.1.nvda-addon

⬇ Перейти к истории версий 🔝 Назад к оглавлению

Информация о локализации на русский язык

🔝 Назад к оглавлению

Разделы

🔝 Назад к оглавлению

Справка

Подробнее

AI voice dictation (Голосовая диктовка с использованием ИИ)

AI voice dictation — это комплексный, универсальный голосовой инструмент для NVDA, работающий на базе Google Gemini, который превращает вашу речь в отточенный текст и повышает повседневную производительность. Диктуйте естественно в любое поле редактирования, транскрибируйте аудиофайлы прямо из Проводника, улучшайте текст в буфере обмена с профессиональной проверкой орфографии и грамматики, обогащайте свои тексты уместным оформлением эмодзи и мгновенно переводите более чем на 100 языков.

Каждая функция создана с упором на доступность и эффективность: единая многоуровневая система команд (NVDA+Alt+Space) делает весь инструментарий доступным под рукой, несколько ключей API Gemini автоматически чередуются, когда один из них исчерпан, диктовку можно приостановить и возобновить, не теряя место, любую выполняющуюся операцию можно отменить одним нажатием клавиши, текущий статус всегда доступен одним нажатием, а последнюю запись диктовки можно запустить повторно, если сеть или API прервали её. Пишете ли вы документы, составляете сообщения, работаете с аудиозаписями или общаетесь на разных языках — AI voice dictation станет вашим голосовым помощником для повышения производительности, созданным и поддерживаемым в Непале.

Возможности

Требования

Начало работы

  1. Установите дополнение и перезапустите NVDA.
  2. Откройте «NVDA» > «Параметры» > «Настройки» и выберите категорию Голосовая диктовка с использованием ИИ.
  3. Вставьте ваш(и) ключ(и) API Gemini в поле Ключи API Gemini (разделяются запятой). Несколько ключей разделяются запятой, например: AIza...1111, AIza...2222.
  4. Выберите модель диктовки из комбинированного списка Выберите модель диктовки:. В списке перечислены последние модели Gemini общего назначения (например, Gemini 3.7 Flash, Gemini 3.6 Flash, Gemini 3.5 Flash, Gemini 3.5 Flash Lite, Gemini 2.5 Pro и другие). Чтобы получить точный, актуальный список моделей, доступных для ваших ключей API, нажмите кнопку Получить модели рядом с комбинированным списком — список заполнится моделями, которые сообщает API Gemini, а полученный список будет сохранён.
  5. При необходимости выберите целевой язык и включите перевод / AI-обработку / форматирование эмодзи.
  6. Нажмите «OK».

Команды

Дополнение добавляет одну команду в диалог NVDA «Жесты ввода» в категории AI voice dictation:

Нажатие NVDA+Alt+Space заставляет NVDA произнести «Вход в режим команд AI voice dictation». Следующее одиночное нажатие клавиши затем интерпретируется как команда:

Клавиша Действие
d Диктовка. Если вы не находитесь в поле редактирования, NVDA произносит «Пожалуйста, перейдите в любое поле редактирования для диктовки», и ничего не записывается. Если вы находитесь в поле редактирования, запись начинается немедленно («Слушаю...»). Нажмите NVDA+Alt+Space, а затем d снова, чтобы остановить запись и обработать диктовку. Распознанный текст вставляется непосредственно в текущее поле редактирования, а также помещается в буфер обмена, чтобы вы могли вставить его в другое место с помощью Ctrl+V.
b Транскрибировать аудиофайл. Установите фокус на файл (WAV, MP3, M4A, OGG, FLAC, AAC и т. д.) в Проводнике и нажмите NVDA+Alt+Space, а затем b. NVDA произносит «Транскрибирование аудио...» и по завершении открывает окно только для чтения с заголовком «Транскрибированный текст», содержащее транскрипцию. Используйте кнопку «Копировать» (или Alt+C), чтобы скопировать текст в буфер обмена (NVDA произносит «Транскрипция скопирована в буфер обмена.»), и кнопку «Закрыть» или Escape (или кнопку закрытия окна), чтобы закрыть окно. Если фокус не на файле в Проводнике, NVDA произносит «Пожалуйста, установите фокус на любой аудиофайл в Проводнике и попробуйте ещё раз.». Если файл выбран, но он не является поддерживаемым типом аудио, NVDA произносит «Файл не поддерживается.» и ничего не загружается.
a Улучшить текст в буфере обмена (орфография и грамматика). Улучшенный текст копируется обратно в буфер обмена.
e Отформатировать текст в буфере обмена с помощью эмодзи. Результат копируется обратно в буфер обмена.
t Перевести текст из буфера обмена на язык, выбранный в настройках. Перевод копируется обратно в буфер обмена.
c Отменить текущую выполняющуюся операцию. NVDA объявляет отменённую задачу (например, «Диктовка отменено.», «Транскрипция отменено.», «Улучшение отменено.», «Перевод отменено.», «Форматирование эмодзи отменено.»). Отмена диктовки удаляет временное аудио, поэтому диктовку нужно начинать заново с самого начала. Если ничего не выполняется, NVDA произносит «Нет задачи для отмены.»
p Приостановить или возобновить диктовку. Пока идёт запись диктовки, нажатие p произносит «Диктовка приостановлена.», и микрофон останавливается (во время паузы ничего не записывается). Повторное нажатие p произносит «Диктовка возобновлена.», и запись продолжается; аудио после возобновления добавляется к части, записанной до паузы, и всё это транскрибируется вместе по завершении диктовки. Если диктовка не запущена, NVDA произносит «Диктовка не запущена.»
Enter Повторно продиктовать последнюю диктовку. Каждая завершённая запись диктовки сохраняется, поэтому если диктовка не удалась (например, из-за проблемы с сетью или исчерпанного ключа API), нажатие NVDA+Alt+Space, а затем Enter снова отправляет сохранённую запись через конвейер диктовки — не нужно диктовать заново. Повторно продиктованный текст вставляется в поле редактирования и обрабатывается в соответствии с флажками настроек, как и обычная диктовка. Вы должны находиться в поле редактирования: иначе NVDA немедленно произносит «Пожалуйста, перейдите в любое поле редактирования для диктовки», и ничего не отправляется в API. Если диктовка ещё не была записана, NVDA произносит «Диктовка не найдена.»
u Объявить текущий статус. Во время записи NVDA произносит «Диктовка...»; во время паузы — «Диктовка приостановлена.»; пока операция обрабатывается (диктовка, транскрипция, улучшение, форматирование эмодзи или перевод), объявляется соответствующий статус (например, «Транскрибирование...», «Улучшение...»); в противном случае — «Никакая операция не выполняется.»
i Открыть диалог настроек NVDA в категории Голосовая диктовка с использованием ИИ, готовый к изменению ключей API, модели, языка и параметров обработки. Если диалог настроек уже открыт, фокус переводится на него.
h Открыть окно Справка AI voice dictation со списком всех команд. Окно имеет кнопки «Копировать» (или Alt+C) и «Закрыть», точно как окно «Транскрибированный текст».
любая другая клавиша NVDA произносит «Не команда AI voice dictation, попробуйте ещё раз.»

Настройки

Доступны в «NVDA» > «Параметры» > «Настройки» > «Голосовая диктовка с использованием ИИ»:

Мы приветствуем вклад

Мы тепло приветствуем вклад от всех, будь то исправление ошибки, добавление новой функции, улучшение документации или помощь с переводами. Каждый вклад — каким бы малым он ни был — помогает сделать AI voice dictation лучше для всего сообщества.

Если вы столкнётесь с какой-либо проблемой при использовании дополнения, пожалуйста, сообщите о ней, открыв issue в GitHub-репозитории проекта. Укажите как можно больше деталей — шаги для воспроизведения проблемы, любые увиденные сообщения об ошибках и вашу версию NVDA — чтобы её можно было быстро решить. Спасибо, что помогаете нам улучшать!

🔝 Назад к оглавлению

История версий

История версий
Версия файлаТестируемая версия NVDAМинимальная версия NVDAРазмер файла (КБ)Ссылка на загрузку
2026.12026.1.02026.1.055AiVoiceDictation-V.2026.1.nvda-addon
🔝 Назад к оглавлению