Голосовой ввод текста для Windows — локальная или облачная диктовка в любом приложении | NeuroSwitcher

Новое в Pro-бете · Голосовой ввод

Голосовой ввод для Windows в любом приложении — по умолчанию локально.

Включите диктовку, нажмите горячую клавишу и скажите, что хотите написать, — NeuroSwitcher напечатает это в активном окне: в чате, браузере, редакторе, IDE. Распознавание речи по умолчанию идёт на вашем ПК; или переключитесь на NeuroSwitcher Cloud без настройки, или на API вашего провайдера. Без подписки.

  • Локально или в облаке
  • Хватает процессора
  • RU · EN · DE + HE бета
  • Опциональная ИИ-правка
сообщение.txt

🎙 Идёт запись… (F8 — стоп)

Давай перенесём встречу на четверг, на три часа.

Локальная модель · распознано на вашем ПК
Движок: запущен Бэкенд: локально / облако Хоткей: F8

Как это работает

Включите, нажмите F8, говорите. Текст — там, где курсор.

Диктовка NeuroSwitcher — это небольшой речевой движок, который живёт рядом с уже привычным переключателем раскладки. Распознанный текст печатается через тот же механизм ввода, что и исправления раскладки, поэтому работает в обычных текстовых полях по всей Windows.

1

Включите диктовку

Движок по умолчанию выключен (держит модель в оперативной памяти). Запустите его из трея Voice → Запустить диктовку или включите автозапуск при старте на вкладке Voice в Pro Console.

2

Нажмите F8 — запись

Когда движок включён, нажмите клавишу диктовки (F8 по умолчанию, настраивается) и говорите. Индикатор — и значок микрофона Windows 11 — покажут, что микрофон открыт.

3

Нажмите F8 — стоп

Повторное нажатие закрывает микрофон, и текст печатается у курсора. С локальным бэкендом аудио обрабатывается в памяти: не пишется на диск и никуда не уходит.

4

Длинная диктовка? Включите VAD

По умолчанию вся запись распознаётся целиком в момент остановки. Включите VAD-сегментацию (трей → Voice → VAD-сегментация), чтобы речь резалась по паузам: каждый кусок распознаётся и вставляется сразу — текст идёт фраза за фразой, и снимается лимит ~30 секунд на одну реплику у Whisper. Модель VAD (Silero) уже встроена, отдельно скачивать не нужно.

Распознавание

Выберите, где речь превращается в текст.

У распознавания речи три пути — выберите под свою приватность и удобство настройки, на вкладке Pro Console Voice → Распознавание (speech-to-text). Локально — по умолчанию и максимально приватно; облачные пути меняют часть приватности на нулевую настройку или максимальную точность.

Локальная модель · офлайн (по умолчанию)

Скачайте модель распознавания в один клик из встроенного каталога (Pro Console → Voice), с прогрессом установки. Маленькую и быструю или крупнее и точнее. После загрузки распознавание идёт целиком на вашем процессоре — без интернета, аудио не покидает ПК.

NeuroSwitcher Cloud

Ноль настройки: без ключа, без скачивания модели, с бесплатным дневным лимитом. Запрос подписывается анонимным install id вашей машины. Записанное аудио отправляется на наш прокси и дальше провайдеру. Подробнее о NeuroSwitcher Cloud →

Свой провайдер

Направьте распознавание на OpenAI (напр. gpt-4o-mini-transcribe) или любой OpenAI-совместимый эндпоинт по вашему API-ключу. Аудио идёт напрямую с вашего ПК к этому провайдеру — без сервера NeuroSwitcher посередине.

Переключается в любой момент

Бэкенд — это выпадающий список на вкладке Voice: начните локально ради приватности, переключитесь на облако, когда нужна точность без настройки, и обратно. После смены перезапустите движок. Облачные бэкенды всегда опциональны.

Когда удобнее облако: слабый ПК, нужна максимальная точность без большой загрузки модели, или иврит «без возни». Ради приватности и работы офлайн — локальная модель.

Локальные модели

Какую локальную модель распознавания выбрать.

Для локального бэкенда модели докачиваются из встроенного каталога (Pro Console → Voice, установка в один клик, с прогрессом). Единой «лучшей» нет — выбор зависит от языков и мощности ПК. Рекомендации из нашей практики:

Qwen3-ASR 0.6B · ~1 ГБЛучший для RU/EN/DE и смешанной речи — распознаёт микс языков в одной фразе за один проход. Рекомендуется по умолчанию для русско-/англо-/немецкой диктовки. Иврит не поддерживает.
Whisper-base · ~200 МБЛёгкий универсал: RU/EN/DE и иврит (с явно выбранным языком). Хороший старт и вариант для слабых машин.
Whisper-tiny · ~110 МБСамый лёгкий и быстрый; точность ниже. Когда важнее скорость и размер, чем качество.
Whisper-medium / large-v3 · ~1–2 ГБМаксимальная точность, включая иврит. Требуют больше памяти и процессора — на слабом ПК заметно медленнее.

⚠️ Whisper определяет язык один раз на всю фразу, поэтому для речи со смешением языков в одном предложении берите Qwen3. Для иврита — только Whisper (base / medium / large-v3) с явно выбранным языком HE: Qwen3 иврит не умеет. В каталоге есть и модели под другие языки (китайский, японский, кантонский).

Языки

Сделано для тех, кто диктует не на одном языке.

Как и сам переключатель раскладки, голосовой ввод рассчитан на многоязычную повседневную работу — включая фразы, где язык меняется на середине предложения.

РусскийПолноценное качество диктовки на рекомендуемой локальной модели.
АнглийскийПолноценное качество, включая смешанные RU/EN-фразы «на одном дыхании».
НемецкийПолноценное качество диктовки на рекомендуемой локальной модели.
ИвритБета: работает через модели Whisper с подсказкой языка; качество распознавания пока дорабатывается.

Язык распознавания (Авто / RU / EN / DE / HE) выбирается в трей-меню Voice и на вкладке Voice в Pro Console. Для иврита рекомендуется указывать язык явно.

Правка диктовки

По желанию — причешите сырую расшифровку через LLM.

Надиктованный текст приходит с паразитами, оговорками и без пунктуации. Опциональный проход LLM переписывает всю диктовку — пунктуация, чистка мусора, формат — до вставки. По умолчанию выключено; вот как включить.

1 · Включите «Правка (LLM)»Включите в трее Voice → Правка (LLM) или выберите бэкенд правки на вкладке Voice в Pro Console. По умолчанию выключено.
2 · Выберите пресетВыберите пресет-промпт в трее Voice → Промпт правки — «Причесать», «Формально», «Разговорно», «Списком», «Суммаризовать», «Перевести» и другие. Отмеченный пресет применяется к каждой диктовке.
3 · Редактируйте или добавляйте промптыНа вкладке Voice в Pro Console (раздел с промптами LLM) можно отредактировать любой встроенный промпт — он станет новым дефолтом для этого пресета — или добавить свой; трей-меню обновится.
4 · Выберите ИИ-бэкендБесплатный NeuroSwitcher Cloud, ваш ключ OpenAI / OpenRouter или полностью локальная модель через Ollama или LM Studio. Настройка общая с ассистентом — см. страницу ИИ-ассистента.

Те же правила приватности: с локальной моделью правка остаётся на вашем ПК; с облачной текст расшифровки уходит напрямую к выбранному провайдеру по вашему ключу (или по бесплатной квоте NeuroSwitcher Cloud).

Управление

Из трея или из Pro Console — как удобнее.

Меню Voice в трееСтарт/стоп движка, смена активной модели, язык распознавания, а также «Правка (LLM)» и её пресет — не открывая никаких окон.
Вкладка Voice в Pro ConsoleКаталог моделей с установкой в один клик и прогрессом, бэкенд распознавания (локально / Cloud / свой ключ), статус движка, горячая клавиша, автозапуск и настройки правки — в одном месте.
Настраиваемый хоткейF8 по умолчанию; поменяйте, если конфликтует с вашими приложениями.
Движок по требованиюГолосовой движок работает, только когда вы его запустили: он держит модель в оперативной памяти, поэтому выключен, пока не нужен (или пока не включён автозапуск).

FAQ

Частые вопросы про голосовой ввод.

Как начать диктовать?

Голосовой движок по умолчанию выключен. Включите его из трея Voice → Запустить диктовку (или включите автозапуск на вкладке Voice в Pro Console). Затем нажмите F8, чтобы начать запись, говорите и нажмите F8 ещё раз для остановки — текст напечатается в активном приложении.

Он работает без интернета?

Да, с локальной моделью распознавания — это вариант по умолчанию. После установки модели распознавание идёт целиком на вашем ПК без интернета (сеть нужна только для разовой загрузки модели). NeuroSwitcher Cloud и бэкенды с вашим ключом опциональны и используют соединение.

Мой голос записывается или где-то хранится?

С локальным бэкендом — нет: микрофон открыт только между явным стартом и стопом, аудио распознаётся в памяти, ничего не пишется на диск и не выгружается. Если вы выбрали облачный бэкенд распознавания (NeuroSwitcher Cloud или свой провайдер), записанное аудио отправляется этому провайдеру для распознавания. Во время записи видны и индикатор NeuroSwitcher, и стандартный значок микрофона Windows.

Нужен мощный компьютер или видеокарта?

Нет. Надиктованные фразы короткие, и локальные модели по умолчанию распознают их быстрее реального времени на обычном процессоре. Если машина позволяет, в каталоге есть модели крупнее и точнее — или можно полностью переложить распознавание на облачный бэкенд.

В каких приложениях это работает?

В любых с обычным текстовым полем: браузеры, мессенджеры, редакторы, IDE, офисные приложения. Текст печатается тем же механизмом, каким NeuroSwitcher исправляет раскладку, и на него действует тот же список исключений по приложениям.

Насколько хорош иврит?

Диктовка на иврите — в бете. Она работает через модели Whisper с явно выставленным языком, на выходе — настоящий ивритский текст, но качество распознавания пока заметно уступает русскому, английскому и немецкому. Над этим активно работаем.

Голосовой ввод бесплатный?

Голосовой ввод входит в бесплатную Pro-бету. Управляемый каталог моделей с установкой в один клик — это Pro-удобство; сам голосовой движок — часть открытого ядра. У NeuroSwitcher Cloud есть бесплатный дневной лимит; бэкенды с вашим ключом тарифицируются вашим провайдером.

Антивирус просит доступ к микрофону для «ks-voice-host.exe» — так и должно быть?

Да. Микрофон открывает не основное приложение, а отдельный процесс распознавания — ks-voice-host.exe из подпапки voice в каталоге установки NeuroSwitcher. Распознавание вынесено в отдельный процесс намеренно: речевая модель изолирована от переключателя раскладки, и сбой в одном не роняет другое. Поэтому Windows или ваш антивирус показывают незнакомое имя файла, а не «NeuroSwitcher». Разрешение достаточно выдать один раз.

Бесплатная Pro-бета

Печатайте голосом — так, как удобно вам.

Скачайте NeuroSwitcher для Windows 10 и 11, откройте вкладку Voice, включите диктовку и говорите в любое приложение — с локальной моделью офлайн или через NeuroSwitcher Cloud без настройки.

Скачать NeuroSwitcher

← На главную NeuroSwitcher