Голосовой ввод превращает живую речь в отформатированный текст прямо в рабочем приложении. Ниже — семь актуальных решений и короткая логика выбора под разные платформы, требования к приватности и работу с ИИ-агентами.

🎙️
В моём рабочем потоке основным инструментом остаётся Wispr Flow. Для взаимодействия с Codex и Cursor также полезен Spokenly: агент может запросить уточнение через локальный MCP-сервер (Model Context Protocol, протокол подключения инструментов к ИИ-приложениям), а надиктованный ответ возвращается агенту в виде текста.

Как выбрать за 30 секунд

  • Один облачный инструмент для Mac, Windows, iPhone и Android → Wispr Flow.
  • Локальная диктовка и голосовые ответы агентам → Spokenly.
  • Диктовка, обработка аудиофайлов и гибкие режимы → Superwhisper.
  • Высокая точность на коде и профессиональной лексике → Aqua Voice.
  • Локальная диктовка на Apple Silicon без подписки → VoiceInk.
  • Простой бесплатный локальный ввод → Handy.
  • Linux, локальные модели, облако и ИИ-агент в одном приложении → OpenWhispr.

Цены, лимиты и платформы проверены по официальным материалам 2 сентября 2026 года. Для Spokenly и OpenWhispr актуальная цена не указана в доступном снимке документации.

Wispr Flow — диктовка на четырёх платформах

Wispr Flow вводит текст в любое поле, убирает слова-паразиты, исправляет повторы, добавляет пунктуацию и форматирование. Поддерживаются более 100 языков.

  • Платформы: macOS, Windows, iPhone и Android.
  • Бесплатный тариф: 2000 слов в неделю на десктопе, 1000 слов в неделю на iPhone и безлимитная диктовка на Android.
  • Pro: $15 в месяц или $12 в месяц при годовой оплате; диктовка без ограничений.
  • Сильные стороны: единый рабочий процесс на четырёх платформах, автоматическая очистка текста, персональный словарь и сниппеты.
  • Ограничение: официальные материалы описывают управление хранением и использованием данных, но не заявляют локальную модель распознавания. Для чувствительной информации заранее проверьте настройки Data and Privacy.
  • Кому подойдёт: тем, кому нужен один инструмент для диктовки на компьютере и телефоне.

Официальный сайт · Тарифы

Spokenly — локальные модели и голосовые ответы агентам

Spokenly работает в любом поле ввода и поддерживает локальный режим. В документации перечислены Mac, iPhone, Windows и Linux.

  • Обработка: можно работать полностью офлайн с локальными моделями и включить Local Only Mode.
  • Режимы: инструкции для суммаризации, переписывания и генерации текста; на Mac доступны Agentic Actions.
  • Интеграция с агентами: локальный MCP-сервер позволяет Claude Code, Codex и Cursor задавать пользователю вопросы и получать надиктованный ответ.
  • Требования к MCP: Spokenly 2.18.0 или новее на macOS; нужна версия с сайта разработчика, потому что MCP недоступен в сборке Mac App Store.
  • Кому подойдёт: тем, кому важны локальная обработка и голосовой канал для уточнений от кодинг-агента.

MCP здесь служит для ответов на вопросы агента. Обычную постановку задачи по-прежнему можно диктовать в активное поле любого приложения.

Документация · Voice for Agents

Superwhisper — диктовка и обработка аудиофайлов

Superwhisper сочетает системную диктовку, расшифровку аудио- и видеофайлов и режимы обработки текста. Он доступен на macOS, Windows, iPhone и iPad и поддерживает более 100 языков.

  • Бесплатная версия: голосовой ввод и базовая транскрипция, ограниченный доступ к облачным моделям. Новые пользователи получают 15 минут функций Pro и могут создать три режима.
  • Pro: $8.49 в месяц, $84.99 в год или $249.99 разово.
  • В Pro входят: локальные голосовые модели, безлимитные облачные модели, пользовательские режимы, словарь и разделение спикеров.
  • Лицензия: одна лицензия действует на Mac, Windows, iPhone и iPad; для компьютеров отдельного лимита устройств нет.
  • Кому подойдёт: тем, кому кроме диктовки нужна обработка записанных лекций, интервью или встреч.

Документация · Тарифы Pro

Aqua Voice — облачная диктовка для терминов и кода

Aqua Voice работает системно и на тарифе Pro использует собственную модель Avalon. Deep Context может учитывать содержимое экрана, чтобы точнее распознавать код, имена и профессиональную лексику.

  • Платформы: macOS, Windows 10/11 и iPhone. Полноценная клавиатура для iPhone вышла в апреле 2026 года.
  • Языки: 49, включая русский.
  • Бесплатный доступ: 1000 слов диктовки на пробный период, без банковской карты.
  • Pro: $8 в месяц при годовой оплате или $10 помесячно; безлимитная диктовка и Avalon.
  • Словарь: до 800 пользовательских записей.
  • Ограничение: Aqua работает через облако и требует интернет-соединения. Компания также предупреждает, что пока не подписывает HIPAA BAA.
  • Кому подойдёт: тем, кто работает онлайн и часто диктует код, имена и специализированные термины.

В октябре 2025 года Avalon дебютировала на первом месте среди проприетарных моделей в Open ASR Leaderboard. Рейтинг обновляется, поэтому это исторический результат запуска, а не обещание текущего лидерства.

Руководство · FAQ

VoiceInk — локальная диктовка для Apple Silicon

VoiceInk — приложение с открытым исходным кодом, которое обрабатывает голос локально на Mac. Облачное улучшение необязательно: при его включении передаётся распознанный текст, а не аудио.

  • Основная версия для Mac: Apple Silicon и macOS 14.4 или новее; рекомендуется 8 ГБ памяти.
  • iOS: на официальном сайте также доступна версия для iPhone.
  • Цена версии для Mac: $25 за одно устройство, $39 за два или $49 за три. Это разовая покупка с пожизненными обновлениями.
  • Пробный период: доступна бесплатная пробная версия; для покупки действует 14-дневный возврат.
  • Сильные стороны: локальная обработка, открытый код и отсутствие подписки.
  • Кому подойдёт: владельцам Mac на Apple Silicon, которым нужна приватная диктовка с разовой оплатой.

Официальный сайт · Тарифы

Handy — простой бесплатный локальный ввод

Handy решает одну задачу: по горячей клавише записывает речь, распознаёт её на компьютере и вставляет результат в активное текстовое поле.

  • Цена: бесплатно.
  • Исходный код: открыт для изучения и доработки.
  • Приватность: голос остаётся на компьютере и не отправляется в облако.
  • Режимы запуска: удержание сочетания клавиш или отдельные нажатия для начала и завершения записи.
  • Ограничение: Handy сфокусирован на транскрипции, поэтому возможностей для автоматической обработки текста у него меньше, чем у продуктов с отдельными режимами редактирования.
  • Кому подойдёт: тем, кому нужен минималистичный локальный инструмент без подписки.

Официальный сайт

OpenWhispr — локальная диктовка и ИИ-агент на Linux

OpenWhispr — приложение с открытым кодом для диктовки, расшифровки встреч, заметок и голосового взаимодействия с ИИ-агентом.

  • Платформы: macOS 12 или новее, Windows 10 или новее и 64-битный Linux.
  • Локальные модели: Whisper, NVIDIA Parakeet и Nemotron.
  • Другие варианты обработки: встроенное облако OpenWhispr или собственные ключи OpenAI, Groq, xAI, Mistral, Tinfoil, OpenRouter и Corti.
  • Возможности: ввод в любое приложение, автоматическое обнаружение встреч, разделение спикеров, заметки и семантический поиск.
  • Интеграции: публичный REST API для работы с данными и MCP-сервер для Claude, Cursor и VS Code.
  • Кому подойдёт: пользователям Linux и тем, кто хочет выбирать между локальной обработкой, собственным API-ключом и готовым облаком.

Документация

Сводная таблица

ПриложениеПлатформыЛокальная обработкаПодтверждённая цена
Wispr FlowMac, Windows, iPhone, AndroidНе заявленабесплатно; Pro $12–15/мес
SpokenlyMac, Windows, Linux, iPhoneДаактуальная цена не указана в доступном снимке документации
SuperwhisperMac, Windows, iPhone, iPadДа, в Pro$8.49/мес, $84.99/год или $249.99 разово
Aqua VoiceMac, Windows, iPhoneНет1000 слов на пробу; Pro $8–10/мес
VoiceInkMac, iPhoneДа на Macот $25 разово за Mac-версию
HandyКомпьютерДабесплатно
OpenWhisprMac, Windows, LinuxДатарифы не указаны в доступном снимке документации

Полезные сценарии

Один инструмент на компьютере и телефоне

Wispr Flow подходит, если важнее всего единый инструмент на основных платформах. После установки проверьте его в почте, мессенджере и редакторе: результат должен появляться непосредственно в поле с курсором. Если нужна подтверждённая локальная обработка, выберите другой вариант: в официальном описании Flow локальная модель не заявлена.

Голосовые уточнения в Codex или Cursor

Установите Spokenly 2.18.0 или новее с сайта разработчика на Mac, включите интеграцию нужного агента и перезапустите его. Для проверки попросите агента задать несколько вопросов через Spokenly. Успешный результат: приложение начинает запись, а транскрибированный ответ возвращается агенту. Сценарий не подойдёт для сборки Spokenly из Mac App Store: MCP там недоступен.

Чувствительные данные без облака

Выберите локальный режим Spokenly, VoiceInk, Handy или OpenWhispr. Перед рабочей диктовкой включите режим только локальной обработки там, где он предусмотрен, и проверьте настройки выбранной модели. В Superwhisper локальные модели относятся к Pro. Учитывайте, что локальная транскрипция сама по себе не подтверждает локальную очистку, форматирование или генерацию ответа.

Диктовка кода и терминов

Для облачного сценария на тарифе Pro подойдёт Aqua Voice с Avalon и пользовательским словарём. Для локального сценария используйте Spokenly или OpenWhispr и добавьте названия проектов, библиотек и людей в словарь приложения. Aqua не подходит, если обязательна работа без интернета: по официальному FAQ сервис облачный и требует соединения.

Что проверить перед выбором

  • Приложение действительно работает на вашей версии операционной системы.
  • Русский язык поддерживается выбранной моделью, а не только приложением в целом.
  • Локальный режим не вызывает скрытое облачное улучшение текста.
  • Бесплатный доступ является постоянным тарифом или разовым пробным лимитом.
  • Словарь, разделение спикеров и крупные локальные модели входят в выбранный тариф.
  • Голосовой ввод вставляет текст в нужные вам терминал, редактор и корпоративные приложения.
  • Для MCP-интеграции используется поддерживаемая сборка и версия приложения.
🔒
Для клиентских, медицинских и других чувствительных данных проверяйте не только место распознавания аудио, но и последующую обработку текста. Локальная транскрипция не гарантирует локальную очистку, форматирование или генерацию ответа.

Ссылки на официальные источники

Следующий шаг

Silero Models — open-source модели речи на русском

Если хотите встроить голосовой ввод в работу с документами, кодом или ИИ-агентами, сначала определите требования к платформам и приватности.

Если захотите обсудить, как это применить у себя или в команде — пишите в Telegram @pimenov