FluidVoice — бесплатное приложение для системного голосового ввода на Mac. Оно распознаёт речь локально, вставляет текст в активное поле и при необходимости приводит диктовку в порядок с помощью локальной модели Fluid-1.

Я перешёл на голосовой ввод больше полугода назад и долго пользовался Wispr Flow. После одного дня с FluidVoice решил остаться на нём: для моих задач бесплатность, локальная обработка и словарь собственных терминов оказались важнее более широкой поддержки платформ у Wispr Flow.

Ниже — актуализация возможностей и ограничений FluidVoice по официальным источникам на 6 сентября 2026 года. Последний стабильный выпуск для macOS — 1.6.9 от 18 августа 2026 года.

Содержание

  1. Что такое FluidVoice
  2. Основные возможности
  3. Режимы ввода
  4. Подключение внешней постобработки
  5. Модели распознавания
  6. Собственный словарь
  7. Полезные сценарии
  8. Установка и проверка результата
  9. Приватность, аналитика и лицензия
  10. Ограничения и сравнение с Wispr Flow
  11. Официальные ссылки

Что такое FluidVoice

FluidVoice — приложение с открытым исходным кодом для голосового ввода в macOS. Оно работает поверх системы: вы устанавливаете глобальную горячую клавишу и диктуете в почте, документах, чатах, терминале или редакторе кода.

Распознавание выполняют локальные речевые модели. Дополнительная постобработка, то есть приведение сырой диктовки к более оформленному виду, доступна через локальную среду Fluid Intelligence с моделью Fluid-1. Этот слой исправляет регистр, пунктуацию и форматирование, а также может учитывать активное приложение.

💡
Локальный режим: голос, аудио и распознанный текст остаются на Mac, пока вы сами не подключите облачного провайдера для постобработки с помощью ИИ.

Есть два компонента. Само приложение FluidVoice распространяется с открытым исходным кодом под GPLv3. Fluid Intelligence — отдельная локальная среда выполнения для Fluid-1; разработчики пока держат этот компонент закрытым.

Основные возможности

ВозможностьЧто получает пользователь
Бесплатное приложениеНет платных тарифов; официальный сайт сообщает о 100 000+ загрузок
Локальное распознаваниеДиктовка работает без интернета после загрузки речевой модели
Системный вводОдна настраиваемая горячая клавиша для текстовых полей в разных приложениях
Fluid-1Опциональная локальная обработка диктовки, загрузка занимает около 3,5 ГБ
Адаптация под приложениеДля разных программ можно назначить собственные промпты и стиль текста
Несколько режимовDirect Dictation, Write Mode и Command Mode
Выбор движкаNemotron, Parakeet, Cohere Transcribe, Apple Speech и Whisper
Внешние провайдерыПо желанию можно подключить OpenAI, Groq или пользовательского провайдера
ИсторияОпциональная локальная история аудиозаписей с настройкой лимита занимаемого места и экспортом ZIP
Живой предпросмотрОверлей показывает распознаваемый текст во время диктовки

Официальный сайт указывает воспринимаемую задержку менее 100 мс, но реальная скорость зависит от модели, длины записи и компьютера. В версии 1.6.7 разработчики также сократили задержку захвата первых слов примерно с 350 мс до менее 100 мс.

Режимы ввода

  • Direct Dictation — обычная диктовка без AI-переработки текста.
  • Write Mode — создание нового текста или переработка выделенного фрагмента прямо в активном поле.
  • Command Mode — голосовое управление Mac: запуск приложений, системных действий, быстрых команд и автоматизаций.

Режим и способ постобработки настраиваются под задачу. Fluid-1 может локально убирать слова-паразиты, исправлять регистр и оформлять структуру. Для Slack, Mail, GitHub и других приложений можно задать отдельные промпты; FluidVoice определит активное приложение и применит соответствующую конфигурацию.

Подключение внешней постобработки

Обычная локальная диктовка и Fluid-1 не требуют API-ключа. Если нужна облачная постобработка с помощью ИИ, можно выбрать OpenAI, Groq или пользовательского провайдера и добавить его API-ключ. README проекта указывает, что ключи хранятся в системной связке ключей macOS (Keychain); при запросе доступа выберите «Always allow».

При таком подключении постобработка перестаёт быть полностью локальной. Отдельный публичный API или SDK FluidVoice в проверенных официальных материалах не описан.

Модели распознавания

Набор языков, размер загрузки и поддерживаемое оборудование зависят от модели.

МодельЯзыкиРазмерОборудование
Nemotron Speech 3.5 Ultra Fast Low Latencyоколо 40около 670 МБApple Silicon
Nemotron 3.5 Multilingualоколо 40около 530 МБApple Silicon
Parakeet Flash, бетаанглийскийоколо 250 МБApple Silicon
Parakeet TDT v325около 500 МБApple Silicon
Parakeet TDT v2английскийоколо 500 МБApple Silicon
Cohere Transcribe14около 1,4 ГБApple Silicon
Apple Speechсистемные языки macOSвстроенаApple Silicon и Intel
Whisper Tiny–Largeдо 99около 75 МБ–2,9 ГБApple Silicon и Intel

Для русского языка в списке языков Parakeet TDT v3 прямо указан русский язык. Whisper поддерживает до 99 языков в зависимости от размера выбранной модели.

На Intel Mac доступны Apple Speech и Whisper; поддержка Intel через модели Whisper появилась в FluidVoice 1.5.1.

Собственный словарь

FluidVoice позволяет добавлять имена, названия сервисов, аббревиатуры и профессиональные термины в пользовательский словарь (Custom Dictionary), если распознаватель регулярно искажает их. Для сложных слов можно сохранить образец произношения через функцию Train by Voice.

Начиная с версии 1.6.3 приложение умеет предлагать замены после повторных исправлений и поддерживает настраиваемые голосовые обозначения пунктуации. В версии 1.6.9 функция голосового форматирования (Spoken Formatting) научилась вставлять переносы строк, абзацы, табуляцию, пробелы, знаки препинания и символы по заданному стартовому слову.

В моём случае настройка словаря заняла несколько минут и заметно сократила число ошибок в рабочих терминах и именах.

Полезные сценарии

  • Длинные письма и промпты. Задача — быстро подготовить черновик в активном поле. Заранее установите Fluid-1 или выберите облачного провайдера, зажмите горячую клавишу и продиктуйте текст. Наблюдаемый результат — оформленный текст с пунктуацией, который можно проверить по оверлею и в активном поле до отправки. Без постобработки получится исходная расшифровка, а облачный вариант не будет полностью локальным.
  • Техническая диктовка. Задача — надиктовать комментарий к коду, рабочую заметку или команду в терминале. Сначала добавьте названия продуктов, имена и аббревиатуры в Custom Dictionary, затем продиктуйте контрольную фразу и проверьте написание в вставленном тексте. Команды терминала нужно перечитать перед выполнением: корректное распознавание не заменяет проверку самой команды.
  • Работа без интернета. Задача — диктовать в дороге или при отключённой сети. Заранее загрузите речевую модель и Fluid-1, если нужна локальная постобработка, откройте Notes и повторите диктовку после отключения интернета. Ожидаемый результат — текст появляется в активном поле без обращения к облаку. Облачная постобработка в таком режиме недоступна.
  • Разный стиль для разных приложений. Задача — получать более формальный текст в почте и более короткий рабочий текст в чате. Назначьте отдельные промпты для приложений и продиктуйте одну и ту же фразу при переключении активного окна. Результат можно сравнить по вставленному тексту. Адаптивный стиль зависит от выбранной постобработки и настроек конкретного приложения.
  • Голосовое управление Mac. Задача — запускать приложения, быстрые команды и системные действия без клавиатуры. Переключитесь в Command Mode и сначала проверьте безопасное действие, например открытие приложения. Наблюдаемый результат — выбранное действие выполняется. Перед более важными действиями просматривайте распознанную команду и учитывайте, что этот режим может менять состояние системы.
  • Расшифровка файлов. Задача — получить текст из аудио- или видеофайла. Используйте локальную транскрибацию файлов; в версии 1.6.8 появилась опциональная офлайн-разметка спикеров с временными метками, историей по спикерам и экспортом в текст или JSON. Разметку спикеров нужно включать отдельно, если она нужна.

Установка и проверка результата

Требования: macOS 15.0 Sequoia или новее, доступ к микрофону и разрешение Accessibility для ввода текста в другие приложения. Для загружаемой речевой модели рекомендуется предусмотреть около 1 ГБ диска, хотя точный объём зависит от выбранного варианта.

Установка через Homebrew:

brew install --cask fluidvoice

FluidVoice также можно скачать со страницы последнего официального релиза.

  1. Откройте приложение и выдайте доступ к микрофону.
  2. Разрешите FluidVoice управлять вводом в разделе Accessibility системных настроек.
  3. Выберите речевую модель с учётом языка и процессора.
  4. Установите глобальную горячую клавишу в настройках.
  5. При необходимости установите локальную среду Fluid Intelligence и загрузите модель Fluid-1. Этот шаг необязателен.
  6. Откройте Notes или другое безопасное текстовое поле, нажмите выбранную комбинацию и продиктуйте короткую фразу.
  7. Убедитесь, что текст появился в активном поле. Затем отключите интернет и повторите тест, если вам нужен полностью локальный сценарий.

Материал актуализирован по документации и журналу релизов; повторная практическая проверка текущей версии в рамках обновления не выполнялась.

Приватность, аналитика и лицензия

FluidVoice работает по принципу локальной обработки: аудио и текст не покидают компьютер, если пользователь явно не включил OpenAI, Groq или другого облачного провайдера.

По документации проекта, встроенная аналитика FluidVoice не собирает голос, исходное аудио, расшифровки, выделенный текст, промпты, ответы AI, команды терминала, заголовки окон, пути к файлам, буфер обмена и набираемый текст. При подключении облачного провайдера действует отдельный поток обработки, поэтому его условия приватности нужно проверять отдельно.

FluidVoice записывает один анонимный сигнал активности за локальный день и отправляет накопленный недельный пакет после завершения недели. Подробная анонимная аналитика включена по умолчанию и отключается в Settings → Share Detailed Anonymous Analytics; отключение не отменяет отправку базового недельного пакета активности.

FluidVoice бесплатен и распространяется под GPLv3 для версий от 23 февраля 2026 года. Более ранние версии использовали Apache License 2.0.

Ограничения и сравнение с Wispr Flow

Стабильная версия FluidVoice ориентирована на macOS 15 и новее. Для Windows уже публикуются предварительные сборки; в официальном списке релизов последняя доступная сборка — 0.0.9 с пометкой Pre-release. Версия для iPhone остаётся в разработке.

FluidVoice подходит, если вам нужны бесплатный системный ввод, локальное распознавание и контроль над используемыми моделями. Нужно учитывать объём локальных моделей, требования macOS и то, что Fluid Intelligence пока не является открытым компонентом.

Моё исходное сравнение с Wispr Flow основано на личной работе с обоими приложениями: FluidVoice оказался удобнее для моих задач. Это не заменяет актуального сравнения тарифов и платформ Wispr Flow, которые со временем могут меняться.

Официальные ссылки

Следующий шаг

Wispr Flow — голосовой ввод с AI-командами для любого приложения

Локальный голосовой ввод полезен тем, кто много работает с текстами, промптами или специальной лексикой и хочет меньше зависеть от облачных сервисов.

Если захотите обсудить, как это применить у себя или в команде — пишите в Telegram @pimenov