FluidVoice — бесплатное приложение для системного голосового ввода на Mac. Оно распознаёт речь локально, вставляет текст в активное поле и при необходимости приводит диктовку в порядок с помощью локальной модели Fluid-1.
Я перешёл на голосовой ввод больше полугода назад и долго пользовался Wispr Flow. После одного дня с FluidVoice решил остаться на нём: для моих задач бесплатность, локальная обработка и словарь собственных терминов оказались важнее более широкой поддержки платформ у Wispr Flow.
Ниже — актуализация возможностей и ограничений FluidVoice по официальным источникам на 6 сентября 2026 года. Последний стабильный выпуск для macOS — 1.6.9 от 18 августа 2026 года.
Содержание
- Что такое FluidVoice
- Основные возможности
- Режимы ввода
- Подключение внешней постобработки
- Модели распознавания
- Собственный словарь
- Полезные сценарии
- Установка и проверка результата
- Приватность, аналитика и лицензия
- Ограничения и сравнение с Wispr Flow
- Официальные ссылки
Что такое FluidVoice
FluidVoice — приложение с открытым исходным кодом для голосового ввода в macOS. Оно работает поверх системы: вы устанавливаете глобальную горячую клавишу и диктуете в почте, документах, чатах, терминале или редакторе кода.
Распознавание выполняют локальные речевые модели. Дополнительная постобработка, то есть приведение сырой диктовки к более оформленному виду, доступна через локальную среду Fluid Intelligence с моделью Fluid-1. Этот слой исправляет регистр, пунктуацию и форматирование, а также может учитывать активное приложение.
Есть два компонента. Само приложение FluidVoice распространяется с открытым исходным кодом под GPLv3. Fluid Intelligence — отдельная локальная среда выполнения для Fluid-1; разработчики пока держат этот компонент закрытым.
Основные возможности
| Возможность | Что получает пользователь |
| Бесплатное приложение | Нет платных тарифов; официальный сайт сообщает о 100 000+ загрузок |
| Локальное распознавание | Диктовка работает без интернета после загрузки речевой модели |
| Системный ввод | Одна настраиваемая горячая клавиша для текстовых полей в разных приложениях |
| Fluid-1 | Опциональная локальная обработка диктовки, загрузка занимает около 3,5 ГБ |
| Адаптация под приложение | Для разных программ можно назначить собственные промпты и стиль текста |
| Несколько режимов | Direct Dictation, Write Mode и Command Mode |
| Выбор движка | Nemotron, Parakeet, Cohere Transcribe, Apple Speech и Whisper |
| Внешние провайдеры | По желанию можно подключить OpenAI, Groq или пользовательского провайдера |
| История | Опциональная локальная история аудиозаписей с настройкой лимита занимаемого места и экспортом ZIP |
| Живой предпросмотр | Оверлей показывает распознаваемый текст во время диктовки |
Официальный сайт указывает воспринимаемую задержку менее 100 мс, но реальная скорость зависит от модели, длины записи и компьютера. В версии 1.6.7 разработчики также сократили задержку захвата первых слов примерно с 350 мс до менее 100 мс.
Режимы ввода
- Direct Dictation — обычная диктовка без AI-переработки текста.
- Write Mode — создание нового текста или переработка выделенного фрагмента прямо в активном поле.
- Command Mode — голосовое управление Mac: запуск приложений, системных действий, быстрых команд и автоматизаций.
Режим и способ постобработки настраиваются под задачу. Fluid-1 может локально убирать слова-паразиты, исправлять регистр и оформлять структуру. Для Slack, Mail, GitHub и других приложений можно задать отдельные промпты; FluidVoice определит активное приложение и применит соответствующую конфигурацию.
Подключение внешней постобработки
Обычная локальная диктовка и Fluid-1 не требуют API-ключа. Если нужна облачная постобработка с помощью ИИ, можно выбрать OpenAI, Groq или пользовательского провайдера и добавить его API-ключ. README проекта указывает, что ключи хранятся в системной связке ключей macOS (Keychain); при запросе доступа выберите «Always allow».
При таком подключении постобработка перестаёт быть полностью локальной. Отдельный публичный API или SDK FluidVoice в проверенных официальных материалах не описан.
Модели распознавания
Набор языков, размер загрузки и поддерживаемое оборудование зависят от модели.
| Модель | Языки | Размер | Оборудование |
| Nemotron Speech 3.5 Ultra Fast Low Latency | около 40 | около 670 МБ | Apple Silicon |
| Nemotron 3.5 Multilingual | около 40 | около 530 МБ | Apple Silicon |
| Parakeet Flash, бета | английский | около 250 МБ | Apple Silicon |
| Parakeet TDT v3 | 25 | около 500 МБ | Apple Silicon |
| Parakeet TDT v2 | английский | около 500 МБ | Apple Silicon |
| Cohere Transcribe | 14 | около 1,4 ГБ | Apple Silicon |
| Apple Speech | системные языки macOS | встроена | Apple Silicon и Intel |
| Whisper Tiny–Large | до 99 | около 75 МБ–2,9 ГБ | Apple Silicon и Intel |
Для русского языка в списке языков Parakeet TDT v3 прямо указан русский язык. Whisper поддерживает до 99 языков в зависимости от размера выбранной модели.
На Intel Mac доступны Apple Speech и Whisper; поддержка Intel через модели Whisper появилась в FluidVoice 1.5.1.
Собственный словарь
FluidVoice позволяет добавлять имена, названия сервисов, аббревиатуры и профессиональные термины в пользовательский словарь (Custom Dictionary), если распознаватель регулярно искажает их. Для сложных слов можно сохранить образец произношения через функцию Train by Voice.
Начиная с версии 1.6.3 приложение умеет предлагать замены после повторных исправлений и поддерживает настраиваемые голосовые обозначения пунктуации. В версии 1.6.9 функция голосового форматирования (Spoken Formatting) научилась вставлять переносы строк, абзацы, табуляцию, пробелы, знаки препинания и символы по заданному стартовому слову.
В моём случае настройка словаря заняла несколько минут и заметно сократила число ошибок в рабочих терминах и именах.
Полезные сценарии
- Длинные письма и промпты. Задача — быстро подготовить черновик в активном поле. Заранее установите Fluid-1 или выберите облачного провайдера, зажмите горячую клавишу и продиктуйте текст. Наблюдаемый результат — оформленный текст с пунктуацией, который можно проверить по оверлею и в активном поле до отправки. Без постобработки получится исходная расшифровка, а облачный вариант не будет полностью локальным.
- Техническая диктовка. Задача — надиктовать комментарий к коду, рабочую заметку или команду в терминале. Сначала добавьте названия продуктов, имена и аббревиатуры в Custom Dictionary, затем продиктуйте контрольную фразу и проверьте написание в вставленном тексте. Команды терминала нужно перечитать перед выполнением: корректное распознавание не заменяет проверку самой команды.
- Работа без интернета. Задача — диктовать в дороге или при отключённой сети. Заранее загрузите речевую модель и Fluid-1, если нужна локальная постобработка, откройте Notes и повторите диктовку после отключения интернета. Ожидаемый результат — текст появляется в активном поле без обращения к облаку. Облачная постобработка в таком режиме недоступна.
- Разный стиль для разных приложений. Задача — получать более формальный текст в почте и более короткий рабочий текст в чате. Назначьте отдельные промпты для приложений и продиктуйте одну и ту же фразу при переключении активного окна. Результат можно сравнить по вставленному тексту. Адаптивный стиль зависит от выбранной постобработки и настроек конкретного приложения.
- Голосовое управление Mac. Задача — запускать приложения, быстрые команды и системные действия без клавиатуры. Переключитесь в Command Mode и сначала проверьте безопасное действие, например открытие приложения. Наблюдаемый результат — выбранное действие выполняется. Перед более важными действиями просматривайте распознанную команду и учитывайте, что этот режим может менять состояние системы.
- Расшифровка файлов. Задача — получить текст из аудио- или видеофайла. Используйте локальную транскрибацию файлов; в версии 1.6.8 появилась опциональная офлайн-разметка спикеров с временными метками, историей по спикерам и экспортом в текст или JSON. Разметку спикеров нужно включать отдельно, если она нужна.
Установка и проверка результата
Требования: macOS 15.0 Sequoia или новее, доступ к микрофону и разрешение Accessibility для ввода текста в другие приложения. Для загружаемой речевой модели рекомендуется предусмотреть около 1 ГБ диска, хотя точный объём зависит от выбранного варианта.
Установка через Homebrew:
brew install --cask fluidvoiceFluidVoice также можно скачать со страницы последнего официального релиза.
- Откройте приложение и выдайте доступ к микрофону.
- Разрешите FluidVoice управлять вводом в разделе Accessibility системных настроек.
- Выберите речевую модель с учётом языка и процессора.
- Установите глобальную горячую клавишу в настройках.
- При необходимости установите локальную среду Fluid Intelligence и загрузите модель Fluid-1. Этот шаг необязателен.
- Откройте Notes или другое безопасное текстовое поле, нажмите выбранную комбинацию и продиктуйте короткую фразу.
- Убедитесь, что текст появился в активном поле. Затем отключите интернет и повторите тест, если вам нужен полностью локальный сценарий.
Материал актуализирован по документации и журналу релизов; повторная практическая проверка текущей версии в рамках обновления не выполнялась.
Приватность, аналитика и лицензия
FluidVoice работает по принципу локальной обработки: аудио и текст не покидают компьютер, если пользователь явно не включил OpenAI, Groq или другого облачного провайдера.
По документации проекта, встроенная аналитика FluidVoice не собирает голос, исходное аудио, расшифровки, выделенный текст, промпты, ответы AI, команды терминала, заголовки окон, пути к файлам, буфер обмена и набираемый текст. При подключении облачного провайдера действует отдельный поток обработки, поэтому его условия приватности нужно проверять отдельно.
FluidVoice записывает один анонимный сигнал активности за локальный день и отправляет накопленный недельный пакет после завершения недели. Подробная анонимная аналитика включена по умолчанию и отключается в Settings → Share Detailed Anonymous Analytics; отключение не отменяет отправку базового недельного пакета активности.
FluidVoice бесплатен и распространяется под GPLv3 для версий от 23 февраля 2026 года. Более ранние версии использовали Apache License 2.0.
Ограничения и сравнение с Wispr Flow
Стабильная версия FluidVoice ориентирована на macOS 15 и новее. Для Windows уже публикуются предварительные сборки; в официальном списке релизов последняя доступная сборка — 0.0.9 с пометкой Pre-release. Версия для iPhone остаётся в разработке.
FluidVoice подходит, если вам нужны бесплатный системный ввод, локальное распознавание и контроль над используемыми моделями. Нужно учитывать объём локальных моделей, требования macOS и то, что Fluid Intelligence пока не является открытым компонентом.
Моё исходное сравнение с Wispr Flow основано на личной работе с обоими приложениями: FluidVoice оказался удобнее для моих задач. Это не заменяет актуального сравнения тарифов и платформ Wispr Flow, которые со временем могут меняться.
Официальные ссылки
- Официальный сайт FluidVoice
- Исходный код и документация
- Релизы FluidVoice
- Последняя сборка для загрузки
- Мой разбор Wispr Flow
Следующий шаг
Wispr Flow — голосовой ввод с AI-командами для любого приложения
Локальный голосовой ввод полезен тем, кто много работает с текстами, промптами или специальной лексикой и хочет меньше зависеть от облачных сервисов.
Если захотите обсудить, как это применить у себя или в команде — пишите в Telegram @pimenov


