OmniVoice — локальный синтез речи и клонирование голоса на 600+ языков
Локальная open-source TTS-модель на 600+ языков: клонирует голос по образцу в 3–10 секунд, работает офлайн. Установка, API, сценарии и наш кейс озвучки сайта на Mac mini.
Руководства по инструментам и рабочим задачам. Найдите нужное и переходите к конкретным шагам.
Локальная open-source TTS-модель на 600+ языков: клонирует голос по образцу в 3–10 секунд, работает офлайн. Установка, API, сценарии и наш кейс озвучки сайта на Mac mini.
gigastt — локальный STT-сервер на Rust: модель GigaAM v3, WebSocket и REST, диаризация и пунктуация, работа без облака и без API-ключей.
Recordly — бесплатный open-source инструмент для записи экрана с автоматическим зумом, анимациями курсора и красивыми фонами. Работает на macOS, Windows и Linux.
Higgsfield AI: платформа-агрегатор видео-моделей (Sora 2, Veo 3.1, Kling 3.0, Seedance 2.0), собственная фото-модель Soul, Cinema Studio, агент Supercomputer, MCP и API. Что выбирать под задачу, тарифы, варианты применения и доступ из РФ.
Локальный AI-автокомплит для macOS: предсказывает слова в любом приложении, работает офлайн на Apple Silicon. Советы по настройке и выбору модели.
Wispr Flow — приложение для голосового ввода с AI-обработкой: диктовка в любое приложение, автоматическое редактирование, команды, 100+ языков. Работает на macOS, Windows, iOS и Android.
Сравнение семи приложений для голосового ввода — Wispr Flow, Spokenly, Superwhisper, Aqua Voice, VoiceInk, Google Eloquent и Handy: цены, платформы и приватность.
Попробуйте название инструмента, например GitHub, или выберите «Все темы».
Страница 5 из 5
MagicPath — мультиплеерный ИИ-канвас для проектирования интерфейсов людьми и агентами: генерация UI из промптов, Figma-импорт, экспорт кода, работа в ChatGPT.