СейчасЧто входит в Summarize
- Что входит в Summarize
- Установка и первый запуск CLI
- Извлечение текста и управление результатом
- YouTube, подкасты и слайды
- Расширение для Chrome и Firefox
- Подключение локального демона
- Модели и способы подключения
- Полезные сценарии
- Быстрый отбор материалов для чтения
- Подготовка текста для AI-агента
- Разбор длинного видео
- Проверка результата и ограничения
- Официальные ссылки
- Следующий шаг
- Связанные материалы
Summarize превращает веб-страницы, YouTube-видео, подкасты, PDF и локальные файлы в структурированные саммари или очищенный текст. Инструмент подходит для ручной работы через браузер и автоматизации через командную строку.
Актуальность проверена 8 сентября 2026 года по официальной документации и релизам. Последний опубликованный релиз — 0.21.13, репозиторий насчитывает около 6,6 тысячи звёзд.
Содержание
- Что входит в Summarize
- Установка и первый запуск CLI
- Извлечение текста и управление результатом
- YouTube, подкасты и слайды
- Расширение для Chrome и Firefox
- Модели и способы подключения
- Полезные сценарии
- Проверка результата и ограничения
Что входит в Summarize
Проект объединяет несколько способов работы:
- CLI принимает URL, путь к локальному файлу или данные из стандартного ввода;
- Chrome Side Panel показывает саммари текущей вкладки в боковой панели;
- Firefox Sidebar предоставляет похожий сценарий в постоянной боковой панели;
- локальный демон расширяет возможности браузера: подключает общий конвейер CLI, нативные медиасредства, OCR и инструменты для журналов и процессов.
CLI поддерживает веб-страницы, PDF, изображения, текстовые документы, аудио, видео, YouTube и подкасты. Обычная обработка включает получение и очистку содержимого, поиск доступного транскрипта или создание транскрипта для медиа и генерацию результата выбранной моделью.
Для сайтов с заблокированным или слишком коротким локальным извлечением можно включить Firecrawl в режиме auto. Для этого нужен FIRECRAWL_API_KEY.
Установка и первый запуск CLI
Установите пакет через npm:
npm i -g @steipete/summarizeНа macOS и Linux доступна установка через Homebrew:
brew install summarizeМинимальные примеры:
# Саммари веб-страницы
summarize https://example.com/article
# Обработка YouTube
summarize https://youtu.be/... --youtube auto
# Саммари локального PDF выбранной моделью
summarize ./report.pdf --model openai/gpt-5-mini
# Длина результата: пресет или числовой предел
summarize https://example.com --length long
summarize https://example.com --length 20kВстроенная длина по умолчанию — long. Доступны short, medium, long, xl, xxl, сокращения s, m, l и числовой предел вроде 20k.
Извлечение текста и управление результатом
Флаг --extract выводит очищенное содержимое без этапа суммаризации:
summarize https://example.com --extract
summarize https://example.com --extract --format mdДля URL формат Markdown используется в режиме извлечения по умолчанию. Стандартный ввод поддерживается при создании саммари, но недоступен с --extract.
--extract отключает этап суммаризации, но не гарантирует полностью автономную обработку.Полезные параметры CLI:
| Параметр | Что делает | Пример |
--json | Возвращает структурированный JSON и отключает потоковый вывод | summarize URL --json |
--metrics | Управляет метриками в режиме off, on или detailed | summarize URL --metrics detailed |
--format | Выбирает text или md для извлечения и подготовки файлов | summarize URL --extract --format md |
--firecrawl | Управляет резервным извлечением: off, auto, always | summarize URL --firecrawl auto |
--max-extract-characters | Ограничивает число символов в режиме --extract; по умолчанию лимита нет | summarize URL --extract --max-extract-characters 50000 |
--max-output-tokens | Задаёт жёсткий лимит ответа модели | summarize URL --max-output-tokens 2k |
--timeout | Ограничивает весь конвейер; значение по умолчанию — 2m | summarize URL --timeout 90s |
--no-cache | Обходит кэш саммари, сохраняя кэши медиа и транскриптов | summarize URL --no-cache |
--json удобен для скриптов и агентов, а --extract — когда следующему этапу нужен исходный очищенный материал.
YouTube, подкасты и слайды
Для YouTube и медиа сначала проверяются доступные транскрипты или субтитры. Если их недостаточно, запускается транскрибация. При режиме auto порядок зависит от конфигурации: при наличии ключа сначала используется Groq, затем локальные ONNX/whisper.cpp и облачные резервные варианты.
Основные возможности:
- выбор YouTube-режима через
--youtube auto|web|apify|yt-dlp|no-auto; - выбор транскрибатора через
--transcriber auto|whisper|parakeet|canary; - добавление таймкодов через
--timestamps; - транскрибация YouTube, локального и прямого аудио или видео;
- диаризация, то есть разделение речи по спикерам, через
--diarize; - извлечение слайдов из YouTube, прямого видео или локального файла через
--slides; - OCR слайдов через
--slides-ocr, если установлен Tesseract.
Пример полного транскрипта со слайдами:
summarize https://youtu.be/... --slides --extractПо умолчанию извлекается до шести слайдов. Для изменения лимита используйте --slides-max.
Расширение для Chrome и Firefox
Расширение показывает потоковое Markdown-саммари текущей вкладки и умеет автоматически запускать обработку при навигации, пока панель открыта и включён автоматический режим. Для страниц с медиа можно выбрать обработку страницы или видео и включить слайды.
В актуальной версии роли режимов разделены между подключением к ИИ и средой обработки медиа:
- Direct — расширение напрямую обращается к настроенному провайдеру. Ключи хранятся в локальном хранилище расширения;
- Browser — браузер локально обрабатывает поддерживаемое медиа через MediaBunny, WebCodecs и загружаемую по требованию модель Whisper Tiny;
- Daemon — расширение использует локальный сервис Summarize для более широкой поддержки медиа, OCR, CLI-резервов и инструментов диагностики.
В Direct-режиме auto использует настроенного провайдера. Если провайдер не настроен, расширение пробует Gemini Nano при его доступности, затем извлекающий резервный режим. Чат доступен при настроенном Direct-провайдере или подключённом демоне.
Подключение локального демона
Панель генерирует токен и показывает команду установки. Стандартный порт — 8787:
summarize daemon install --token --port 8787
summarize daemon statusДемон слушает только 127.0.0.1 и требует bearer-токен. В Chrome связь в режиме Daemon проходит через опциональный Native Messaging host, привязанный к идентификатору расширения из Chrome Web Store. Firefox сохраняет loopback-интеграцию.
Если выбран другой порт, укажите то же значение в Options → Runtime → Daemon → Port. После обновления CLI или конфигурации демон можно перезапустить:
summarize daemon restartМодели и способы подключения
CLI принимает идентификаторы моделей с префиксами провайдеров, включая OpenAI, Anthropic, Google, OpenRouter, xAI, NVIDIA, MiniMax, Z.AI и GitHub Copilot. Поддерживаются также авторизованные CLI-провайдеры, среди которых Claude, Gemini, Codex, Copilot и Pi.
В расширении Direct-режим поддерживает облачные и OpenAI-совместимые подключения, включая локальные шлюзы вроде Ollama. Конкретная доступность модели зависит от выбранного провайдера, учётных данных, базового URL и возможностей среды.
Режим --model auto является значением по умолчанию. Для воспроизводимого конвейера лучше задавать конкретный идентификатор модели и отдельно ограничивать длину и число выходных токенов.
Полезные сценарии
Быстрый отбор материалов для чтения
Исходные данные: список публичных статей. Запустите короткое саммари для каждой ссылки и сохраните JSON для последующей сортировки:
summarize https://example.com/article --length short --json > result.jsonНаблюдаемый результат — структурированный JSON-конверт с результатом и метриками. Сценарий помогает провести первичный отбор, но не заменяет проверку важных выводов по оригиналу.
Подготовка текста для AI-агента
Исходные данные: URL страницы, содержимое которой нужно передать следующему этапу в очищенном виде.
summarize https://example.com/article --extract --format mdНаблюдаемый результат — очищенный Markdown. На защищённых или динамических сайтах локальное извлечение может оказаться неполным; в таком случае потребуется настроенный Firecrawl с ключом или другой разрешённый способ получения содержимого.
Разбор длинного видео
Исходные данные: YouTube-ссылка с субтитрами либо доступным аудио.
summarize https://youtu.be/... --timestamps --length longНаблюдаемый результат — саммари с таймкодами, если источник транскрипта сохранил временные метки. Видео без субтитров потребует настроенного локального или облачного транскрибатора.
Проверка результата и ограничения
После установки CLI проверьте версию:
summarize --versionДля демона используйте:
summarize daemon statusДля режима Daemon признаком успешного подключения служит положительная проверка сервиса, конечной точки здоровья и, для Chrome, регистрации Native Messaging host. При нестандартном порте проверьте, что значение в настройках расширения совпадает с конфигурацией демона.
При оценке саммари:
- сопоставьте ключевые тезисы с оригиналом;
- проверьте числа, цитаты и выводы, влияющие на решение;
- учитывайте, что качество зависит от извлечённого текста, транскрипта и выбранной модели;
- не считайте успешное выполнение команды доказательством точности содержания.
Это руководство основано на официальных источниках; описанные команды не заявлены как лично протестированные автором материала.
Официальные ссылки
- Репозиторий Summarize
- Официальная документация
- Справочник команды
summarize - Руководство по расширению
- Справочник локального демона
- Релизы на GitHub
Следующий шаг
Open WebUI — собственный интерфейс для любых языковых моделей
Связанные материалы
- Статья: NotebookLM: полный гид по инструменту, который все недооценивают
- Блог: Лучший способ освоить агентный кодинг — заставить ИИ научить вас
- База знаний: Brave Search API — поисковый API для AI-агентов
Если вы собираете собственный контур обработки контента, сравнение локального и облачного запуска помогает заранее определить требования к приватности, качеству транскрипции и автоматизации.
Если захотите обсудить, как это применить у себя или в команде — пишите в Telegram @pimenov
Если хотите разобрать свою задачу — напишите мне Если хотите разобрать свою задачу — напишите мне.
Можно прийти с идеей, черновым контекстом или уже живой задачей. Помогу быстро понять, где реальный следующий шаг, а где лишний шум.
Обычно хватает 2–3 сообщений, чтобы понять, могу ли я здесь реально помочь и в каком формате лучше двигаться дальше.
Дальше по теме
Консультации, аудит процессов, работа с контентом и сайтами, сессии для команд и решения под конкретную задачу.