pimenov.ai

База знаний

Summarize — CLI и расширение Chrome для быстрых саммари из любых источников

Открытый инструмент для извлечения и суммаризации контента из URL, YouTube, подкастов, PDF и локальных файлов — через терминал или боковую панель браузера.

Опубликовано Обновлено

Summarize превращает веб-страницы, YouTube-видео, подкасты, PDF и локальные файлы в структурированные саммари или очищенный текст. Инструмент подходит для ручной работы через браузер и автоматизации через командную строку.

Актуальность проверена 8 сентября 2026 года по официальной документации и релизам. Последний опубликованный релиз — 0.21.13, репозиторий насчитывает около 6,6 тысячи звёзд.

Содержание

  1. Что входит в Summarize
  2. Установка и первый запуск CLI
  3. Извлечение текста и управление результатом
  4. YouTube, подкасты и слайды
  5. Расширение для Chrome и Firefox
  6. Модели и способы подключения
  7. Полезные сценарии
  8. Проверка результата и ограничения

Что входит в Summarize

Проект объединяет несколько способов работы:

  • CLI принимает URL, путь к локальному файлу или данные из стандартного ввода;
  • Chrome Side Panel показывает саммари текущей вкладки в боковой панели;
  • Firefox Sidebar предоставляет похожий сценарий в постоянной боковой панели;
  • локальный демон расширяет возможности браузера: подключает общий конвейер CLI, нативные медиасредства, OCR и инструменты для журналов и процессов.

CLI поддерживает веб-страницы, PDF, изображения, текстовые документы, аудио, видео, YouTube и подкасты. Обычная обработка включает получение и очистку содержимого, поиск доступного транскрипта или создание транскрипта для медиа и генерацию результата выбранной моделью.

Для сайтов с заблокированным или слишком коротким локальным извлечением можно включить Firecrawl в режиме auto. Для этого нужен FIRECRAWL_API_KEY.

Установка и первый запуск CLI

Установите пакет через npm:

npm i -g @steipete/summarize

На macOS и Linux доступна установка через Homebrew:

brew install summarize

Минимальные примеры:

# Саммари веб-страницы
summarize https://example.com/article

# Обработка YouTube
summarize https://youtu.be/... --youtube auto

# Саммари локального PDF выбранной моделью
summarize ./report.pdf --model openai/gpt-5-mini

# Длина результата: пресет или числовой предел
summarize https://example.com --length long
summarize https://example.com --length 20k

Встроенная длина по умолчанию — long. Доступны short, medium, long, xl, xxl, сокращения s, m, l и числовой предел вроде 20k.

Извлечение текста и управление результатом

Флаг --extract выводит очищенное содержимое без этапа суммаризации:

summarize https://example.com --extract
summarize https://example.com --extract --format md

Для URL формат Markdown используется в режиме извлечения по умолчанию. Стандартный ввод поддерживается при создании саммари, но недоступен с --extract.

💡
Ограничение: извлечение может использовать настроенные удалённые средства транскрибации, OCR или форматирования Markdown для медиа и PDF. Поэтому --extract отключает этап суммаризации, но не гарантирует полностью автономную обработку.

Полезные параметры CLI:

ПараметрЧто делаетПример
--jsonВозвращает структурированный JSON и отключает потоковый выводsummarize URL --json
--metricsУправляет метриками в режиме off, on или detailedsummarize URL --metrics detailed
--formatВыбирает text или md для извлечения и подготовки файловsummarize URL --extract --format md
--firecrawlУправляет резервным извлечением: off, auto, alwayssummarize URL --firecrawl auto
--max-extract-charactersОграничивает число символов в режиме --extract; по умолчанию лимита нетsummarize URL --extract --max-extract-characters 50000
--max-output-tokensЗадаёт жёсткий лимит ответа моделиsummarize URL --max-output-tokens 2k
--timeoutОграничивает весь конвейер; значение по умолчанию — 2msummarize URL --timeout 90s
--no-cacheОбходит кэш саммари, сохраняя кэши медиа и транскриптовsummarize URL --no-cache

--json удобен для скриптов и агентов, а --extract — когда следующему этапу нужен исходный очищенный материал.

YouTube, подкасты и слайды

Для YouTube и медиа сначала проверяются доступные транскрипты или субтитры. Если их недостаточно, запускается транскрибация. При режиме auto порядок зависит от конфигурации: при наличии ключа сначала используется Groq, затем локальные ONNX/whisper.cpp и облачные резервные варианты.

Основные возможности:

  • выбор YouTube-режима через --youtube auto|web|apify|yt-dlp|no-auto;
  • выбор транскрибатора через --transcriber auto|whisper|parakeet|canary;
  • добавление таймкодов через --timestamps;
  • транскрибация YouTube, локального и прямого аудио или видео;
  • диаризация, то есть разделение речи по спикерам, через --diarize;
  • извлечение слайдов из YouTube, прямого видео или локального файла через --slides;
  • OCR слайдов через --slides-ocr, если установлен Tesseract.

Пример полного транскрипта со слайдами:

summarize https://youtu.be/... --slides --extract

По умолчанию извлекается до шести слайдов. Для изменения лимита используйте --slides-max.

Расширение для Chrome и Firefox

Расширение показывает потоковое Markdown-саммари текущей вкладки и умеет автоматически запускать обработку при навигации, пока панель открыта и включён автоматический режим. Для страниц с медиа можно выбрать обработку страницы или видео и включить слайды.

В актуальной версии роли режимов разделены между подключением к ИИ и средой обработки медиа:

  • Direct — расширение напрямую обращается к настроенному провайдеру. Ключи хранятся в локальном хранилище расширения;
  • Browser — браузер локально обрабатывает поддерживаемое медиа через MediaBunny, WebCodecs и загружаемую по требованию модель Whisper Tiny;
  • Daemon — расширение использует локальный сервис Summarize для более широкой поддержки медиа, OCR, CLI-резервов и инструментов диагностики.

В Direct-режиме auto использует настроенного провайдера. Если провайдер не настроен, расширение пробует Gemini Nano при его доступности, затем извлекающий резервный режим. Чат доступен при настроенном Direct-провайдере или подключённом демоне.

Подключение локального демона

Панель генерирует токен и показывает команду установки. Стандартный порт — 8787:

summarize daemon install --token --port 8787
summarize daemon status

Демон слушает только 127.0.0.1 и требует bearer-токен. В Chrome связь в режиме Daemon проходит через опциональный Native Messaging host, привязанный к идентификатору расширения из Chrome Web Store. Firefox сохраняет loopback-интеграцию.

Если выбран другой порт, укажите то же значение в Options → Runtime → Daemon → Port. После обновления CLI или конфигурации демон можно перезапустить:

summarize daemon restart
⚖️
Передача данных: облачный Direct-провайдер или модель, которую вызывает демон, получает переданные ей данные согласно своей схеме работы. Полностью локальная обработка возможна только в подходящей конфигурации с локальными средствами или поддерживаемыми браузерными моделями.

Модели и способы подключения

CLI принимает идентификаторы моделей с префиксами провайдеров, включая OpenAI, Anthropic, Google, OpenRouter, xAI, NVIDIA, MiniMax, Z.AI и GitHub Copilot. Поддерживаются также авторизованные CLI-провайдеры, среди которых Claude, Gemini, Codex, Copilot и Pi.

В расширении Direct-режим поддерживает облачные и OpenAI-совместимые подключения, включая локальные шлюзы вроде Ollama. Конкретная доступность модели зависит от выбранного провайдера, учётных данных, базового URL и возможностей среды.

Режим --model auto является значением по умолчанию. Для воспроизводимого конвейера лучше задавать конкретный идентификатор модели и отдельно ограничивать длину и число выходных токенов.

Полезные сценарии

Быстрый отбор материалов для чтения

Исходные данные: список публичных статей. Запустите короткое саммари для каждой ссылки и сохраните JSON для последующей сортировки:

summarize https://example.com/article --length short --json > result.json

Наблюдаемый результат — структурированный JSON-конверт с результатом и метриками. Сценарий помогает провести первичный отбор, но не заменяет проверку важных выводов по оригиналу.

Подготовка текста для AI-агента

Исходные данные: URL страницы, содержимое которой нужно передать следующему этапу в очищенном виде.

summarize https://example.com/article --extract --format md

Наблюдаемый результат — очищенный Markdown. На защищённых или динамических сайтах локальное извлечение может оказаться неполным; в таком случае потребуется настроенный Firecrawl с ключом или другой разрешённый способ получения содержимого.

Разбор длинного видео

Исходные данные: YouTube-ссылка с субтитрами либо доступным аудио.

summarize https://youtu.be/... --timestamps --length long

Наблюдаемый результат — саммари с таймкодами, если источник транскрипта сохранил временные метки. Видео без субтитров потребует настроенного локального или облачного транскрибатора.

Проверка результата и ограничения

После установки CLI проверьте версию:

summarize --version

Для демона используйте:

summarize daemon status

Для режима Daemon признаком успешного подключения служит положительная проверка сервиса, конечной точки здоровья и, для Chrome, регистрации Native Messaging host. При нестандартном порте проверьте, что значение в настройках расширения совпадает с конфигурацией демона.

При оценке саммари:

  • сопоставьте ключевые тезисы с оригиналом;
  • проверьте числа, цитаты и выводы, влияющие на решение;
  • учитывайте, что качество зависит от извлечённого текста, транскрипта и выбранной модели;
  • не считайте успешное выполнение команды доказательством точности содержания.

Это руководство основано на официальных источниках; описанные команды не заявлены как лично протестированные автором материала.

Официальные ссылки

Следующий шаг

Open WebUI — собственный интерфейс для любых языковых моделей

Связанные материалы

Если вы собираете собственный контур обработки контента, сравнение локального и облачного запуска помогает заранее определить требования к приватности, качеству транскрипции и автоматизации.

Если захотите обсудить, как это применить у себя или в команде — пишите в Telegram @pimenov