pimenov.ai

Skill Doctor проверяет скиллы по реальным сессиям

Warp выпустила открытый Skill Doctor: он анализирует реальные сессии Claude Code, Codex и Warp, оценивает работу и предлагает правки к SKILL.md.

ИИ-агентыИнструментыПрактика

Скилл, то есть рабочая инструкция для ИИ-агента, может выглядеть безупречно и всё равно плохо работать. Проблема проявляется в реальных задачах: агент пропускает шаги, повторяет поиск или редко использует инструкцию.

Команда Warp выпустила Skill Doctor — открытый скилл, который превращает историю работы агента в обратную связь для инструкций. Он:

  • собирает недавние локальные сессии Claude Code, Codex и Warp;
  • оценивает ход работы и качество кода по заданным рубрикам;
  • считает долю сессий, в которых скиллы сработали;
  • готовит конкретные изменения в SKILL.md и показывает различия в формате diff.

В официальном SKILL.md указано: транскрипты остаются на компьютере, а черновики новых версий складываются отдельно. Рабочие скиллы автоматически не перезаписываются.

Инструкцию для агента стоит развивать по следам реальной работы. Skill Doctor ставит оценки по рубрикам, поэтому его правки всё равно надо читать и проверять на собственных задачах.

Практический цикл выглядит так: увидеть сбой, предложить правку и проверить её в следующих сессиях.


Следующий шаг

На pimenov.ai уже есть разбор ручного варианта такого ретроспективного аудита: Пусть Codex перепишет ваш скилл по вашим же сессиям.

Связанные материалы

Такой аудит особенно полезен командам, у которых инструкции для агентов уже стали частью ежедневного процесса и начали расходиться с реальной работой.

Если захотите обсудить, как это применить у себя или в команде — пишите в Telegram @pimenov