BD safety-guard
Защита от деструктивных операций в трех режимах: Careful перехватывает опасные команды (rm -rf, git push --force, DROP TABLE) для подтверждения, Freeze блокирует запись в один каталог, а Guard объединяет оба режима через хуки PreToolUse. Используйте при работе с производственными системами, автономном запуске агентов, ограничении редактирования каталога или во время миграций, развертываний и изменений данных.
машинный переводПоказать оригиналСкрыть оригинал«Guard against destructive operations with three modes: Careful interce…»
Guard against destructive operations with three modes: Careful intercepts dangerous commands (rm -rf, git push --force, DROP TABLE) for confirmation, Freeze locks writes to one directory, and Guard combines both via PreToolUse hooks. Use when working on production systems, running agents autonomously, restricting edits to a directory, or during migrations, deploys, and data changes.
Скилл обещает три режима защиты: Careful перехватывает опасные команды (rm -rf, DROP TABLE, git push --force) и требует подтверждения, Freeze блокирует запись в выбранную папку, Guard объединяет оба через PreToolUse хуки. В файлах — одна инструкция на 441 токен, без скриптов и критических ошибок. Safety-score 98, quality 84, но process всего 45 — значит, логика проверки команд может быть неполной или документирована слабо.
На моделях не тестировалось. Находки — две проблемы средней и низкой серьёзности, что указывает на пробелы в реализации. Для production-систем и автономных агентов скилл обещает нужное, но без прогона на реальных сценариях остаётся неясно, поймёт ли он все вариации опасных команд или пропустит экзотический синтаксис. Ставить, если готовы проверить его поведение перед боевым использованием.
Защита от деструктивных операций в трех режимах: Careful перехватывает опасные команды (rm -rf, git push --force, DROP TABLE) для подтверждения, Freeze…
Как процесс D 45/100 · Процесс не доведён — слабые места: результат и критерий готовности, когда включается, входы и предусловия
Как улучшить
- Свои кейсы (evals/evals.json, 4–6 реальных запросов с ожидаемыми ответами): тогда полная проверка прогонит именно их, а не черновик от модели.
- spec.yaml с триггерными фразами и утверждениями — контракт поведения для CI; `skilltest init` создаст шаблон.
Находки guard · 2
✓ Критических и высоких находок нет
Средние и низкие: 2
-
низкая Опасные команды
cmd-privilegeSKILL.md:34Повышение привилегий / права на запись для всех (документация security-скилла)- chmod 777
security-скилл -
низкая Опасные команды
cmd-privilegeSKILL.md:35Повышение привилегий / права на запись для всех (документация security-скилла)- sudo rm
security-скилл
Просканировано файлов: 1. Улики замаскированы. Пометки в серых чипах объясняют, почему серьёзность понижена.
По спецификации Agent Skills
✓ По спецификации Agent Skills замечаний нет
Процессный рейтинг: все десять параметров 45/100
- 0Результат и критерий готовности. Не сказано, что считать результатом
- 0Входы и предусловия. Не сказано, что нужно иметь на входе
- 0Ошибки и развилки. Линейный процесс без обработки сбоев
- 20Когда включается. Не сказано, при каком запросе скилл включается
- 30Повторный запуск. Изменяющих операций: 1, без проверки текущего состояния
- 60Инструменты и файлы. Используются инструменты (bash), но во frontmatter они не объявлены
- 100Шаги. Шагов: 7
- 100Согласованность. Имя и обязательные поля на месте
- 100Стоимость исполнения. Тело инструкции 441 токенов
- 100Отчётность по ходу. Скилл сообщает о ходе работы
- medium Правила безопасности и запреты внутри скилла: их место в системном промпте, здесь они не защищают
Всё перечисленное измерено по тексту скилла, а не оценено моделью: цифры проверяемы. Вес параметра тем больше, чем чаще из-за него процесс встаёт.
Сигналы качества
- +5В description нет примеров фраз, по которым скилл должен срабатывать
- +4Описание не говорит, когда скилл НЕ применять (ложные срабатывания)
- +3Формат ответа не описан: модель каждый раз решает сама
- +1Лицензия не указана
- +2Инструкции на одном языке
- +3Длина description 385 символов: достаточно сигнала, не съедает бюджет
- +4Структура: 9 заголовков
- +3Пошаговые инструкции: 7 пунктов
- +4Есть примеры (4 блоков кода)
База качества 70; замечания lint вычитаются, сигналы прибавляют до 100. Итог: 84.