BC exec-guard
Интеллектуальный классификатор разрешений команд — обнаруживает опасные команды оболочки перед выполнением. Основан на Claude Code bashClassifier + yoloClassifier.
машинный переводПоказать оригиналСкрыть оригинал«Intelligent command permission classifier — detect dangerous shell com…»
Intelligent command permission classifier — detect dangerous shell commands before execution. Distilled from Claude Code bashClassifier + yoloClassifier.
Интеллектуальный классификатор разрешений команд — обнаруживает опасные команды оболочки перед выполнением.
Как процесс C 50/100 · Есть пробелы — слабые места: когда включается, входы и предусловия, ошибки и развилки
Чем это грозит
Находки средней серьёзности: скорее всего скилл честный, но прочитайте, что именно насторожило сканер.
Ниже описан худший случай для этой категории. Здесь находка средней серьёзности: guard увидел признак, но не доказательство.
Скилл содержит команды, которые удаляют файлы, переписывают диски или исполняют код, скачанный из сети. Агент может выполнить их без вопроса, если считает, что так требует инструкция.
Замените разрушительные команды на безопасные аналоги с подтверждением, ограничьте область действия конкретной папкой и не тяните код через curl | bash: укажите версию и контрольную сумму.
Как улучшить
- Свои кейсы (evals/evals.json, 4–6 реальных запросов с ожидаемыми ответами): тогда полная проверка прогонит именно их, а не черновик от модели.
- spec.yaml с триггерными фразами и утверждениями — контракт поведения для CI; `skilltest init` создаст шаблон.
Находки guard · 6
✓ Критических и высоких находок нет
Средние и низкие: 6
-
средняя Опасные команды
cmd-pipe-to-shellSKILL.md:21Скачивание и запуск удалённого кода с неизвестного хоста (pipe в shell) (документация security-скилла)- Network operation safety (curl | bash, wget | sh, etc.)
security-скилл -
низкая Опасные команды
cmd-pipe-to-shellSKILL.md:29Скачивание и запуск удалённого кода с неизвестного хоста (pipe в shell) (с отрицанием — текст это запрещает)- Network piping: curl | bash, wget | sh
с отрицанием -
низкая Опасные команды
cmd-privilegeSKILL.md:30Повышение привилегий / права на запись для всех (с отрицанием — текст это запрещает)- Permission escalation: sudo, chmod 777, su
с отрицанием -
низкая Рискованное назначение
intent-offensive-securitySKILL.md:34Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)- Reverse shell: nc -e, bash -i, /dev/tcp
Ещё 2 совпадений отнесены к цитатам в документации скилла по безопасности и не считаются находками.
Просканировано файлов: 3. Улики замаскированы. Пометки в серых чипах объясняют, почему серьёзность понижена.
По спецификации Agent Skills
✓ По спецификации Agent Skills замечаний нет
Процессный рейтинг: все десять параметров 50/100
- 0Входы и предусловия. Не сказано, что нужно иметь на входе
- 0Ошибки и развилки. Линейный процесс без обработки сбоев
- 0Отчётность по ходу. Скилл ничего не сообщает по ходу работы
- 20Когда включается. Не сказано, при каком запросе скилл включается
- 30Повторный запуск. Изменяющих операций: 4, без проверки текущего состояния
- 60Инструменты и файлы. Используются инструменты (bash, web), но во frontmatter они не объявлены
- 60Результат и критерий готовности. Формат результата описан, критерия завершения нет
- 85Шаги. Шагов: 20, расплывчатых формулировок: 3
- 100Согласованность. Имя и обязательные поля на месте
- 100Стоимость исполнения. Тело инструкции 578 токенов
Всё перечисленное измерено по тексту скилла, а не оценено моделью: цифры проверяемы. Вес параметра тем больше, чем чаще из-за него процесс встаёт.
Сигналы качества
- +5В description нет примеров фраз, по которым скилл должен срабатывать
- +4Описание не говорит, когда скилл НЕ применять (ложные срабатывания)
- -2Ссылки на localhost: у другого пользователя не заработает
- +1Лицензия не указана
- +2Инструкции на одном языке
- +3Длина description 153 символов: достаточно сигнала, не съедает бюджет
- +4Структура: 7 заголовков
- +3Пошаговые инструкции: 20 пунктов
- +3Формат ответа описан явно
- +4Есть примеры (2 блоков кода)
База качества 70; замечания lint вычитаются, сигналы прибавляют до 100. Итог: 85.