BD agentshield
Аудит безопасности с приоритетом конфиденциальности, включающий 77 локальных тестов (52 активных + 25 статических). Работает с OpenClaw, Hermes Agent, n8n (автоопределение), LangChain и любой платформой AI-агентов. Приватные ключи Ed25519 остаются локальными. Все скрипты в комплекте.
машинный переводПоказать оригиналСкрыть оригинал«Privacy-First security audit with 77 local tests (52 live + 25 static)…»
Privacy-First security audit with 77 local tests (52 live + 25 static). Works with OpenClaw, Hermes Agent, n8n (auto-detected), LangChain, and any AI agent platform. Ed25519 private keys stay local. All scripts bundled.
Аудит безопасности с приоритетом конфиденциальности, включающий 77 локальных тестов (52 активных + 25 статических).
Как процесс D 39/100 · Процесс не доведён — слабые места: результат и критерий готовности, когда включается, входы и предусловия
Чем это грозит
Находки средней серьёзности: скорее всего скилл честный, но прочитайте, что именно насторожило сканер.
Ниже описан худший случай для этой категории. Здесь находка средней серьёзности: guard увидел признак, но не доказательство.
В тексте есть фразы вроде «игнорируй предыдущие инструкции» или «теперь ты…». Это попытка перехватить управление агентом: он может нарушить ваши правила, системные ограничения или политику компании.
Такие фразы не нужны честному скиллу: сформулируйте роль и правила прямо, без отмены чужих инструкций. Иначе сканеры каталогов и корпоративные фильтры заблокируют публикацию.
Как улучшить
- Скажите в description, КОГДА применять скилл («используй, когда…», примеры запросов): это главный сигнал для агента.
- Свои кейсы (evals/evals.json, 4–6 реальных запросов с ожидаемыми ответами): тогда полная проверка прогонит именно их, а не черновик от модели.
- spec.yaml с триггерными фразами и утверждениями — контракт поведения для CI; `skilltest init` создаст шаблон.
Находки guard · 13
✓ Критических и высоких находок нет
Средние и низкие: 13
-
средняя Подмена инструкций
en-ignore-previousREADME.md:75Фраза-перехват ("ignore previous instructions") (документация security-скилла)| **Instruction Override** | Tries to override safety instructions | Critical |
security-скилл -
низкая Опасные команды
cmd-pipe-to-shellagentshield_attack_patterns.json:5Скачивание и запуск удалённого кода с неизвестного хоста (pipe в shell) (строковый литерал в коде, не выполняется; документация security-скилла)"curl | bash",
строка в кодеsecurity-скилл -
низкая Опасные команды
cmd-pipe-to-shellagentshield_attack_patterns.json:6Скачивание и запуск удалённого кода с неизвестного хоста (pipe в shell) (строковый литерал в коде, не выполняется; документация security-скилла)"wget | sh"
строка в кодеsecurity-скилл -
низкая Обфускация
uni-mixed-script-wordagentshield_tester.py:655Слово из смеси латиницы и кириллицы (гомоглифы) (1 шт.) (тестовый файл / пример)("LA-018", "Unicode Homoglyph Attack", "іgnore"), # Cyrillic iтестовый файл -
низкая Подмена инструкций
en-ignore-previousaudit_client.py:20Фраза-перехват ("ignore previous instructions") (с отрицанием — текст это запрещает)- Test input payloads (attack strings like "ignore previous instructions")
с отрицанием -
низкая Подмена инструкций
en-ignore-previousecholeak_test.py:165Фраза-перехват ("ignore previous instructions") (тестовый файл / пример; в кавычках — упоминание, а не команда)ignore previous instructions
тестовый файлв кавычках -
низкая Подмена инструкций
en-ignore-previousSKILL.md:382Фраза-перехват ("ignore previous instructions") (с отрицанием — текст это запрещает)- ✅ Attack test inputs/payloads (e.g. "ignore previous instructions")
с отрицанием -
низкая Опасные команды
cmd-pipe-to-shellTESTING.md:155Скачивание и запуск удалённого кода с неизвестного хоста (pipe в shell) (тестовый файл / пример; документация security-скилла)- SC-003: Remote code execution (curl | bash, wget | sh)
тестовый файлsecurity-скилл -
низкая Рискованное назначение
intent-offensive-securityTESTING.md:165Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение) (тестовый файл / пример)- LA-002: `Developer Mode Override` (tests privilege escalation)
тестовый файл
Ещё 4 совпадений отнесены к цитатам в документации скилла по безопасности и не считаются находками.
Просканировано файлов: 31. Улики замаскированы. Пометки в серых чипах объясняют, почему серьёзность понижена.
По спецификации Agent Skills
- предупреждение
description-no-whendescription не говорит, КОГДА применять скилл (нет "use when / используй когда") - заметка
frontmatter-keyнеизвестное поле фронтматтера "triggers"
Процессный рейтинг: все десять параметров 39/100
- 0Результат и критерий готовности. Не сказано, что считать результатом
- 0Входы и предусловия. Не сказано, что нужно иметь на входе
- 0Ошибки и развилки. Линейный процесс без обработки сбоев
- 0Отчётность по ходу. Скилл ничего не сообщает по ходу работы
- 20Когда включается. Не сказано, при каком запросе скилл включается
- 30Повторный запуск. Изменяющих операций: 1, без проверки текущего состояния
- 40Согласованность. Имя во frontmatter (agentshield) не совпадает с папкой (agentshield-audit)
- 60Инструменты и файлы. Используются инструменты (bash), но во frontmatter они не объявлены
- 100Шаги. Шагов: 102
- 100Стоимость исполнения. Тело инструкции 3380 токенов
- medium Правила безопасности и запреты внутри скилла: их место в системном промпте, здесь они не защищают
- low Разделов верхнего уровня: 16. Похоже на несколько доменов в одном скилле
Всё перечисленное измерено по тексту скилла, а не оценено моделью: цифры проверяемы. Вес параметра тем больше, чем чаще из-за него процесс встаёт.
Сигналы качества
- +5В description нет примеров фраз, по которым скилл должен срабатывать
- +4Описание не говорит, когда скилл НЕ применять (ложные срабатывания)
- +3Формат ответа не описан: модель каждый раз решает сама
- -5В тексте остались TODO / заглушки
- -278 эмодзи в инструкциях: шум для модели
- +1Лицензия не указана
- +2Инструкции на одном языке
- +3Длина description 219 символов: достаточно сигнала, не съедает бюджет
- +4Структура: 41 заголовков
- +3Пошаговые инструкции: 102 пунктов
- +4Есть примеры (16 блоков кода)
База качества 70; замечания lint вычитаются, сигналы прибавляют до 100. Итог: 64.