SKILLEMALL.ai

BB probe

Интеграция OWASP ZAP/Burp Suite/Nuclei, планирование тестов на проникновение, выполнение DAST и сканирование уязвимостей. Для проверки уязвимостей во время выполнения. Дополняет статический анализ Sentinel.

машинный переводПоказать оригиналСкрыть оригинал«Integrating OWASP ZAP/Burp Suite/Nuclei, planning penetration tests, e…»

Integrating OWASP ZAP/Burp Suite/Nuclei, planning penetration tests, executing DAST, and scanning for vulnerabilities. For runtime vulnerability validation. Complements Sentinel static analysis.

simota/agent-skills Agent Skills автор: simota 14 файлов тело ≈ 5 735 токенов Открыть источникgithub.com проанализирован 2 ч назад

Интеграция OWASP ZAP/Burp Suite/Nuclei, планирование тестов на проникновение, выполнение DAST и сканирование уязвимостей.

Как процесс B 72/100 · Почти готов — слабые места: входы и предусловия, повторный запуск, отчётность по ходу

ИнтеграцияKubernetesGoogle CloudAzureБезопасностьИИ и агентытип и темы размечены автоматически по тексту скилла
JSON
Технический рейтинг
B
77/100
безопасность, качество, тесты
Безопасность 60%
82
Качество 40%
69
Прогон на моделях
не было
Процессный рейтинг
B
72/100
Почти готов
Входы и предусловия вес 11
0
Отчётность по ходу вес 2
0
Повторный запуск вес 4
30
три самых слабых из десяти параметров · все десять

Как улучшить

  1. Скажите в description, КОГДА применять скилл («используй, когда…», примеры запросов): это главный сигнал для агента.
  2. Тело SKILL.md длиннее 5 000 токенов: вынесите справочные детали в references/ и подключайте по необходимости.
Для прогона на моделях — необязательно
  • Свои кейсы (evals/evals.json, 4–6 реальных запросов с ожидаемыми ответами): тогда полная проверка прогонит именно их, а не черновик от модели.
  • spec.yaml с триггерными фразами и утверждениями — контракт поведения для CI; `skilltest init` создаст шаблон.

Находки guard · 18

✓ Критических и высоких находок нет

Средние и низкие: 18
  • низкая Рискованное назначение intent-offensive-security reference/api-dast.md:51
    Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)
    | PyRIT (Microsoft) | Multi-turn / multi-modal LLM red teaming (crescendo, TAP) | Integrates with Azure AI Foundry; pairs with Burp for hybrid API + LLM tests |
  • низкая Рискованное назначение intent-offensive-security reference/pentest-methodology-pitfalls.md:1
    Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение) (тестовый файл / пример)
    # Penetration Testing Methodology Pitfalls
    тестовый файл
  • низкая Рискованное назначение intent-offensive-security reference/pentest-methodology-pitfalls.md:22
    Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение) (тестовый файл / пример)
    | `PT-06` | Skip post-exploitation thinking | Lateral movement risk stays hidden | Assess privilege escalation and impact paths safely |
    тестовый файл
  • низкая Рискованное назначение intent-offensive-security reference/pentest-methodology-pitfalls.md:41
    Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение) (тестовый файл / пример)
    | `PTES` | Lifecycle management and end-to-end pentest structure | 2014 baseline still widely cited; supplement with newer guides |
    тестовый файл
  • низкая Рискованное назначение intent-offensive-security reference/pentest-methodology-pitfalls.md:57
    Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение) (определение детектора / чёрного списка; тестовый файл / пример)
    | AI / LLM / Agent integrations | Wallarm: 2,185 AI-related vulns in 2025, **36% overlap with API vulns**; **315 MCP-related vulns** with 270% Q2→Q3 growth. Prompt injection (LLM01), indirect injectio
    детектортестовый файл
  • низкая Рискованное назначение intent-offensive-security reference/recon.md:9
    Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)
    - **Probe `recon`**: passive / low-touch recon. Output is an inventory (assets, tech, exposures, leaked secrets) — not a penetration test. No exploitation, no credential spraying, no active scanning o
  • низкая Рискованное назначение intent-offensive-security reference/recon.md:10
    Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)
    - **Breach**: full red-team engagement including initial access, lateral movement, and objective achievement. `recon` is the first phase Breach would run, broken out as an explicit standalone delivera
  • низкая Рискованное назначение intent-offensive-security reference/recon.md:12
    Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение) (определение детектора / чёрного списка)
    - **Other Probe recipes** (`zap`/`burp`/`nuclei`/`api`/`mobile`/`pentest`): active DAST. `recon` feeds them a target list; it never attacks.
    детектор
  • низкая Рискованное назначение intent-offensive-security reference/recon.md:64
    Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение) (определение детектора / чёрного списка)
    →  recommend next: `pentest` / `zap` / `api` / `mobile` for prioritized active follow-up
    детектор
  • низкая Рискованное назначение intent-offensive-security reference/recon.md:92
    Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение) (определение детектора / чёрного списка)
    - Recommend org-side rotation and MFA rollout; defer authenticated validation to a scoped `pentest` engagement.
    детектор
  • низкая Рискованное назначение intent-offensive-security reference/vulnerability-testing-patterns.md:121
    Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение) (тестовый файл / пример; в кавычках — упоминание, а не команда)
    - `pentest`: Full PLAN→REPORT engagement. Scope, authorization, threat model, attack-path chaining. Output is a complete assessment report with CVSS v4.0, SLAs, and agent handoffs.
    тестовый файлв кавычках
  • низкая Рискованное назначение intent-offensive-security reference/vulnerability-testing-patterns.md:124
    Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение) (тестовый файл / пример)
    - `recon`: Passive-by-default external attack-surface mapping. Output is an inventory, NOT a pentest — no exploitation, no auth attempts, no active vuln scans without separate written scope. Subfinder
    тестовый файл
  • низкая Рискованное назначение intent-offensive-security SKILL.md:23
    Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)
    - Breach -> Probe: Red team scenarios requiring DAST validation
  • низкая Рискованное назначение intent-offensive-security SKILL.md:39
    Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)
    Probe is the dynamic security testing specialist. Use it to prove exploitability in running systems, validate static findings from Sentinel, design penetration test plans, and produce actionable DAST 
  • низкая Рискованное назначение intent-offensive-security SKILL.md:45
    Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)
    - ZAP (v2.17.0), Burp Suite, Nuclei (v3.8.0 — pin against CVE-…405 and its GHSA follow-ups), DAST, pentesting, or runtime exploit verification. Version/tooling detail -> `reference/zap-scanning-
  • низкая Рискованное назначение intent-offensive-security SKILL.md:51
    Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)
    - Attack-path analysis — chaining identity abuse, misconfigurations, and privilege escalation into full compromise proof
  • низкая Рискованное назначение intent-offensive-security SKILL.md:59
    Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)
    - Red team scenario design or threat modeling → **Breach**

Ещё 1 совпадений отнесены к цитатам в документации скилла по безопасности и не считаются находками.

Просканировано файлов: 14. Улики замаскированы. Пометки в серых чипах объясняют, почему серьёзность понижена.

По спецификации Agent Skills

  • предупреждение description-no-when description не говорит, КОГДА применять скилл (нет "use when / используй когда")
  • предупреждение body-long тело SKILL.md ≈ 5735 токенов (рекомендуется < 5000); вынесите детали в references/

Процессный рейтинг: все десять параметров 72/100

  • 0Входы и предусловия. Не сказано, что нужно иметь на входе
  • 0Отчётность по ходу. Скилл ничего не сообщает по ходу работы
  • 30Повторный запуск. Изменяющих операций: 13, без проверки текущего состояния
  • 50Когда включается. Не сказано, при каком запросе скилл включается
  • 60Ошибки и развилки. Развилок: 2
  • 70Стоимость исполнения. Тело инструкции 5735 токенов
  • 100Инструменты и файлы. Внешние инструменты не нужны
  • 100Шаги. Шагов: 85
  • 100Результат и критерий готовности. Формат результата и критерий готовности описаны
  • 100Согласованность. Имя и обязательные поля на месте
  • medium Правила безопасности и запреты внутри скилла: их место в системном промпте, здесь они не защищают
  • low Разделов верхнего уровня: 18. Похоже на несколько доменов в одном скилле

Всё перечисленное измерено по тексту скилла, а не оценено моделью: цифры проверяемы. Вес параметра тем больше, чем чаще из-за него процесс встаёт.

Сигналы качества

  • +5В description нет примеров фраз, по которым скилл должен срабатывать
  • +4Описание не говорит, когда скилл НЕ применять (ложные срабатывания)
  • +1Лицензия не указана
  • +2Инструкции на одном языке
  • +3Длина description 194 символов: достаточно сигнала, не съедает бюджет
  • +4Структура: 24 заголовков
  • +3Пошаговые инструкции: 85 пунктов
  • +3Формат ответа описан явно
  • +4Есть примеры (2 блоков кода)
  • +4Справочные файлы упоминаются в инструкциях (13 из 13)

База качества 70; замечания lint вычитаются, сигналы прибавляют до 100. Итог: 69.