BC pentest-workbench
Комплексный рабочий процесс наступательной безопасности для поиска ошибок, оценки уязвимостей, тестирования на проникновение и эксплуатации. Используйте при выполнении тестов безопасности, анализе уязвимых целей, проведении повышения привилегий, создании эксплойтов или выполнении разведки. Охватывает: переполнение буфера TCP (vulnserver), тестирование веб-приложений (VulnerableWordpress/WPScan), анализ honeypot (Cowrie), повышение привилегий GTFOBins/LOLBAS, основы pwn.college и автоматизацию цепочки инструментов наступательной безопасности. Срабатывает при: запуске пентеста, эксплуатации этого, переполнении буфера, повышении привилегий, OSCP, CTF, поиске ошибок, оценке уязвимостей, rev shell, тестировании этой цели.
машинный переводПоказать оригиналСкрыть оригинал«Comprehensive offensive security workflow for bug bounty, vulnerabilit…»
Comprehensive offensive security workflow for bug bounty, vulnerability assessment, penetration testing, and exploitation. Use when performing security testing, analyzing vulnerable targets, conducting privilege escalation, building exploits, or running reconnaissance. Covers: TCP buffer overflows (vulnserver), web application testing (VulnerableWordpress/WPScan), honeypot analysis (Cowrie), GTFOBins/LOLBAS privesc, pwn.college fundamentals, and offensive toolchain automation. Triggers on: run a pentest, exploit this, buffer overflow, privesc, OSCP, CTF, bug bounty, vulnerability assessment, rev shell, test this target.
Комплексный рабочий процесс наступательной безопасности для поиска ошибок, оценки уязвимостей, тестирования на проникновение и эксплуатации.
Как процесс C 51/100 · Есть пробелы — слабые места: результат и критерий готовности, входы и предусловия, ошибки и развилки
Как улучшить
- Свои кейсы (evals/evals.json, 4–6 реальных запросов с ожидаемыми ответами): тогда полная проверка прогонит именно их, а не черновик от модели.
- spec.yaml с триггерными фразами и утверждениями — контракт поведения для CI; `skilltest init` создаст шаблон.
Находки guard · 21
✓ Критических и высоких находок нет
Средние и низкие: 21
-
низкая Рискованное назначение
intent-offensive-securityreferences/privesc.md:1Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)# Privilege Escalation Reference
-
низкая Рискованное назначение
intent-offensive-securityreferences/privesc.md:78Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)**GTFOBins search**: Filter by Function=Privilege escalation, Context=SUID
-
низкая Рискованное назначение
intent-offensive-securityreferences/privesc.md:104Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)## Windows Privilege Escalation
-
низкая Рискованное назначение
intent-offensive-securityreferences/privesc.md:108Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)- `CVE-…527` (PrintNightmare) — RCE + privesc
-
низкая Рискованное назначение
intent-offensive-securityreferences/privesc.md:155Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)## AD Privilege Escalation
-
низкая Рискованное назначение
intent-offensive-securityreferences/tools-inventory.md:14Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)| `theHarvester` | Pentest-Tools | Email/subdomain OSINT |
-
низкая Рискованное назначение
intent-offensive-securityreferences/tools-inventory.md:15Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)| `Amass` | Pentest-Tools | Subdomain enumeration |
-
низкая Рискованное назначение
intent-offensive-securityreferences/tools-inventory.md:29Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)| `XSStrike` | Pentest-Tools | XSS detection |
-
низкая Рискованное назначение
intent-offensive-securityreferences/tools-inventory.md:30Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)| `Commix` | Pentest-Tools | Command injection testing |
-
низкая Рискованное назначение
intent-offensive-securityreferences/tools-inventory.md:68Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)| `CrackMapExec` | Pentest-Tools | AD enum/attack tool |
-
низкая Рискованное назначение
intent-offensive-securityskill-card.md:2Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)Pentest Workbench guides authorized offensive security work across reconnaissance, vulnerability analysis, exploitation, privilege escalation, post-exploitation review, and documentation. <br>
-
низкая Рискованное назначение
intent-offensive-securityskill-card.md:14Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)Security practitioners, developers, and assessment teams use this skill to plan and document authorized penetration testing workflows, lab exploit development, reconnaissance, and privilege escalation
-
низкая Рискованное назначение
intent-offensive-securityskill-card.md:28Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)- [Privilege Escalation Reference](references/privesc.md) <br>
-
низкая Рискованное назначение
intent-offensive-securityskill-card.md:32Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)- [ClawHub skill page](https://clawhub.ai/mamuaminu/pentest-workbench) <br>
-
низкая Рискованное назначение
intent-offensive-securitySKILL.md:2Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)name: pentest-workbench
-
низкая Рискованное назначение
intent-offensive-securitySKILL.md:3Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение) (в кавычках — упоминание, а не команда)description: "Comprehensive offensive security workflow for bug bounty, vulnerability assessment, penetration testing, and exploitation. Use when performing security testing, analyzing vulnerable targ
в кавычках -
низкая Рискованное назначение
intent-offensive-securitySKILL.md:6Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)# Pentest Workbench
-
низкая Рискованное назначение
intent-offensive-securitySKILL.md:27Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение) (в кавычках — упоминание, а не команда)- `Pentest-Tools` (40+ categories) — scanner/framework discovery, network_enum
в кавычках -
низкая Рискованное назначение
intent-offensive-securitySKILL.md:48Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)- RCE → reverse shell via pentest-tools
Ещё 2 совпадений отнесены к цитатам в документации скилла по безопасности и не считаются находками.
Просканировано файлов: 7. Улики замаскированы. Пометки в серых чипах объясняют, почему серьёзность понижена.
По спецификации Agent Skills
✓ По спецификации Agent Skills замечаний нет
Процессный рейтинг: все десять параметров 51/100
- 0Результат и критерий готовности. Не сказано, что считать результатом
- 0Входы и предусловия. Не сказано, что нужно иметь на входе
- 0Ошибки и развилки. Линейный процесс без обработки сбоев
- 30Повторный запуск. Изменяющих операций: 1, без проверки текущего состояния
- 60Инструменты и файлы. Используются инструменты (bash), но во frontmatter они не объявлены
- 70Когда включается. Сказано, когда применять, но не сказано, когда не стоит
- 100Шаги. Шагов: 46
- 100Согласованность. Имя и обязательные поля на месте
- 100Стоимость исполнения. Тело инструкции 1030 токенов
- 100Отчётность по ходу. Скилл сообщает о ходе работы
Всё перечисленное измерено по тексту скилла, а не оценено моделью: цифры проверяемы. Вес параметра тем больше, чем чаще из-за него процесс встаёт.
Сигналы качества
- +5В description нет примеров фраз, по которым скилл должен срабатывать
- +4Описание не говорит, когда скилл НЕ применять (ложные срабатывания)
- +3Формат ответа не описан: модель каждый раз решает сама
- -32 из 2 скриптов не упомянуты в SKILL.md
- +1Лицензия не указана
- +2Инструкции на одном языке
- +3Длина description 627 символов: достаточно сигнала, не съедает бюджет
- +4Структура: 12 заголовков
- +3Пошаговые инструкции: 46 пунктов
- +4Есть примеры (1 блоков кода)
- +4Справочные файлы упоминаются в инструкциях (3 из 3)
База качества 70; замечания lint вычитаются, сигналы прибавляют до 100. Итог: 85.