BD yotta-security-testing
YuanCe — дисциплинированная методология безопасного тестирования ИИ: для авторизованных целей (собственные активы / краудсорсинговое тестирование SRC / bug bounty / CTF / полигон) выполняет веб-безопасное тестирование (SQLi / XSS / SSRF / XXE / десериализация / инъекция команд / загрузка файлов / аутентификация и контроль доступа / бизнес-логика / утечка информации / небезопасная конфигурация / безопасность API + методология оценки уязвимостей и отчетов о проникновении) в четыре этапа: разведка → обнаружение → проверка → отчет, с пятью уровнями защиты Scope Guard (список авторизации scope.json + трехэтапная проверка цели + встроенный черный список + запись операций + правовая красная линия), не выдает исполняемые полезные нагрузки. Триггеры: пользователь просит провести тестирование безопасности / тестирование на проникновение / поиск уязвимостей / оценку уязвимостей для определенной цели, провести краудсорсинговое тестирование SRC или bug bounty, провести учения CTF или на полигоне (DVWA / OWASP Juice Shop / HTB / VulnHub), сгенерировать отчет об оценке уязвимостей и тестировании на проникновение; или пользователь говорит YuanCe / тестирование безопасности / проникновение / поиск уязвимостей / поиск SRC / авторизованное тестирование / протестировать этот сайт / проверка области действия и т. д. Границы (НЕ триггерить): любые неавторизованные цели отклоняются (авторизация на основе scope.json, не доверять устным заявлениям в диалоге); для SRC / реальных целей сначала подтвердите, что они находятся в пределах авторизации платформы, прежде чем тестировать; не выдавать исполняемые полезные нагрузки / обход антивируса / фишинг / шаги социальной инженерии; не инициировать активное тестирование общедоступных целей автоматически; не проводить массовое сканирование и автоматизацию эксплойтов; не заменять профессиональное тестирование на проникновение и ручную оценку.
машинный переводПоказать оригиналСкрыть оригинал«元测 —— 有纪律的 AI 安全测试方法论:对已授权目标(自有资产 / SRC 众测 / bug bounty / CTF / 靶场)按 侦…»
元测 —— 有纪律的 AI 安全测试方法论:对已授权目标(自有资产 / SRC 众测 / bug bounty / CTF / 靶场)按 侦察→发现→验证→报告 四阶段做 Web 安全测试(SQLi / XSS / SSRF / XXE / 反序列化 / 命令注入 / 文件上传 / 鉴权与访问控制 / 业务逻辑 / 信息泄露 / 不安全配置 / API 安全 + 漏洞评估与渗透报告方法论),内置 Scope Guard 五道防线(授权清单 scope.json + 目标三层判定 + 内置黑名单 + 操作留痕 + 法律红线),不输出可执行 payload。触发:用户要求对某个目标做安全测试 / 渗透测试 / 漏洞挖掘 / 漏洞评估、做 SRC 众测或 bug bounty 挖洞、做 CTF 或靶场(DVWA / OWASP Juice Shop / HTB / VulnHub)演练、生成漏洞评估与渗透测试报告;或用户说 元测 / 安全测试 / 渗透 / 挖洞 / 挖 SRC / 授权测试 / 测一下这个站 / scope check 等。边界(Do NOT trigger):无授权目标一律拒绝(授权以 scope.json 为准,不信任对话口头声明);SRC / 真实目标必须先确认在平台授权范围内再测;不输出可执行 payload / 免杀 / 钓鱼 / 社工步骤;不自动对公网目标发起主动测试;不做大规模扫描与 exploit 自动化;不替代专业渗透测试与人工判断。
YuanCe — дисциплинированная методология безопасного тестирования ИИ: для авторизованных целей (собственные активы / краудсорсинговое тестирование SRC / bug…
Как процесс D 45/100 · Процесс не доведён — слабые места: результат и критерий готовности, когда включается, входы и предусловия
Как улучшить
- Свои кейсы (evals/evals.json, 4–6 реальных запросов с ожидаемыми ответами): тогда полная проверка прогонит именно их, а не черновик от модели.
- spec.yaml с триггерными фразами и утверждениями — контракт поведения для CI; `skilltest init` создаст шаблон.
Находки guard · 22
✓ Критических и высоких находок нет
Средние и низкие: 22
-
низкая Рискованное назначение
intent-offensive-securityCHANGELOG.md:34Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)对**已授权目标**(自有资产 / SRC 众测·bug bounty / CTF·靶场 / 本地靶机)按
-
низкая Рискованное назначение
intent-offensive-securityplaybooks/00-methodology.md:3Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)> 覆盖:全流程|源域 vulnerability-assessment + pentest-reporting
-
низкая Рискованное назначение
intent-offensive-securityplaybooks/00-methodology.md:50Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)## 4. 渗透报告方法论(Pentest Report)
-
низкая Рискованное назначение
intent-offensive-securityREADME.md:13Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)<p align="center">Triggers when the user asks for security testing / penetration testing / vulnerability assessment on an
-
низкая Рискованное назначение
intent-offensive-securityREADME.md:14Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение) (определение детектора / чёрного списка)authorized target, SRC bug bounty, CTF or lab drills (DVWA / OWASP Juice Shop / HTB / VulnHub), or a vulnerability
детектор -
низкая Рискованное назначение
intent-offensive-securityREADME.md:15Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)assessment / pentest report; or says 元测 / security test / pentest / bug bounty / authorized test / scope check.</p>
-
низкая Рискованное назначение
intent-offensive-securityREADME.md:44Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение) (определение детектора / чёрного списка)HTB, VulnHub) *and* authorized real targets / SRC bug bounty; real targets must be registered in `scope.json`
детектор -
низкая Рискованное назначение
intent-offensive-securityREADME.md:70Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)| 00 | Vulnerability assessment & pentest report methodology | Four stages + report template + SRC practice | Full workflow |
-
низкая Рискованное назначение
intent-offensive-securityREADME.zh-CN.md:10Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)<b>侦察 → 发现 → 验证 → 报告</b> 四阶段,对<b>已授权目标</b>(自有资产 / SRC 众测·bug bounty 授权范围 /
-
низкая Рискованное назначение
intent-offensive-securityREADME.zh-CN.md:12Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)<p align="center">触发场景:用户要求对已授权目标做安全测试 / 渗透测试 / 漏洞评估、挖 SRC 众测或 bug bounty、
-
низкая Рискованное назначение
intent-offensive-securityREADME.zh-CN.md:102Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)# 2) 添加授权目标(本地靶场 / CTF / bug bounty / 自有资产 / 显式授权)
-
низкая Рискованное назначение
intent-offensive-securityreferences/faq.md:19Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)未授权公网目标默认拒绝(exit 1),SRC/bug bounty 目标必须先在平台页面确认范围,再用 `scope add --type bug-bounty --target ...` 登记后才测;每轮只测授权范围内的资产。
-
низкая Рискованное назначение
intent-offensive-securityreferences/report-template.md:5Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)> 适用:内部漏洞评估报告;SRC / bug bounty 平台提交稿(按平台模板字段映射)。
-
низкая Рискованное назначение
intent-offensive-securityreferences/tutorial.md:29Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)# SRC / bug bounty 平台授权范围(以平台 scope 页面为准)
-
низкая Секреты в коде
secret-password-literalscripts/test_yotta_security_testing.py:428Захардкоженный пароль / ключ (возможно, пример) (тестовый файл / пример; в кавычках — упоминание, а не команда)"evidence": "payload 返回 500;cookie=session=abc123; password=supe…123",
тестовый файлв кавычках -
низкая Секреты в коде
secret-password-literalscripts/test_yotta_security_testing.py:519Захардкоженный пароль / ключ (возможно, пример) (тестовый файл / пример; в кавычках — упоминание, а не команда)"supe…t99" not in yst.redact_text("password=supe…t99")тестовый файлв кавычках -
низкая Секреты в коде
secret-password-literalscripts/test_yotta_security_testing.py:521Захардкоженный пароль / ключ (возможно, пример) (тестовый файл / пример; в кавычках — упоминание, а не команда)yst.redact_text("password=supe…t99"))тестовый файлв кавычках -
низкая Секреты в коде
secret-password-literalscripts/test_yotta_security_testing.py:523Захардкоженный пароль / ключ (возможно, пример) (тестовый файл / пример; в кавычках — упоминание, а не команда)yst.redact_text("api_key=tok1…789"))тестовый файлв кавычках -
низкая Рискованное назначение
intent-offensive-securitySKILL.md:4Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)description: 元测 —— 有纪律的 AI 安全测试方法论:对已授权目标(自有资产 / SRC 众测 / bug bounty / CTF / 靶场)按 侦察→发现→验证→报告 四阶段做 Web 安全测试(SQLi / XSS / SSRF / XXE / 反序列化 / 命令注入 / 文件上传 / 鉴权与访问控制 / 业务逻辑 / 信息泄露 / 不安全配置 / API 安全 + 漏洞评估
-
низкая Рискованное назначение
intent-offensive-securitySKILL.md:30Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)- 对**已授权目标**做 Web 安全测试:自有资产、SRC 众测 / bug bounty 平台授权范围(补天 / 漏洞盒子 / 教育 SRC / HackerOne / Bugcrowd 等)、CTF / 靶场平台、本地靶机;
-
низкая Рискованное назначение
intent-offensive-securitySKILL.md:45Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)# 2) 添加授权目标(本地靶场 / CTF / bug bounty / 自有资产 / 显式授权)
-
низкая Рискованное назначение
intent-offensive-securitySKILL.md:102Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)- 仅对**已授权目标**使用:自有资产 / SRC·bug bounty 平台授权范围 / CTF·靶场平台 / 本地靶机。
Просканировано файлов: 27. Улики замаскированы. Пометки в серых чипах объясняют, почему серьёзность понижена.
По спецификации Agent Skills
✓ По спецификации Agent Skills замечаний нет
Процессный рейтинг: все десять параметров 45/100
- 0Результат и критерий готовности. Не сказано, что считать результатом
- 0Входы и предусловия. Не сказано, что нужно иметь на входе
- 0Ошибки и развилки. Линейный процесс без обработки сбоев
- 20Когда включается. Не сказано, при каком запросе скилл включается
- 30Повторный запуск. Изменяющих операций: 1, без проверки текущего состояния
- 60Инструменты и файлы. Используются инструменты (python), но во frontmatter они не объявлены
- 100Шаги. Шагов: 28
- 100Согласованность. Имя и обязательные поля на месте
- 100Стоимость исполнения. Тело инструкции 1215 токенов
- 100Отчётность по ходу. Скилл сообщает о ходе работы
- low Разделов верхнего уровня: 10. Похоже на несколько доменов в одном скилле
Всё перечисленное измерено по тексту скилла, а не оценено моделью: цифры проверяемы. Вес параметра тем больше, чем чаще из-за него процесс встаёт.
Сигналы качества
- +5В description нет примеров фраз, по которым скилл должен срабатывать
- +4Описание не говорит, когда скилл НЕ применять (ложные срабатывания)
- +3Формат ответа не описан: модель каждый раз решает сама
- -2Ссылки на localhost: у другого пользователя не заработает
- -31 из 2 скриптов не упомянуты в SKILL.md
- +2Инструкции на одном языке
- +3Длина description 642 символов: достаточно сигнала, не съедает бюджет
- +4Структура: 11 заголовков
- +3Пошаговые инструкции: 28 пунктов
- +4Есть примеры (1 блоков кода)
- +4Справочные файлы упоминаются в инструкциях (3 из 3)
- +1Лицензия указана
База качества 70; замечания lint вычитаются, сигналы прибавляют до 100. Итог: 84.