CC breach
Разработка сценариев атак red team, моделей угроз, приложений MITRE ATT&CK/OWASP, упражнений Purple Team и red teaming для ИИ/LLM. Используйте, когда требуется проверка безопасности с точки зрения противника.
машинный переводПоказать оригиналСкрыть оригинал«Designing red team attack scenarios, threat models, MITRE ATT&CK/OWASP…»
Designing red team attack scenarios, threat models, MITRE ATT&CK/OWASP application, Purple Team exercises, and AI/LLM red teaming. Use when adversarial security validation is needed.
Разработка сценариев атак red team, моделей угроз, приложений MITRE ATT&CK/OWASP, упражнений Purple Team и red teaming для ИИ/LLM.
Как процесс C 56/100 · Есть пробелы — слабые места: когда включается, входы и предусловия, ошибки и развилки
Чем это грозит
Находки средней серьёзности: скорее всего скилл честный, но прочитайте, что именно насторожило сканер.
Ниже описан худший случай для этой категории. Здесь находка средней серьёзности: guard увидел признак, но не доказательство.
В тексте есть фразы вроде «игнорируй предыдущие инструкции» или «теперь ты…». Это попытка перехватить управление агентом: он может нарушить ваши правила, системные ограничения или политику компании.
Такие фразы не нужны честному скиллу: сформулируйте роль и правила прямо, без отмены чужих инструкций. Иначе сканеры каталогов и корпоративные фильтры заблокируют публикацию.
Как улучшить
- Тело SKILL.md длиннее 5 000 токенов: вынесите справочные детали в references/ и подключайте по необходимости.
- Свои кейсы (evals/evals.json, 4–6 реальных запросов с ожидаемыми ответами): тогда полная проверка прогонит именно их, а не черновик от модели.
- spec.yaml с триггерными фразами и утверждениями — контракт поведения для CI; `skilltest init` создаст шаблон.
Находки guard · 29
✓ Критических и высоких находок нет
Средние и низкие: 29
-
средняя Подмена инструкций
en-fake-system-promptreference/ai-red-teaming.md:84Поддельный системный промпт внутри контента (документация security-скилла)Category: System Prompt Override
security-скилл -
низкая Рискованное назначение
intent-offensive-securityreference/ai-red-teaming.md:1Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)# AI/LLM Red Teaming Reference
-
низкая Рискованное назначение
intent-offensive-securityreference/ai-red-teaming.md:4Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)**Read when:** Red teaming AI-powered systems including LLMs, RAG, and agentic applications.
-
низкая Рискованное назначение
intent-offensive-securityreference/ai-red-teaming.md:25Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)| LLM06 | **Excessive Agency** | Abuse over-permissioned tool access | Privilege escalation via tools, unintended action execution |
-
низкая Рискованное назначение
intent-offensive-securityreference/ai-red-teaming.md:119Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)## AI Red Team Assessment Template
-
низкая Рискованное назначение
intent-offensive-securityreference/ai-red-teaming.md:122Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)## AI Red Team Assessment: [System Name]
-
низкая Рискованное назначение
intent-offensive-securityreference/attack-playbooks.md:13Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)| A01 | Broken Access Control | IDOR, forced browsing, privilege escalation, JWT manipulation | Enumerate resources with different auth levels; test horizontal/vertical access |
-
низкая Рискованное назначение
intent-offensive-securityreference/attack-playbooks.md:52Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)| Privilege Escalation | T1068 Exploitation, T1548 Abuse Elevation Control | Kernel exploits, sudo misconfig |
-
низкая Рискованное назначение
intent-offensive-securityreference/attack-playbooks.md:54Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)| Credential Access | T1110 Brute Force, T1003 OS Credential Dumping | Password spraying, hash extraction |
-
низкая Рискованное назначение
intent-offensive-securityreference/attack-playbooks.md:55Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)| Lateral Movement | T1021 Remote Services, T1080 Taint Shared Content | SSH pivoting, shared drive abuse |
-
низкая Рискованное назначение
intent-offensive-securityreference/attack-playbooks.md:94Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)### Red Team Actions
-
низкая Рискованное назначение
intent-offensive-securityreference/phishing-campaign-design.md:1Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)# Phishing Campaign Design Reference
-
низкая Рискованное назначение
intent-offensive-securityreference/phishing-campaign-design.md:3Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)Purpose: Design an authorized phishing campaign that measures real organizational susceptibility, exercises the detection and reporting loop, and produces awareness-training input — without exposing p
-
низкая Рискованное назначение
intent-offensive-securityreference/phishing-campaign-design.md:9Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)- **Probe (elsewhere)**: DAST / penetration testing of the landing-page infrastructure itself. Not the social pretext.
-
низкая Рискованное назначение
intent-offensive-securityreference/recipes-index.md:14Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение) (строка таблицы в документации)| Attack Scenario | `scenario` | ✓ | Attack scenario and kill-chain design — signals `attack scenario` / `kill chain` / `pentest plan` / `WAF bypass` / `control validation` | `reference/attack-playboo
таблица -
низкая Рискованное назначение
intent-offensive-securityreference/recipes-index.md:17Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)| AI/LLM Red Team | `ai-red` | | AI/LLM red team — signals `prompt injection` / `jailbreak` / `agentic risk` / `RAG poisoning` / `prompt leakage` / `MAESTRO` / `agent skill` / `tool registry`. Multi-t
-
низкая Рискованное назначение
intent-offensive-securityreference/recipes-index.md:18Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)| Phishing Campaign | `phishing` | | Authorized campaign design — pretexting, landing-page clones, MFA fatigue, quishing, OAuth consent phishing, SPF/DKIM/DMARC evasion, awareness-training integration
-
низкая Рискованное назначение
intent-offensive-securityreference/supply-chain-attack-design.md:63Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)Mitigation guidance the red team should expect to validate:
-
низкая Рискованное назначение
intent-offensive-securityreference/threat-modeling.md:142Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)| Privilege Escalation | T1068 | Exploitation for Privilege Escalation | [H/M/L] | [H/M/L] |
-
низкая Рискованное назначение
intent-offensive-securityreference/threat-modeling.md:145Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)| Lateral Movement | T1021 | Remote Services | [H/M/L] | [H/M/L] |
-
низкая Рискованное назначение
intent-offensive-securityreference/threat-modeling.md:198Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение) (в кавычках — упоминание, а не команда)- question: "What is the scope of this red team assessment?"
в кавычках -
низкая Рискованное назначение
intent-offensive-securitySKILL.md:3Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение) (в кавычках — упоминание, а не команда)description: "Designing red team attack scenarios, threat models, MITRE ATT&CK/OWASP application, Purple Team exercises, and AI/LLM red teaming. Use when adversarial security validation is needed."
в кавычках -
низкая Рискованное назначение
intent-offensive-securitySKILL.md:19Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)- Probe → Breach: DAST vulnerabilities feed into exploitation chain design
-
низкая Рискованное назначение
intent-offensive-securitySKILL.md:21Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)- Oracle → Breach: AI/ML architecture provides attack surface for AI red teaming
-
низкая Рискованное назначение
intent-offensive-securitySKILL.md:39Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)Red team engineering agent that thinks like an attacker. Designs attack scenarios, builds threat models, and validates security controls through adversarial simulation. Covers traditional application
-
низкая Рискованное назначение
intent-offensive-securitySKILL.md:52Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)- AI/LLM red teaming (prompt injection, jailbreak, agentic risks)
Ещё 3 совпадений отнесены к цитатам в документации скилла по безопасности и не считаются находками.
Просканировано файлов: 10. Улики замаскированы. Пометки в серых чипах объясняют, почему серьёзность понижена.
По спецификации Agent Skills
- предупреждение
body-longтело SKILL.md ≈ 5721 токенов (рекомендуется < 5000); вынесите детали в references/
Процессный рейтинг: все десять параметров 56/100
- 0Входы и предусловия. Не сказано, что нужно иметь на входе
- 0Ошибки и развилки. Линейный процесс без обработки сбоев
- 0Отчётность по ходу. Скилл ничего не сообщает по ходу работы
- 20Когда включается. Не сказано, при каком запросе скилл включается
- 30Повторный запуск. Изменяющих операций: 15, без проверки текущего состояния
- 60Инструменты и файлы. Используются инструменты (bash), но во frontmatter они не объявлены
- 70Стоимость исполнения. Тело инструкции 5721 токенов
- 100Шаги. Шагов: 106
- 100Результат и критерий готовности. Формат результата и критерий готовности описаны
- 100Согласованность. Имя и обязательные поля на месте
- low Разделов верхнего уровня: 16. Похоже на несколько доменов в одном скилле
Всё перечисленное измерено по тексту скилла, а не оценено моделью: цифры проверяемы. Вес параметра тем больше, чем чаще из-за него процесс встаёт.
Сигналы качества
- +5В description нет примеров фраз, по которым скилл должен срабатывать
- +4Описание не говорит, когда скилл НЕ применять (ложные срабатывания)
- +1Лицензия не указана
- +2Инструкции на одном языке
- +3Длина description 182 символов: достаточно сигнала, не съедает бюджет
- +4Структура: 22 заголовков
- +3Пошаговые инструкции: 106 пунктов
- +3Формат ответа описан явно
- +4Есть примеры (2 блоков кода)
- +4Справочные файлы упоминаются в инструкциях (9 из 9)
База качества 70; замечания lint вычитаются, сигналы прибавляют до 100. Итог: 81.