SKILLEMALL.ai

AB red-team-my-plan

Атакуйте свой собственный план так, как это сделал бы умный противник — найдите самое слабое место, то, на что вы надеетесь, что никто не заметит, и где он ломается под давлением. Используйте при запросе «проведите репетицию этого», «атакуйте мой план», «найдите слабые места» или «где это ломается». Предоставляет враждебный разбор самых слабых мест плана, единственный ход, который противник (или реальность) сделает, чтобы его сломать, ту часть, на которую вы тихо надеетесь, что она выдержит, и исправления, которые закрывают самые большие пробелы — враждебное стресс-тестирование, проведенное вашей собственной стороной, прежде чем кто-то другой сделает это по-настоящему.

машинный переводПоказать оригиналСкрыть оригинал«Attack your own plan the way a smart adversary would — find the weakes…»

Attack your own plan the way a smart adversary would — find the weakest point, the thing you're hoping nobody notices, and where it breaks under pressure. Use when asked to red-team this, attack my plan, find the holes, or where does this break. Produces an adversarial breakdown of the plan's weakest points, the single move an opponent (or reality) would make to break it, the part you're quietly hoping holds, and the fixes that close the biggest gaps — a hostile stress-test done by your own side, before someone else does it for real.

mohitagw15856/pm-claude-skills Agent Skills автор: mohitagw15856 MIT 1 файл тело ≈ 723 токенов Открыть источникgithub.com проанализирован 2 дн назад

Атакуйте свой собственный план так, как это сделал бы умный противник — найдите самое слабое место, то, на что вы надеетесь, что никто не заметит, и где он…

Как процесс B 70/100 · Почти готов — слабые места: когда включается, ошибки и развилки, отчётность по ходу

ГенераторБезопасностьтип и темы размечены автоматически по тексту скилла
JSON
Технический рейтинг
A
94/100
безопасность, качество, тесты
Безопасность 60%
99
Качество 40%
87
Прогон на моделях
не было
Процессный рейтинг
B
70/100
Почти готов
Ошибки и развилки вес 10
0
Отчётность по ходу вес 2
0
Когда включается вес 12
20
три самых слабых из десяти параметров · все десять

Такой же скилл встречается ещё в 2 местах: pm-claude-skills, pm-claude-skills

Как улучшить

    Для прогона на моделях — необязательно
    • Свои кейсы (evals/evals.json, 4–6 реальных запросов с ожидаемыми ответами): тогда полная проверка прогонит именно их, а не черновик от модели.
    • spec.yaml с триггерными фразами и утверждениями — контракт поведения для CI; `skilltest init` создаст шаблон.

    Находки guard · 1

    ✓ Критических и высоких находок нет

    Средние и низкие: 1
    • низкая Рискованное назначение intent-offensive-security SKILL.md:28
      Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение) (в кавычках — упоминание, а не команда)
      1. **Adopt the adversary's goal.** Genuinely try to make the plan fail — a real red team, not a gentle review.
      в кавычках

    Просканировано файлов: 1. Улики замаскированы. Пометки в серых чипах объясняют, почему серьёзность понижена.

    По спецификации Agent Skills

    ✓ По спецификации Agent Skills замечаний нет

    Процессный рейтинг: все десять параметров 70/100

    • 0Ошибки и развилки. Линейный процесс без обработки сбоев
    • 0Отчётность по ходу. Скилл ничего не сообщает по ходу работы
    • 20Когда включается. Не сказано, при каком запросе скилл включается
    • 60Результат и критерий готовности. Формат результата описан, критерия завершения нет
    • 70Входы и предусловия. Входные данные и предусловия перечислены
    • 100Инструменты и файлы. Внешние инструменты не нужны
    • 100Шаги. Шагов: 30
    • 100Согласованность. Имя и обязательные поля на месте
    • 100Стоимость исполнения. Тело инструкции 723 токенов
    • 100Повторный запуск. Изменяющих операций нет

    Всё перечисленное измерено по тексту скилла, а не оценено моделью: цифры проверяемы. Вес параметра тем больше, чем чаще из-за него процесс встаёт.

    Сигналы качества

    • +5В description нет примеров фраз, по которым скилл должен срабатывать
    • +4Описание не говорит, когда скилл НЕ применять (ложные срабатывания)
    • +1Лицензия не указана
    • +2Инструкции на одном языке
    • +3Длина description 539 символов: достаточно сигнала, не съедает бюджет
    • +4Структура: 9 заголовков
    • +3Пошаговые инструкции: 30 пунктов
    • +3Формат ответа описан явно
    • +4Есть примеры (0 блоков кода)

    База качества 70; замечания lint вычитаются, сигналы прибавляют до 100. Итог: 87.