SKILLEMALL.ai

AC adversarial-reviewer

Конструктивный обзор кода, который ломает монокультуру самообзора. Используйте, когда вам нужен по-настоящему критический обзор последних изменений перед слиянием PR или когда вы подозреваете, что Claude слишком благосклонен к качеству кода. Меняет перспективу через враждебные роли рецензентов, которые выявляют слепые зоны, разделяемые ментальной моделью автора и рецензента.

машинный переводПоказать оригиналСкрыть оригинал«Adversarial code review that breaks the self-review monoculture. Use w…»

Adversarial code review that breaks the self-review monoculture. Use when you want a genuinely critical review of recent changes, before merging a PR, or when you suspect Claude is being too agreeable about code quality. Forces perspective shifts through hostile reviewer personas that catch blind spots the author's mental model shares with the reviewer.

alirezarezvani/claude-skills Agent Skills автор: alirezarezvani MIT 1 файл тело ≈ 2 817 токенов Открыть источникgithub.com проанализирован 24 ч назад

Конструктивный обзор кода, который ломает монокультуру самообзора.

Как процесс C 57/100 · Есть пробелы — слабые места: когда включается, входы и предусловия, повторный запуск

АнализаторКачество и контрольтип и темы размечены автоматически по тексту скилла
JSON
Технический рейтинг
A
94/100
безопасность, качество, тесты
Безопасность 60%
99
Качество 40%
86
Прогон на моделях
не было
Процессный рейтинг
C
57/100
Есть пробелы
Входы и предусловия вес 11
0
Отчётность по ходу вес 2
0
Когда включается вес 12
20
три самых слабых из десяти параметров · все десять

Как улучшить

    Для прогона на моделях — необязательно
    • Свои кейсы (evals/evals.json, 4–6 реальных запросов с ожидаемыми ответами): тогда полная проверка прогонит именно их, а не черновик от модели.
    • spec.yaml с триггерными фразами и утверждениями — контракт поведения для CI; `skilltest init` создаст шаблон.

    Находки guard · 1

    ✓ Критических и высоких находок нет

    Средние и низкие: 1
    • низкая Рискованное назначение intent-offensive-security SKILL.md:161
      Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение) (строка таблицы в документации)
      | **Missing Access Control** | IDOR (can user A access user B's data?), missing role checks, privilege escalation paths |
      таблица

    Просканировано файлов: 1. Улики замаскированы. Пометки в серых чипах объясняют, почему серьёзность понижена.

    По спецификации Agent Skills

    • заметка frontmatter-key неизвестное поле фронтматтера "tier"
    • заметка frontmatter-key неизвестное поле фронтматтера "dependencies"

    Процессный рейтинг: все десять параметров 57/100

    • 0Входы и предусловия. Не сказано, что нужно иметь на входе
    • 0Отчётность по ходу. Скилл ничего не сообщает по ходу работы
    • 20Когда включается. Не сказано, при каком запросе скилл включается
    • 30Повторный запуск. Изменяющих операций: 3, без проверки текущего состояния
    • 55Ошибки и развилки. Развилок: 1
    • 60Инструменты и файлы. Используются инструменты (bash, web), но во frontmatter они не объявлены
    • 60Результат и критерий готовности. Формат результата описан, критерия завершения нет
    • 100Шаги. Шагов: 64
    • 100Согласованность. Имя и обязательные поля на месте
    • 100Стоимость исполнения. Тело инструкции 2817 токенов
    • low Разделов верхнего уровня: 14. Похоже на несколько доменов в одном скилле

    Всё перечисленное измерено по тексту скилла, а не оценено моделью: цифры проверяемы. Вес параметра тем больше, чем чаще из-за него процесс встаёт.

    Сигналы качества

    • +5В description нет примеров фраз, по которым скилл должен срабатывать
    • +4Описание не говорит, когда скилл НЕ применять (ложные срабатывания)
    • +2Инструкции на одном языке
    • +3Длина description 355 символов: достаточно сигнала, не съедает бюджет
    • +4Структура: 25 заголовков
    • +3Пошаговые инструкции: 64 пунктов
    • +3Формат ответа описан явно
    • +4Есть примеры (4 блоков кода)
    • +1Лицензия указана

    База качества 70; замечания lint вычитаются, сигналы прибавляют до 100. Итог: 86.