SKILLEMALL.ai

AB skill-deep-audit

Универсальный аудитор качества навыков для любого навыка агента (Claude, OpenClaw, Cursor и т. д.). Выполняет статический анализ по 7 измерениям (D1 завершение процесса и идемпотентность, D2 соглашения об инструментах/командах, D3 переносимость и защита, D4 удобство использования навыка, D5 безопасность и операционный риск, D6 качество кода и документации, D7 зависимости и объем) с явной серьезностью ERR / WARN, 120-балльной оценкой (проход 90 + ноль ERR) и дополнительным рабочим процессом `--fix`, который всегда сначала создает резервную копию. Две глубины: L1 статический (~2 мин) и L2 dryRun (~5 мин, проверка доступности и только для чтения хаба). Строгие красные линии — по умолчанию только для чтения, никогда не выполняет запись аудируемого навыка. Используйте, когда пользователь просит «аудировать навык», «проверить качество навыка», «готов ли этот навык к выпуску», «проверить мой навык» или запускает этот инструмент по имени. Триггеры также: «审计这个 Skill»、«检查 Skill 质量»、«Skill 能上线吗»、 «skill-deep-audit»、«审一下 xxx skill».

машинный переводПоказать оригиналСкрыть оригинал«Generic skill-quality auditor for any agent skill (Claude, OpenClaw, C…»

Generic skill-quality auditor for any agent skill (Claude, OpenClaw, Cursor, etc.). Runs a 7-dimension static analysis (D1 process closure & idempotency, D2 tool/command conventions, D3 portability & defense, D4 skill usability, D5 security & op risk, D6 code & doc quality, D7 dependency & footprint) with explicit ERR / WARN severity, 120-point scoring (pass line 90 + zero ERR), and an opt-in `--fix` workflow that always backs up first. Two depths: L1 static (~2 min) and L2 dryRun (~5 min, read-only hub + reachability checks). Strict red lines — read-only by default, never executes the audited skill's writes. Use when the user asks to "audit a skill", "check skill quality", "is this skill ready to ship", "lint my skill", or runs this tool by name. Triggers also: "审计这个 Skill"、"检查 Skill 质量"、"Skill 能上线吗"、 "skill-deep-audit"、"审一下 xxx skill"。

ClawHub Agent Skills автор: Evan Song v1.1.0 MIT-0 8 файлов тело ≈ 3 660 токенов Открыть источникclawhub.ai проанализирован 2 дн назад

Универсальный аудитор качества навыков для любого навыка агента (Claude, OpenClaw, Cursor и т.

Как процесс B 70/100 · Почти готов — слабые места: результат и критерий готовности

АнализаторGitHubРазработкаИИ и агентытип и темы размечены автоматически по тексту скилла
JSON
Технический рейтинг
A
96/100
безопасность, качество, тесты
Безопасность 60%
100
Качество 40%
91
Прогон на моделях
не было
Процессный рейтинг
B
70/100
Почти готов
Результат и критерий готовности вес 14
0
Инструменты и файлы вес 18
60
Когда включается вес 12
70
три самых слабых из десяти параметров · все десять

Как улучшить

    Для прогона на моделях — необязательно
    • Свои кейсы (evals/evals.json, 4–6 реальных запросов с ожидаемыми ответами): тогда полная проверка прогонит именно их, а не черновик от модели.
    • spec.yaml с триггерными фразами и утверждениями — контракт поведения для CI; `skilltest init` создаст шаблон.

    Находки guard · 0

    ✓ Критических и высоких находок нет

    Просканировано файлов: 8. Улики замаскированы. Пометки в серых чипах объясняют, почему серьёзность понижена.

    По спецификации Agent Skills

    ✓ По спецификации Agent Skills замечаний нет

    Процессный рейтинг: все десять параметров 70/100

    • 0Результат и критерий готовности. Не сказано, что считать результатом
    • 60Инструменты и файлы. Используются инструменты (python), но во frontmatter они не объявлены
    • 70Когда включается. Сказано, когда применять, но не сказано, когда не стоит
    • 70Входы и предусловия. Входные данные и предусловия перечислены
    • 85Шаги. Шагов: 48, расплывчатых формулировок: 1
    • 100Ошибки и развилки. Развилок: 2, есть раздел про ошибки
    • 100Согласованность. Имя и обязательные поля на месте
    • 100Стоимость исполнения. Тело инструкции 3660 токенов
    • 100Повторный запуск. Изменяющие операции проверяют текущее состояние
    • 100Отчётность по ходу. Скилл сообщает о ходе работы
    • low Разделов верхнего уровня: 15. Похоже на несколько доменов в одном скилле

    Всё перечисленное измерено по тексту скилла, а не оценено моделью: цифры проверяемы. Вес параметра тем больше, чем чаще из-за него процесс встаёт.

    Сигналы качества

    • +4Описание не говорит, когда скилл НЕ применять (ложные срабатывания)
    • +3Длина description 849: рекомендуется 120–800 символов
    • +3Формат ответа не описан: модель каждый раз решает сама
    • -223 эмодзи в инструкциях: шум для модели
    • +1Лицензия не указана
    • +2Инструкции на одном языке
    • +5В description 9 примера фраз-триггеров в кавычках
    • +4Структура: 24 заголовков
    • +3Пошаговые инструкции: 48 пунктов
    • +4Есть примеры (8 блоков кода)
    • +4Справочные файлы упоминаются в инструкциях (4 из 4)
    • +3Все 1 скриптов описаны в инструкциях

    База качества 70; замечания lint вычитаются, сигналы прибавляют до 100. Итог: 91.

    Внешние проверки

    ClawHub: suspicious
    This appears to be a legitimate skill auditor, but its read-only claims are inaccurate because routine audits write into the audited skill directory.
    LLM: suspicious (high) · VirusTotal: · 23 авг. 2026 г.