AB skill-deep-audit
Универсальный аудитор качества навыков для любого навыка агента (Claude, OpenClaw, Cursor и т. д.). Выполняет статический анализ по 7 измерениям (D1 завершение процесса и идемпотентность, D2 соглашения об инструментах/командах, D3 переносимость и защита, D4 удобство использования навыка, D5 безопасность и операционный риск, D6 качество кода и документации, D7 зависимости и объем) с явной серьезностью ERR / WARN, 120-балльной оценкой (проход 90 + ноль ERR) и дополнительным рабочим процессом `--fix`, который всегда сначала создает резервную копию. Две глубины: L1 статический (~2 мин) и L2 dryRun (~5 мин, проверка доступности и только для чтения хаба). Строгие красные линии — по умолчанию только для чтения, никогда не выполняет запись аудируемого навыка. Используйте, когда пользователь просит «аудировать навык», «проверить качество навыка», «готов ли этот навык к выпуску», «проверить мой навык» или запускает этот инструмент по имени. Триггеры также: «审计这个 Skill»、«检查 Skill 质量»、«Skill 能上线吗»、 «skill-deep-audit»、«审一下 xxx skill».
машинный переводПоказать оригиналСкрыть оригинал«Generic skill-quality auditor for any agent skill (Claude, OpenClaw, C…»
Generic skill-quality auditor for any agent skill (Claude, OpenClaw, Cursor, etc.). Runs a 7-dimension static analysis (D1 process closure & idempotency, D2 tool/command conventions, D3 portability & defense, D4 skill usability, D5 security & op risk, D6 code & doc quality, D7 dependency & footprint) with explicit ERR / WARN severity, 120-point scoring (pass line 90 + zero ERR), and an opt-in `--fix` workflow that always backs up first. Two depths: L1 static (~2 min) and L2 dryRun (~5 min, read-only hub + reachability checks). Strict red lines — read-only by default, never executes the audited skill's writes. Use when the user asks to "audit a skill", "check skill quality", "is this skill ready to ship", "lint my skill", or runs this tool by name. Triggers also: "审计这个 Skill"、"检查 Skill 质量"、"Skill 能上线吗"、 "skill-deep-audit"、"审一下 xxx skill"。
Универсальный аудитор качества навыков для любого навыка агента (Claude, OpenClaw, Cursor и т.
Как процесс B 70/100 · Почти готов — слабые места: результат и критерий готовности
Как улучшить
- Свои кейсы (evals/evals.json, 4–6 реальных запросов с ожидаемыми ответами): тогда полная проверка прогонит именно их, а не черновик от модели.
- spec.yaml с триггерными фразами и утверждениями — контракт поведения для CI; `skilltest init` создаст шаблон.
Находки guard · 0
✓ Критических и высоких находок нет
Просканировано файлов: 8. Улики замаскированы. Пометки в серых чипах объясняют, почему серьёзность понижена.
По спецификации Agent Skills
✓ По спецификации Agent Skills замечаний нет
Процессный рейтинг: все десять параметров 70/100
- 0Результат и критерий готовности. Не сказано, что считать результатом
- 60Инструменты и файлы. Используются инструменты (python), но во frontmatter они не объявлены
- 70Когда включается. Сказано, когда применять, но не сказано, когда не стоит
- 70Входы и предусловия. Входные данные и предусловия перечислены
- 85Шаги. Шагов: 48, расплывчатых формулировок: 1
- 100Ошибки и развилки. Развилок: 2, есть раздел про ошибки
- 100Согласованность. Имя и обязательные поля на месте
- 100Стоимость исполнения. Тело инструкции 3660 токенов
- 100Повторный запуск. Изменяющие операции проверяют текущее состояние
- 100Отчётность по ходу. Скилл сообщает о ходе работы
- low Разделов верхнего уровня: 15. Похоже на несколько доменов в одном скилле
Всё перечисленное измерено по тексту скилла, а не оценено моделью: цифры проверяемы. Вес параметра тем больше, чем чаще из-за него процесс встаёт.
Сигналы качества
- +4Описание не говорит, когда скилл НЕ применять (ложные срабатывания)
- +3Длина description 849: рекомендуется 120–800 символов
- +3Формат ответа не описан: модель каждый раз решает сама
- -223 эмодзи в инструкциях: шум для модели
- +1Лицензия не указана
- +2Инструкции на одном языке
- +5В description 9 примера фраз-триггеров в кавычках
- +4Структура: 24 заголовков
- +3Пошаговые инструкции: 48 пунктов
- +4Есть примеры (8 блоков кода)
- +4Справочные файлы упоминаются в инструкциях (4 из 4)
- +3Все 1 скриптов описаны в инструкциях
База качества 70; замечания lint вычитаются, сигналы прибавляют до 100. Итог: 91.