AF skill-tester
Проверяет, тестирует и оценивает качество скиллов в экосистеме claude-skills. Комплексный мета-скилл: проверка структуры, тестирование скриптов Python (синтаксис + импорты + выполнение + формат вывода), многомерная оценка качества с буквенными оценками и классификацией уровней (BASIC/STANDARD/POWERFUL). Используйте при создании нового скилла, аудите существующих скиллов для повышения уровня, настройке pre-commit хуков для качества скиллов или интеграции QA скиллов в CI.
машинный переводПоказать оригиналСкрыть оригинал«Validate, test, and score the quality of skills within the claude-skil…»
Validate, test, and score the quality of skills within the claude-skills ecosystem. Comprehensive meta-skill: structure validation, Python script testing (syntax + imports + runtime + output format), multi-dimensional quality scoring with letter grades and tier classification (BASIC/STANDARD/POWERFUL). Use when authoring a new skill, auditing existing skills for tier promotion, setting up pre-commit hooks for skill quality, or integrating skill QA into CI.
Проверяет, тестирует и оценивает качество скиллов в экосистеме claude-skills.
Как процесс F 38/100 · Не запустится — Скилл ссылается на файлы, которых нет в архиве: scripts/audit_skills.py
Как улучшить
- В тексте есть ссылки на отсутствующие файлы: добавьте файлы или уберите ссылки.
- Свои кейсы (evals/evals.json, 4–6 реальных запросов с ожидаемыми ответами): тогда полная проверка прогонит именно их, а не черновик от модели.
- spec.yaml с триггерными фразами и утверждениями — контракт поведения для CI; `skilltest init` создаст шаблон.
Находки guard · 1
✓ Критических и высоких находок нет
Средние и низкие: 1
-
низкая Опасные команды
cmd-eval-dynamicreferences/quality-scoring-rubric.md:512Динамическое выполнение кода из декодированного/недоверенного ввода (документация security-скилла)os.system(f"ls {user_input}") # BADsecurity-скилл
Просканировано файлов: 10. Улики замаскированы. Пометки в серых чипах объясняют, почему серьёзность понижена.
По спецификации Agent Skills
- предупреждение
missing-refссылка на отсутствующий файл: scripts/audit_skills.py - заметка
edit-residueв тексте есть пометки об устаревшем (строки 13, 55): проверьте, не остались ли старые правила рядом с новыми — полная проверка читает текст на противоречия
Процессный рейтинг: все десять параметров 38/100
- 0Инструменты и файлы. Не хватает 1 файла(ов): scripts/audit_skills.py
- 0Результат и критерий готовности. Не сказано, что считать результатом
- 0Входы и предусловия. Не сказано, что нужно иметь на входе
- 0Отчётность по ходу. Скилл ничего не сообщает по ходу работы
- 20Когда включается. Не сказано, при каком запросе скилл включается
- 30Повторный запуск. Изменяющих операций: 2, без проверки текущего состояния
- 50Ошибки и развилки. Развилок: 0, есть раздел про ошибки
- 100Шаги. Шагов: 16
- 100Согласованность. Имя и обязательные поля на месте
- 100Стоимость исполнения. Тело инструкции 1135 токенов
- low Ответ описан самодельной разметкой (4 тегов): типизированный вызов надёжнее
Всё перечисленное измерено по тексту скилла, а не оценено моделью: цифры проверяемы. Вес параметра тем больше, чем чаще из-за него процесс встаёт.
Сигналы качества
- +5В description нет примеров фраз, по которым скилл должен срабатывать
- +4Описание не говорит, когда скилл НЕ применять (ложные срабатывания)
- +3Формат ответа не описан: модель каждый раз решает сама
- -43 справочных файлов, но SKILL.md на них не ссылается: модель их не откроет
- +1Лицензия не указана
- +2Инструкции на одном языке
- +3Длина description 460 символов: достаточно сигнала, не съедает бюджет
- +4Структура: 10 заголовков
- +3Пошаговые инструкции: 16 пунктов
- +4Есть примеры (2 блоков кода)
- +3Все 4 скриптов описаны в инструкциях
База качества 70; замечания lint вычитаются, сигналы прибавляют до 100. Итог: 77.