SKILLEMALL.ai

AF skill-tester

Проверяет, тестирует и оценивает качество скиллов в экосистеме claude-skills. Комплексный мета-скилл: проверка структуры, тестирование скриптов Python (синтаксис + импорты + выполнение + формат вывода), многомерная оценка качества с буквенными оценками и классификацией уровней (BASIC/STANDARD/POWERFUL). Используйте при создании нового скилла, аудите существующих скиллов для повышения уровня, настройке pre-commit хуков для качества скиллов или интеграции QA скиллов в CI.

машинный переводПоказать оригиналСкрыть оригинал«Validate, test, and score the quality of skills within the claude-skil…»

Validate, test, and score the quality of skills within the claude-skills ecosystem. Comprehensive meta-skill: structure validation, Python script testing (syntax + imports + runtime + output format), multi-dimensional quality scoring with letter grades and tier classification (BASIC/STANDARD/POWERFUL). Use when authoring a new skill, auditing existing skills for tier promotion, setting up pre-commit hooks for skill quality, or integrating skill QA into CI.

alirezarezvani/claude-skills Agent Skills автор: alirezarezvani MIT 11 файлов тело ≈ 1 135 токенов Открыть источникgithub.com проанализирован 2 дн назад

Проверяет, тестирует и оценивает качество скиллов в экосистеме claude-skills.

Как процесс F 38/100 · Не запустится — Скилл ссылается на файлы, которых нет в архиве: scripts/audit_skills.py

АнализаторРазработкаИИ и агентытип и темы размечены автоматически по тексту скилла
JSON
Технический рейтинг
A
90/100
безопасность, качество, тесты
Безопасность 60%
99
Качество 40%
77
Прогон на моделях
не было
Процессный рейтинг
F
38/100
Не запустится
Скилл ссылается на файлы, которых нет в архиве: scripts/audit_skills.py
Инструменты и файлы вес 18
0
Результат и критерий готовности вес 14
0
Входы и предусловия вес 11
0
три самых слабых из десяти параметров · все десять

Как улучшить

  1. В тексте есть ссылки на отсутствующие файлы: добавьте файлы или уберите ссылки.
Для прогона на моделях — необязательно
  • Свои кейсы (evals/evals.json, 4–6 реальных запросов с ожидаемыми ответами): тогда полная проверка прогонит именно их, а не черновик от модели.
  • spec.yaml с триггерными фразами и утверждениями — контракт поведения для CI; `skilltest init` создаст шаблон.

Находки guard · 1

✓ Критических и высоких находок нет

Средние и низкие: 1
  • низкая Опасные команды cmd-eval-dynamic references/quality-scoring-rubric.md:512
    Динамическое выполнение кода из декодированного/недоверенного ввода (документация security-скилла)
    os.system(f"ls {user_input}")  # BAD
    security-скилл

Просканировано файлов: 10. Улики замаскированы. Пометки в серых чипах объясняют, почему серьёзность понижена.

По спецификации Agent Skills

  • предупреждение missing-ref ссылка на отсутствующий файл: scripts/audit_skills.py
  • заметка edit-residue в тексте есть пометки об устаревшем (строки 13, 55): проверьте, не остались ли старые правила рядом с новыми — полная проверка читает текст на противоречия

Процессный рейтинг: все десять параметров 38/100

Не запустится. Скилл ссылается на файлы, которых нет в архиве: scripts/audit_skills.py
  • 0Инструменты и файлы. Не хватает 1 файла(ов): scripts/audit_skills.py
  • 0Результат и критерий готовности. Не сказано, что считать результатом
  • 0Входы и предусловия. Не сказано, что нужно иметь на входе
  • 0Отчётность по ходу. Скилл ничего не сообщает по ходу работы
  • 20Когда включается. Не сказано, при каком запросе скилл включается
  • 30Повторный запуск. Изменяющих операций: 2, без проверки текущего состояния
  • 50Ошибки и развилки. Развилок: 0, есть раздел про ошибки
  • 100Шаги. Шагов: 16
  • 100Согласованность. Имя и обязательные поля на месте
  • 100Стоимость исполнения. Тело инструкции 1135 токенов
  • low Ответ описан самодельной разметкой (4 тегов): типизированный вызов надёжнее

Всё перечисленное измерено по тексту скилла, а не оценено моделью: цифры проверяемы. Вес параметра тем больше, чем чаще из-за него процесс встаёт.

Сигналы качества

  • +5В description нет примеров фраз, по которым скилл должен срабатывать
  • +4Описание не говорит, когда скилл НЕ применять (ложные срабатывания)
  • +3Формат ответа не описан: модель каждый раз решает сама
  • -43 справочных файлов, но SKILL.md на них не ссылается: модель их не откроет
  • +1Лицензия не указана
  • +2Инструкции на одном языке
  • +3Длина description 460 символов: достаточно сигнала, не съедает бюджет
  • +4Структура: 10 заголовков
  • +3Пошаговые инструкции: 16 пунктов
  • +4Есть примеры (2 блоков кода)
  • +3Все 4 скриптов описаны в инструкциях

База качества 70; замечания lint вычитаются, сигналы прибавляют до 100. Итог: 77.