SKILLEMALL.ai

AB audit-skill-completeness

Оцените качество отдельного навыка по отношению к его заявленной цели. Классифицирует тип цели навыка, затем оценивает применимые категории качества — универсальные измерения всегда применяются; структурные измерения (скрипты, ссылки, ресурсы) оцениваются только при необходимости в зависимости от цели навыка. Сфокусированный поведенческий навык из 20 строк без прилагаемых ресурсов полностью оценивается по всем применимым категориям. Используйте при аудите качества навыка, проверке готовности к рынку, оценке полноты навыка, проведении предварительной оценки перед публикацией.

машинный переводПоказать оригиналСкрыть оригинал«Evaluate a single skill's quality against its stated purpose. Classifi…»

Evaluate a single skill's quality against its stated purpose. Classifies the skill's purpose type, then scores applicable quality categories — universal dimensions always apply; structural dimensions (scripts, references, assets) are scored only when warranted by the skill's purpose. A focused 20-line behavioral skill with no bundled resources scores fully on all applicable categories. Use when auditing skill quality, checking marketplace readiness, evaluating skill completeness, performing pre-publication evaluation.

Jamie-BitFlight/claude_skills Claude Code автор: Jamie-BitFlight MIT 2 файла тело ≈ 3 304 токенов Открыть источникgithub.com↗ проанализирован 8 дн назад

Оцените качество отдельного навыка по отношению к его заявленной цели.

Как процесс B 70/100 · Почти готов — слабые места: результат и критерий готовности, когда включается, отчётность по ходу

АнализаторТорговляДанные и аналитикаИИ и агентытип и темы размечены автоматически по тексту скилла
JSON
Технический рейтинг
A
95/100
безопасность, качество, тесты
Безопасность 60%
100
Качество 40%
88
Прогон на моделях
не было
Процессный рейтинг
B
70/100
Почти готов
Отчётность по ходу вес 2
0
Когда включается вес 12
20
Результат и критерий готовности вес 14
40
три самых слабых из десяти параметров · все десять

Как улучшить

    Для прогона на моделях — необязательно
    • Свои кейсы (evals/evals.json, 4–6 реальных запросов с ожидаемыми ответами): тогда полная проверка прогонит именно их, а не черновик от модели.
    • spec.yaml с триггерными фразами и утверждениями — контракт поведения для CI; `skilltest init` создаст шаблон.

    Находки guard · 0

    ✓ Критических и высоких находок нет

    Просканировано файлов: 2. Улики замаскированы. Пометки в серых чипах объясняют, почему серьёзность понижена.

    По спецификации Agent Skills

    ✓ По спецификации Agent Skills замечаний нет

    Процессный рейтинг: все десять параметров 70/100

    • 0Отчётность по ходу. Скилл ничего не сообщает по ходу работы
    • 20Когда включается. Не сказано, при каком запросе скилл включается
    • 40Результат и критерий готовности. Не сказано, что считать результатом
    • 55Ошибки и развилки. Развилок: 1
    • 70Входы и предусловия. Входные данные и предусловия перечислены
    • 85Шаги. Шагов: 63, расплывчатых формулировок: 1
    • 100Инструменты и файлы. Внешние инструменты не нужны
    • 100Согласованность. Имя и обязательные поля на месте
    • 100Стоимость исполнения. Тело инструкции 3304 токенов
    • 100Повторный запуск. Изменяющие операции проверяют текущее состояние

    Всё перечисленное измерено по тексту скилла, а не оценено моделью: цифры проверяемы. Вес параметра тем больше, чем чаще из-за него процесс встаёт.

    Сигналы качества

    • +5В description нет примеров фраз, по которым скилл должен срабатывать
    • +4Описание не говорит, когда скилл НЕ применять (ложные срабатывания)
    • +3Формат ответа не описан: модель каждый раз решает сама
    • +1Лицензия не указана
    • +2Инструкции на одном языке
    • +3Длина description 523 символов: достаточно сигнала, не съедает бюджет
    • +4Структура: 12 заголовков
    • +3Пошаговые инструкции: 63 пунктов
    • +4Есть примеры (2 блоков кода)
    • +4Справочные файлы упоминаются в инструкциях (1 из 1)

    База качества 70; замечания lint вычитаются, сигналы прибавляют до 100. Итог: 88.