SKILLEMALL.ai

BD skill-evaluation

Автоматически оценивает Skill и выводит отчет об оценке. Поддерживает проверку одного Skill, сравнительную оценку нескольких Skill, сравнение нескольких моделей и сравнение фреймворков. Активируется, когда пользователь говорит «оценить skill», «запустить оценку», «проверить этот skill», «сравнить эффективность skill», «сравнительная оценка», «проверить работу skill».

машинный переводПоказать оригиналСкрыть оригинал«对 Skill 进行自动化评测,并输出评测报告。支持单 Skill 验证、多 Skill 横评、多模型对比、运行框架对比。当用户提到"评测…»

对 Skill 进行自动化评测,并输出评测报告。支持单 Skill 验证、多 Skill 横评、多模型对比、运行框架对比。当用户提到"评测 skill"、"跑评测"、"测一下这个 skill"、"对比 skill 效果"、"横评"、"验证 skill 表现"时触发。

Не рекомендуетсяесть критические или высокие находки безопасности
ClawHub Agent Skills автор: njuxumq v1.0.1 MIT-0 34 файла тело ≈ 507 токенов Открыть источникclawhub.ai проанализирован 3 дн назад

Автоматически оценивает Skill и выводит отчет об оценке.

Как процесс D 46/100 · Процесс не доведён — слабые места: результат и критерий готовности, когда включается, входы и предусловия

АнализаторИнфраструктуратип и темы размечены автоматически по тексту скилла
JSON
Технический рейтинг
B
80/100
безопасность, качество, тесты
Безопасность 60%
82
Качество 40%
78
Прогон на моделях
не было
Процессный рейтинг
D
46/100
Процесс не доведён
Результат и критерий готовности вес 14
0
Входы и предусловия вес 11
0
Ошибки и развилки вес 10
0
три самых слабых из десяти параметров · все десять

Чем это грозит

Скилл содержит фрагменты, которые в чужих руках стоят денег или данных. Ниже, что рискует потерять тот, кто установит, и что должен сделать автор.

Сокрытие от пользователя
Если установить

Скилл просит агента что-то скрывать от вас: не показывать ошибки, не упоминать действия, отвечать иначе, чем было сделано. Вы теряете возможность контролировать, что агент реально сделал.

Автору

Прозрачность важнее гладкого ответа. Если хочется спрятать технический шум, попросите агента «кратко сообщить», а не «не сообщать».

Как улучшить

  1. Разберите находки высокой серьёзности: каждая стоит 18 баллов безопасности. Если это ложное срабатывание, добавьте код правила в guard.allow в spec.yaml.
  2. Скажите в description, КОГДА применять скилл («используй, когда…», примеры запросов): это главный сигнал для агента.
Для прогона на моделях — необязательно
  • Свои кейсы (evals/evals.json, 4–6 реальных запросов с ожидаемыми ответами): тогда полная проверка прогонит именно их, а не черновик от модели.
  • spec.yaml с триггерными фразами и утверждениями — контракт поведения для CI; `skilltest init` создаст шаблон.

Находки guard · 1

  • высокая Сокрытие от пользователя en-hide-from-user skill-card.md:20
    Инструкция скрыть действия от пользователя
    Risk: The skill can silently upload selected skills, datasets, and attachments to the configured cloud service. <br>

Просканировано файлов: 34. Улики замаскированы. Пометки в серых чипах объясняют, почему серьёзность понижена.

По спецификации Agent Skills

  • предупреждение description-no-when description не говорит, КОГДА применять скилл (нет "use when / используй когда")

Процессный рейтинг: все десять параметров 46/100

  • 0Результат и критерий готовности. Не сказано, что считать результатом
  • 0Входы и предусловия. Не сказано, что нужно иметь на входе
  • 0Ошибки и развилки. Линейный процесс без обработки сбоев
  • 0Отчётность по ходу. Скилл ничего не сообщает по ходу работы
  • 20Когда включается. Не сказано, при каком запросе скилл включается
  • 60Инструменты и файлы. Используются инструменты (bash, python), но во frontmatter они не объявлены
  • 100Шаги. Шагов: 11
  • 100Согласованность. Имя и обязательные поля на месте
  • 100Стоимость исполнения. Тело инструкции 507 токенов
  • 100Повторный запуск. Изменяющих операций нет

Всё перечисленное измерено по тексту скилла, а не оценено моделью: цифры проверяемы. Вес параметра тем больше, чем чаще из-за него процесс встаёт.

Сигналы качества

  • +4Описание не говорит, когда скилл НЕ применять (ложные срабатывания)
  • +3Формат ответа не описан: модель каждый раз решает сама
  • -32 из 2 скриптов не упомянуты в SKILL.md
  • +1Лицензия не указана
  • +2Инструкции на одном языке
  • +5В description 4 примера фраз-триггеров в кавычках
  • +3Длина description 133 символов: достаточно сигнала, не съедает бюджет
  • +4Структура: 6 заголовков
  • +3Пошаговые инструкции: 11 пунктов
  • +4Есть примеры (2 блоков кода)
  • +4Справочные файлы упоминаются в инструкциях (2 из 5)

База качества 70; замечания lint вычитаются, сигналы прибавляют до 100. Итог: 78.

Внешние проверки

ClawHub: suspicious
This skill is a coherent cloud evaluation workflow, but it should go to Review because it silently performs uploads, deletion/overwrite actions, credential storage, and authenticated HTTPS calls with certificate verification disabled.
LLM: suspicious (high) · VirusTotal: · 24 июн. 2026 г.