SKILLEMALL.ai

AF exam-evaluator

Извлекает задания из экзаменов/банков заданий в форматах .xlsx/.xls/.docx/.pdf, оценивает качество составления заданий по пяти параметрам (содержательная валидность, структурная валидность, контроль сложности, потенциал дифференциации, нормативность), генерирует интерактивный HTML-отчет с визуализацией. Используйте, когда: (1) пользователь просит оценить качество экзамена или банка заданий, (2) требуется проверка качества после составления заданий, (3) требуется сравнение уровня составления нескольких экзаменов, (4) требуется создание отчета об анализе заданий, (5) пользователь загружает файлы Excel/Word/PDF с просьбой об анализе. Ключевые фразы: оценить экзамен, оценить банк заданий, качество заданий, анализ экзамена, анализ банка заданий, качество составления, проверка составления, оценка экзамена, оценка качества заданий, .xlsx, .docx, .pdf.

машинный переводПоказать оригиналСкрыть оригинал«从 .xlsx/.xls/.docx/.pdf 试卷/题库中提取试题,从五个维度(内容效度、结构效度、难度控制、区分度潜力、规范性)评估命题…»

从 .xlsx/.xls/.docx/.pdf 试卷/题库中提取试题,从五个维度(内容效度、结构效度、难度控制、区分度潜力、规范性)评估命题质量,生成交互式 HTML 可视化报告。Use when: (1) 用户要求评估试卷或题库质量,(2) 命题后需要质量检验,(3) 对比多份试卷的命题水平,(4) 生成试题分析报告,(5) 用户上传 Excel/Word/PDF 文件要求分析。触发词:评估试卷、评估题库、试题质量、试卷分析、题库分析、命题质量、命题检验、exam evaluation、question quality assessment、.xlsx、.docx、.pdf

ClawHub Agent Skills автор: flyboat403 v0.1.0 MIT-0 6 файлов тело ≈ 3 170 токенов Открыть источникclawhub.ai проанализирован 2 дн назад

Извлекает задания из экзаменов/банков заданий в форматах .xlsx/.xls/.docx/.pdf, оценивает качество составления заданий по пяти параметрам (содержательная…

Как процесс F 40/100 · Не запустится — Скилл ссылается на файлы, которых нет в архиве: references/weights/, references/weights/升学考试.json, references/weights/日常测验.json

АнализаторWordExcelPDFИИ и агентыДанные и аналитикатип и темы размечены автоматически по тексту скилла
JSON
Технический рейтинг
A
90/100
безопасность, качество, тесты
Безопасность 60%
100
Качество 40%
74
Прогон на моделях
не было
Процессный рейтинг
F
40/100
Не запустится
Скилл ссылается на файлы, которых нет в архиве: references/weights/, references/weights/升学考试.json, references/weights/日常测验.json
Инструменты и файлы вес 18
0
Результат и критерий готовности вес 14
0
Входы и предусловия вес 11
0
три самых слабых из десяти параметров · все десять

Как улучшить

  1. В тексте есть ссылки на отсутствующие файлы: добавьте файлы или уберите ссылки.
Для прогона на моделях — необязательно
  • Свои кейсы (evals/evals.json, 4–6 реальных запросов с ожидаемыми ответами): тогда полная проверка прогонит именно их, а не черновик от модели.
  • spec.yaml с триггерными фразами и утверждениями — контракт поведения для CI; `skilltest init` создаст шаблон.

Находки guard · 0

✓ Критических и высоких находок нет

Просканировано файлов: 6. Улики замаскированы. Пометки в серых чипах объясняют, почему серьёзность понижена.

По спецификации Agent Skills

  • предупреждение missing-ref ссылка на отсутствующий файл: references/weights/
  • предупреждение missing-ref ссылка на отсутствующий файл: references/weights/升学考试.json
  • предупреждение missing-ref ссылка на отсутствующий файл: references/weights/日常测验.json
  • предупреждение missing-ref ссылка на отсутствующий файл: references/weights/竞赛选拔.json

Процессный рейтинг: все десять параметров 40/100

Не запустится. Скилл ссылается на файлы, которых нет в архиве: references/weights/, references/weights/升学考试.json, references/weights/日常测验.json
  • 0Инструменты и файлы. Не хватает 4 файла(ов): references/weights/, references/weights/升学考试.json, references/weights/日常测验.json
  • 0Результат и критерий готовности. Не сказано, что считать результатом
  • 0Входы и предусловия. Не сказано, что нужно иметь на входе
  • 0Отчётность по ходу. Скилл ничего не сообщает по ходу работы
  • 20Когда включается. Не сказано, при каком запросе скилл включается
  • 50Ошибки и развилки. Развилок: 0, есть раздел про ошибки
  • 100Шаги. Шагов: 126
  • 100Согласованность. Имя и обязательные поля на месте
  • 100Стоимость исполнения. Тело инструкции 3170 токенов
  • 100Повторный запуск. Изменяющих операций нет
  • medium Правила безопасности и запреты внутри скилла: их место в системном промпте, здесь они не защищают
  • low Ответ описан самодельной разметкой (3 тегов): типизированный вызов надёжнее

Всё перечисленное измерено по тексту скилла, а не оценено моделью: цифры проверяемы. Вес параметра тем больше, чем чаще из-за него процесс встаёт.

Сигналы качества

  • +5В description нет примеров фраз, по которым скилл должен срабатывать
  • +4Описание не говорит, когда скилл НЕ применять (ложные срабатывания)
  • +3Формат ответа не описан: модель каждый раз решает сама
  • -220 эмодзи в инструкциях: шум для модели
  • +1Лицензия не указана
  • +2Инструкции на одном языке
  • +3Длина description 291 символов: достаточно сигнала, не съедает бюджет
  • +4Структура: 17 заголовков
  • +3Пошаговые инструкции: 126 пунктов
  • +4Есть примеры (5 блоков кода)
  • +4Справочные файлы упоминаются в инструкциях (4 из 4)

База качества 70; замечания lint вычитаются, сигналы прибавляют до 100. Итог: 74.

Внешние проверки

ClawHub: clean
This appears to be a legitimate exam-analysis skill, with minor caveats around broad document triggers, sensitive local report data, and missing helper scripts.
LLM: benign (high) · VirusTotal: · 9 июл. 2026 г.