AB target-novelty-scorer
Оценка новизны биологических мишеней путем анализа литературы.
машинный переводПоказать оригиналСкрыть оригинал«Score the novelty of biological targets through literature mining and.…»
Score the novelty of biological targets through literature mining and.
Оценка новизны биологических мишеней путем анализа литературы.
Как процесс B 79/100 · Почти готов — слабые места: согласованность
Как улучшить
Для прогона на моделях — необязательно
- Свои кейсы (evals/evals.json, 4–6 реальных запросов с ожидаемыми ответами): тогда полная проверка прогонит именно их, а не черновик от модели.
- spec.yaml с триггерными фразами и утверждениями — контракт поведения для CI; `skilltest init` создаст шаблон.
Находки guard · 0
✓ Критических и высоких находок нет
Просканировано файлов: 5. Улики замаскированы. Пометки в серых чипах объясняют, почему серьёзность понижена.
По спецификации Agent Skills
- заметка
frontmatter-keyнеизвестное поле фронтматтера "skill-author"
Процессный рейтинг: все десять параметров 79/100
- 40Согласованность. Имя во frontmatter (target-novelty-scorer) не совпадает с папкой (target-novelty-scorer-1)
- 50Когда включается. Не сказано, при каком запросе скилл включается
- 60Инструменты и файлы. Используются инструменты (bash, python), но во frontmatter они не объявлены
- 70Входы и предусловия. Входные данные и предусловия перечислены
- 100Шаги. Шагов: 82
- 100Результат и критерий готовности. Формат результата и критерий готовности описаны
- 100Ошибки и развилки. Развилок: 4, есть раздел про ошибки
- 100Стоимость исполнения. Тело инструкции 2343 токенов
- 100Повторный запуск. Изменяющих операций нет
- 100Отчётность по ходу. Скилл сообщает о ходе работы
- medium Правила безопасности и запреты внутри скилла: их место в системном промпте, здесь они не защищают
- low Разделов верхнего уровня: 26. Похоже на несколько доменов в одном скилле
Всё перечисленное измерено по тексту скилла, а не оценено моделью: цифры проверяемы. Вес параметра тем больше, чем чаще из-за него процесс встаёт.
Сигналы качества
- +5В description нет примеров фраз, по которым скилл должен срабатывать
- +4Описание не говорит, когда скилл НЕ применять (ложные срабатывания)
- +3Длина description 70: рекомендуется 120–800 символов
- -4Абсолютные локальные пути (C:\Users, /home/…): скилл не переносим
- +2Инструкции на одном языке
- +4Структура: 33 заголовков
- +3Пошаговые инструкции: 82 пунктов
- +3Формат ответа описан явно
- +4Есть примеры (8 блоков кода)
- +4Справочные файлы упоминаются в инструкциях (1 из 1)
- +3Все 1 скриптов описаны в инструкциях
- +1Лицензия указана
База качества 70; замечания lint вычитаются, сигналы прибавляют до 100. Итог: 87.
Внешние проверки
ClawHub: suspicious
This skill looks like a demo that presents synthetic biomedical scoring as real literature-mining analysis, so users should review it carefully before relying on it.
LLM: suspicious (high) · VirusTotal: · 29 мая 2026 г.