BC skill-creator-claude
Создавайте новые навыки, изменяйте и улучшайте существующие навыки, а также измеряйте производительность навыков. Используйте, когда пользователи хотят создать навык с нуля, обновить или оптимизировать существующий навык, запустить оценки для тестирования навыка, сравнить производительность навыка с анализом отклонений или оптимизировать описание навыка для повышения точности срабатывания.
машинный переводПоказать оригиналСкрыть оригинал«Create new skills, modify and improve existing skills, and measure ski…»
Create new skills, modify and improve existing skills, and measure skill performance. Use when users want to create a skill from scratch, update or optimize an existing skill, run evals to test a skill, benchmark skill performance with variance analysis, or optimize a skill's description for better triggering accuracy.
Создавайте новые навыки, изменяйте и улучшайте существующие навыки, а также измеряйте производительность навыков.
Как процесс C 62/100 · Есть пробелы — слабые места: входы и предусловия, повторный запуск
Чем это грозит
Находки средней серьёзности: скорее всего скилл честный, но прочитайте, что именно насторожило сканер.
Ниже описан худший случай для этой категории. Здесь находка средней серьёзности: guard увидел признак, но не доказательство.
Скилл содержит команды, которые удаляют файлы, переписывают диски или исполняют код, скачанный из сети. Агент может выполнить их без вопроса, если считает, что так требует инструкция.
Замените разрушительные команды на безопасные аналоги с подтверждением, ограничьте область действия конкретной папкой и не тяните код через curl | bash: укажите версию и контрольную сумму.
Как улучшить
- Тело SKILL.md длиннее 5 000 токенов: вынесите справочные детали в references/ и подключайте по необходимости.
- Свои кейсы (evals/evals.json, 4–6 реальных запросов с ожидаемыми ответами): тогда полная проверка прогонит именно их, а не черновик от модели.
- spec.yaml с триггерными фразами и утверждениями — контракт поведения для CI; `skilltest init` создаст шаблон.
Находки guard · 2
✓ Критических и высоких находок нет
Средние и низкие: 2
-
средняя Опасные команды
cmd-autorun-instructionREADME.md:39Инструкция автоматически запускать скрипт в каждой сессии| 3 | "Package and Present": removed the `present_files` tool condition, simplified to always run `package_skill.py` | `present_files` is a Claude Code-exclusive tool |
-
низкая Опасные команды
cmd-autorun-instructionSKILL.md:443Инструкция автоматически запускать скрипт в каждой сессии (в кавычках — упоминание, а не команда)**IMPORTANT — generate the eval viewer before evaluating inputs yourself**: Whether you're in Claude Code, Cowork, or any other platform with a filesystem, always run `generate_review.py` after tests
в кавычках
Просканировано файлов: 20. Улики замаскированы. Пометки в серых чипах объясняют, почему серьёзность понижена.
По спецификации Agent Skills
- предупреждение
body-longтело SKILL.md ≈ 7578 токенов (рекомендуется < 5000); вынесите детали в references/
Процессный рейтинг: все десять параметров 62/100
- 0Входы и предусловия. Не сказано, что нужно иметь на входе
- 30Повторный запуск. Изменяющих операций: 17, без проверки текущего состояния
- 50Когда включается. Не сказано, при каком запросе скилл включается
- 60Инструменты и файлы. Используются инструменты (bash, python), но во frontmatter они не объявлены
- 60Шаги. Шагов: 70, расплывчатых формулировок: 4
- 70Ошибки и развилки. Развилок: 18
- 70Стоимость исполнения. Тело инструкции 7578 токенов
- 100Результат и критерий готовности. Формат результата и критерий готовности описаны
- 100Согласованность. Имя и обязательные поля на месте
- 100Отчётность по ходу. Скилл сообщает о ходе работы
- medium Правила безопасности и запреты внутри скилла: их место в системном промпте, здесь они не защищают
- low Ответ описан самодельной разметкой (9 тегов): типизированный вызов надёжнее
Всё перечисленное измерено по тексту скилла, а не оценено моделью: цифры проверяемы. Вес параметра тем больше, чем чаще из-за него процесс встаёт.
Сигналы качества
- +5В description нет примеров фраз, по которым скилл должен срабатывать
- +4Описание не говорит, когда скилл НЕ применять (ложные срабатывания)
- -35 из 9 скриптов не упомянуты в SKILL.md
- +1Лицензия не указана
- +2Инструкции на одном языке
- +3Длина description 320 символов: достаточно сигнала, не съедает бюджет
- +4Структура: 33 заголовков
- +3Пошаговые инструкции: 70 пунктов
- +3Формат ответа описан явно
- +4Есть примеры (15 блоков кода)
- +4Справочные файлы упоминаются в инструкциях (1 из 1)
База качества 70; замечания lint вычитаются, сигналы прибавляют до 100. Итог: 78.