AC yes
Используйте, когда любая задача включает изменение файлов, конфигураций, баз данных или развертываний. Используйте, когда отладка сталкивается с 2+ сбоями. Используйте, когда собираетесь угадывать или предполагать без доказательств («вероятно», «может быть», «я думаю», «должно быть»). Используйте, когда перекладываете ответственность на пользователя («пожалуйста, проверьте...», «вам следует вручную...», «вам может понадобиться...»). Используйте, когда исправляете что-то, не проверяя, работает ли оно. Используйте, когда делаете вывод или определяете первопричину. Используйте, когда пропускаете доступные инструменты (есть WebSearch, но не ищет, есть Bash, но не запускает, есть Read, но не читает). Используйте, когда ходите по кругу (один и тот же подход 3+ раза с изменением параметров). Используйте, когда завершаете исправление, не проверяя связанные проблемы. Используйте, когда задаете пользователю вопрос, который можно было бы исследовать самостоятельно. Используйте, когда даете предложения вместо действенных кодов/команд. Применяется ко ВСЕМ типам задач: отладка, реализация, конфигурация, развертывание, интеграция API, обработка данных. НЕ активируйте при сбоях на первой попытке или когда известное исправление уже в процессе.
машинный переводПоказать оригиналСкрыть оригинал«Use when any task involves modifying files, configs, databases, or dep…»
Use when any task involves modifying files, configs, databases, or deployments. Use when debugging hits 2+ failures. Use when about to guess or assume without evidence ('probably', 'might be', 'I think', 'should be'). Use when deflecting to user ('please check...', 'you should manually...', 'you may need to...'). Use when fixing something without verifying it works. Use when making a conclusion or root-cause claim. Use when skipping tools that are available (has WebSearch but doesn't search, has Bash but doesn't run, has Read but doesn't read). Use when spinning in circles (same approach 3+ times with parameter tweaks). Use when completing a fix without checking for related issues. Use when asking the user a question that could be self-investigated first. Use when giving suggestions instead of actionable code/commands. Applies to ALL task types: debugging, implementation, config, deployment, API integration, data processing. Do NOT trigger on first-attempt failures or when a known fix is already in progress.
Используйте, когда отладка сталкивается с 2+ сбоями.
Как процесс C 54/100 · Есть пробелы — слабые места: результат и критерий готовности, входы и предусловия, согласованность
Как улучшить
- Свои кейсы (evals/evals.json, 4–6 реальных запросов с ожидаемыми ответами): тогда полная проверка прогонит именно их, а не черновик от модели.
- spec.yaml с триггерными фразами и утверждениями — контракт поведения для CI; `skilltest init` создаст шаблон.
Находки guard · 0
✓ Критических и высоких находок нет
Просканировано файлов: 2. Улики замаскированы. Пометки в серых чипах объясняют, почему серьёзность понижена.
По спецификации Agent Skills
✓ По спецификации Agent Skills замечаний нет
Процессный рейтинг: все десять параметров 54/100
- 0Результат и критерий готовности. Не сказано, что считать результатом
- 0Входы и предусловия. Не сказано, что нужно иметь на входе
- 30Повторный запуск. Изменяющих операций: 10, без проверки текущего состояния
- 40Согласованность. Имя во frontmatter (yes) не совпадает с папкой (yes-md)
- 60Инструменты и файлы. Используются инструменты (bash, web, node), но во frontmatter они не объявлены
- 70Когда включается. Сказано, когда применять, но не сказано, когда не стоит
- 85Шаги. Шагов: 40, расплывчатых формулировок: 1
- 100Ошибки и развилки. Развилок: 3, есть раздел про ошибки
- 100Стоимость исполнения. Тело инструкции 2497 токенов
- 100Отчётность по ходу. Скилл сообщает о ходе работы
- medium Правила безопасности и запреты внутри скилла: их место в системном промпте, здесь они не защищают
- low Разделов верхнего уровня: 10. Похоже на несколько доменов в одном скилле
Всё перечисленное измерено по тексту скилла, а не оценено моделью: цифры проверяемы. Вес параметра тем больше, чем чаще из-за него процесс встаёт.
Сигналы качества
- +5В description нет примеров фраз, по которым скилл должен срабатывать
- +4Описание не говорит, когда скилл НЕ применять (ложные срабатывания)
- +3Длина description 1023: рекомендуется 120–800 символов
- +3Формат ответа не описан: модель каждый раз решает сама
- +1Лицензия не указана
- +2Инструкции на одном языке
- +4Структура: 15 заголовков
- +3Пошаговые инструкции: 40 пунктов
- +4Есть примеры (1 блоков кода)
База качества 70; замечания lint вычитаются, сигналы прибавляют до 100. Итог: 81.