BD yes-zh
Активируется, когда задача включает изменение файлов, настроек, баз данных или развертывание. Активируется при двух и более последовательных неудачных попытках отладки. Активируется, когда делается предположение или гипотеза без доказательств («должно быть», «возможно», «я думаю», «чувствую, что»). Активируется, когда проблема перекладывается на пользователя («пожалуйста, проверьте», «рекомендуется вручную», «вам может понадобиться»). Активируется, когда после внесения изменений говорится о завершении без проверки. Активируется при вынесении заключений или определении корневой причины. Активируется, когда используется инструмент, но он не применяется (не ищет WebSearch, не запускает Bash, не читает Read). Активируется, когда происходит топтание на месте (более 3 раз изменение в одном направлении только для параметров). Активируется, когда после исправления бага не проверяются связанные проблемы. Активируется, когда задается вопрос без предварительного самостоятельного поиска. Активируется, когда дается только рекомендация без кода или инструкций. Применимо ко всем типам задач: отладка, разработка, настройка, развертывание, интеграция API, обработка данных. Не активируется при первой неудаче или во время выполнения известного решения по исправлению.
машинный переводПоказать оригиналСкрыть оригинал«當任務涉及修改檔案、設定、資料庫或部署時觸發。當除錯連續失敗 2 次以上時觸發。當即將猜測或假設而沒有證據時觸發(「應該是」「可能是」「我覺…»
當任務涉及修改檔案、設定、資料庫或部署時觸發。當除錯連續失敗 2 次以上時觸發。當即將猜測或假設而沒有證據時觸發(「應該是」「可能是」「我覺得」「感覺是」)。當把問題推給用戶時觸發(「請你檢查」「建議您手動」「你可能需要」)。當改完東西沒有驗證就說完成時觸發。當下結論或判定根因時觸發。當有工具卻不用時觸發(有 WebSearch 不搜、有 Bash 不跑、有 Read 不讀)。當原地打轉時觸發(同一個方向改 3 次以上只調參數)。當修完 bug 沒有檢查關聯問題時觸發。當空手提問卻沒先自己查過時觸發。當只給建議不給代碼或指令時觸發。適用於所有任務類型:除錯、開發、設定、部署、API 串接、資料處理。首次失敗或已知修復方案執行中不觸發。
Активируется, когда задача включает изменение файлов, настроек, баз данных или развертывание.
Как процесс D 43/100 · Процесс не доведён — слабые места: результат и критерий готовности, когда включается, входы и предусловия
Как улучшить
- Скажите в description, КОГДА применять скилл («используй, когда…», примеры запросов): это главный сигнал для агента.
- Свои кейсы (evals/evals.json, 4–6 реальных запросов с ожидаемыми ответами): тогда полная проверка прогонит именно их, а не черновик от модели.
- spec.yaml с триггерными фразами и утверждениями — контракт поведения для CI; `skilltest init` создаст шаблон.
Находки guard · 0
✓ Критических и высоких находок нет
Просканировано файлов: 2. Улики замаскированы. Пометки в серых чипах объясняют, почему серьёзность понижена.
По спецификации Agent Skills
- предупреждение
description-no-whendescription не говорит, КОГДА применять скилл (нет "use when / используй когда")
Процессный рейтинг: все десять параметров 43/100
- 0Результат и критерий готовности. Не сказано, что считать результатом
- 0Входы и предусловия. Не сказано, что нужно иметь на входе
- 0Ошибки и развилки. Линейный процесс без обработки сбоев
- 20Когда включается. Не сказано, при каком запросе скилл включается
- 40Согласованность. Имя во frontmatter (yes-zh) не совпадает с папкой (yes-md-zh)
- 60Инструменты и файлы. Используются инструменты (bash, web, node), но во frontmatter они не объявлены
- 100Шаги. Шагов: 40
- 100Стоимость исполнения. Тело инструкции 1092 токенов
- 100Повторный запуск. Изменяющих операций нет
- 100Отчётность по ходу. Скилл сообщает о ходе работы
- low Разделов верхнего уровня: 10. Похоже на несколько доменов в одном скилле
Всё перечисленное измерено по тексту скилла, а не оценено моделью: цифры проверяемы. Вес параметра тем больше, чем чаще из-за него процесс встаёт.
Сигналы качества
- +5В description нет примеров фраз, по которым скилл должен срабатывать
- +4Описание не говорит, когда скилл НЕ применять (ложные срабатывания)
- +3Формат ответа не описан: модель каждый раз решает сама
- +1Лицензия не указана
- +2Инструкции на одном языке
- +3Длина description 321 символов: достаточно сигнала, не съедает бюджет
- +4Структура: 15 заголовков
- +3Пошаговые инструкции: 40 пунктов
- +4Есть примеры (1 блоков кода)
База качества 70; замечания lint вычитаются, сигналы прибавляют до 100. Итог: 72.