SKILLEMALL.ai

AB troubleshoot

Исследуйте неожиданное поведение в текущем сеансе агента Copilot, анализируя его журнал событий. Используйте, когда пользователь спрашивает, почему что-то произошло, почему запрос был медленным, почему инструмент был использован или не использован, или почему инструкции/навыки/агенты не загрузились.

машинный переводПоказать оригиналСкрыть оригинал«Investigate unexpected behavior in the current Copilot agent session b…»

Investigate unexpected behavior in the current Copilot agent session by analyzing its event log. Use when the user asks why something happened, why a request was slow, why a tool was or was not used, or why instructions/skills/agents did not load.

Разбор skillemall

Скилл для разбора того, почему агент Copilot сделал не то, что ожидалось. Залезает в лог событий сессии, ищет причину медленного ответа, непредвиденного поведения, неиспользованного инструмента или ошибки загрузки. В файлах нет критических ошибок, линтер молчит, safety-score на 100. Quality на 87 — хороший показатель для аналитического скилла, процесс-скор 68 означает, что логика есть, но в деталях работы есть зазоры.

Проверок на моделях не было, песочница не запускалась — скилл протестирован только статически. Он совместим с основными платформами: Claude, Cursor, Copilot и ещё дюжиной других. Для отладки сессии — нужный инструмент, если верить оценкам. Ставить можно, но без иллюзий: реальное поведение покажется только в боевых условиях.

microsoft/vscode Agent Skills автор: microsoft MIT 1 файл тело ≈ 3 307 токенов Открыть источникgithub.com↗ проанализирован 2 дн назад

Исследуйте неожиданное поведение в текущем сеансе агента Copilot, анализируя его журнал событий.

Как процесс B 68/100 · Почти готов — слабые места: входы и предусловия, повторный запуск

АнализаторVS CodeИИ и агентытип и темы размечены автоматически по тексту скилла
JSON
Технический рейтинг
A
95/100
безопасность, качество, тесты
Безопасность 60%
100
Качество 40%
87
Прогон на моделях
не было
Процессный рейтинг
B
68/100
Почти готов
Входы и предусловия вес 11
0
Повторный запуск вес 4
30
Инструменты и файлы вес 18
60
три самых слабых из десяти параметров · все десять

Как улучшить

    Для прогона на моделях — необязательно
    • Свои кейсы (evals/evals.json, 4–6 реальных запросов с ожидаемыми ответами): тогда полная проверка прогонит именно их, а не черновик от модели.
    • spec.yaml с триггерными фразами и утверждениями — контракт поведения для CI; `skilltest init` создаст шаблон.

    Находки guard · 0

    ✓ Критических и высоких находок нет

    Просканировано файлов: 1. Улики замаскированы. Пометки в серых чипах объясняют, почему серьёзность понижена.

    По спецификации Agent Skills

    ✓ По спецификации Agent Skills замечаний нет

    Процессный рейтинг: все десять параметров 68/100

    • 0Входы и предусловия. Не сказано, что нужно иметь на входе
    • 30Повторный запуск. Изменяющих операций: 7, без проверки текущего состояния
    • 60Инструменты и файлы. Используются инструменты (bash, node), но во frontmatter они не объявлены
    • 60Результат и критерий готовности. Формат результата описан, критерия завершения нет
    • 70Когда включается. Сказано, когда применять, но не сказано, когда не стоит
    • 85Шаги. Шагов: 65, расплывчатых формулировок: 1
    • 100Ошибки и развилки. Развилок: 1, есть раздел про ошибки
    • 100Согласованность. Имя и обязательные поля на месте
    • 100Стоимость исполнения. Тело инструкции 3307 токенов
    • 100Отчётность по ходу. Скилл сообщает о ходе работы
    • medium Правила безопасности и запреты внутри скилла: их место в системном промпте, здесь они не защищают
    • low Ответ описан самодельной разметкой (13 тегов): типизированный вызов надёжнее

    Всё перечисленное измерено по тексту скилла, а не оценено моделью: цифры проверяемы. Вес параметра тем больше, чем чаще из-за него процесс встаёт.

    Сигналы качества

    • +5В description нет примеров фраз, по которым скилл должен срабатывать
    • +4Описание не говорит, когда скилл НЕ применять (ложные срабатывания)
    • +1Лицензия не указана
    • +2Инструкции на одном языке
    • +3Длина description 247 символов: достаточно сигнала, не съедает бюджет
    • +4Структура: 18 заголовков
    • +3Пошаговые инструкции: 65 пунктов
    • +3Формат ответа описан явно
    • +4Есть примеры (4 блоков кода)

    База качества 70; замечания lint вычитаются, сигналы прибавляют до 100. Итог: 87.