BC bug-reproduction
Превращает расплывчатый отчет об ошибке в ПОДТВЕРЖДЕННУЮ минимальную репродукцию, а затем в падающий регрессионный тест, управляемый агентом от начала до конца. Охватывает извлечение неявной репродукции из краткого отчета (среда, сборка, шаги, данные), цикл воспроизвести-минимизировать-изолировать-захватить, git bisect для поиска коммита, внесшего ошибку, создание детерминированной минимальной репродукции (фиксированные зерна, замороженное время, заглушенная сеть), написание падающего регрессионного теста ДО исправления (красный) и подтверждение того, что исправление делает его зеленым, а также запись доказательств репродукции обратно в тикет. Различает нестабильные-невоспроизводимые от специфичных для среды. Используйте, когда: «воспроизвести эту ошибку», «минимальная репродукция», «шаги воспроизведения», «найти коммит, который это сломал», «git bisect», «сделать репродукцию детерминированной», «написать падающий тест для этой ошибки», «регрессионный тест для дефекта», «не могу воспроизвести эту ошибку». Не для: классификации/дедупликации/маршрутизации существующих сбоев по степени серьезности без их воспроизведения — это ai-bug-triage. Генерации тестов из спецификаций, а не из дефекта — это ai-test-generation. Связанные: ai-bug-triage, ai-test-generation, test-reliability, systematic-debugging, qa-project-context.
машинный переводПоказать оригиналСкрыть оригинал«Turn a vague bug report into a VERIFIED minimal reproduction and then…»
Turn a vague bug report into a VERIFIED minimal reproduction and then a failing regression test, agent-driven end to end. Covers extracting the implicit repro from a thin report (env, build, steps, data), the reproduce-minimize-isolate-capture loop, git bisect to find the introducing commit, building a deterministic minimal repro (fixed seeds, frozen time, stubbed network), writing the failing regression test BEFORE the fix (red) and confirming the fix flips it green, and writing repro evidence back into the ticket. Distinguishes flaky-not-reproducible from environment-specific. Use when: "reproduce this bug," "minimal reproduction," "repro steps," "find the commit that broke it," "git bisect," "make the repro deterministic," "write a failing test for this bug," "regression test for a defect," "can't reproduce this bug." Not for: Classifying/deduplicating/severity-routing existing failures without reproducing them — that is ai-bug-triage. Generating tests from specs rather than from a defect — that is ai-test-generation. Related: ai-bug-triage, ai-test-generation, test-reliability, systematic-debugging, qa-project-context.
Превращает расплывчатый отчет об ошибке в ПОДТВЕРЖДЕННУЮ минимальную репродукцию, а затем в падающий регрессионный тест, управляемый агентом от начала до конца.
Как процесс C 64/100 · Есть пробелы — слабые места: результат и критерий готовности, входы и предусловия, повторный запуск
Как улучшить
- Сократите description до 1024 символов.
- Тело SKILL.md длиннее 5 000 токенов: вынесите справочные детали в references/ и подключайте по необходимости.
- Свои кейсы (evals/evals.json, 4–6 реальных запросов с ожидаемыми ответами): тогда полная проверка прогонит именно их, а не черновик от модели.
- spec.yaml с триггерными фразами и утверждениями — контракт поведения для CI; `skilltest init` создаст шаблон.
Находки guard · 0
✓ Критических и высоких находок нет
Просканировано файлов: 5. Улики замаскированы. Пометки в серых чипах объясняют, почему серьёзность понижена.
По спецификации Agent Skills
- ошибка
description-longdescription 1140 символов, лимит 1024 - предупреждение
body-longтело SKILL.md ≈ 5462 токенов (рекомендуется < 5000); вынесите детали в references/ - заметка
edit-residueв тексте есть пометки об устаревшем (строки 192, 193): проверьте, не остались ли старые правила рядом с новыми — полная проверка читает текст на противоречия
Процессный рейтинг: все десять параметров 64/100
- 0Отчётность по ходу. Скилл ничего не сообщает по ходу работы
- 30Входы и предусловия. Не сказано, что нужно иметь на входе
- 30Повторный запуск. Изменяющих операций: 40, без проверки текущего состояния
- 40Результат и критерий готовности. Не сказано, что считать результатом
- 50Когда включается. Не сказано, при каком запросе скилл включается
- 60Инструменты и файлы. Используются инструменты (bash, web), но во frontmatter они не объявлены
- 70Стоимость исполнения. Тело инструкции 5462 токенов
- 100Шаги. Шагов: 57
- 100Ошибки и развилки. Развилок: 1, есть раздел про ошибки
- 100Согласованность. Имя и обязательные поля на месте
- medium Правила безопасности и запреты внутри скилла: их место в системном промпте, здесь они не защищают
- low Разделов верхнего уровня: 16. Похоже на несколько доменов в одном скилле
- low Ответ описан самодельной разметкой (3 тегов): типизированный вызов надёжнее
Всё перечисленное измерено по тексту скилла, а не оценено моделью: цифры проверяемы. Вес параметра тем больше, чем чаще из-за него процесс встаёт.
Сигналы качества
- +3Длина description 1140: рекомендуется 120–800 символов
- +3Формат ответа не описан: модель каждый раз решает сама
- +2Инструкции на одном языке
- +5В description 9 примера фраз-триггеров в кавычках
- +4Описание говорит, когда скилл НЕ применять
- +4Структура: 26 заголовков
- +3Пошаговые инструкции: 57 пунктов
- +4Есть примеры (1 блоков кода)
- +4Справочные файлы упоминаются в инструкциях (4 из 4)
- +1Лицензия указана
База качества 70; замечания lint вычитаются, сигналы прибавляют до 100. Итог: 60.