AC ai-test-generation
Используйте ИИ для написания НОВОГО тестового кода по спецификациям, PRD, пользовательским историям, различиям в коде, отчетам об ошибках или спецификациям OpenAPI. Поэтапный конвейер: извлечение требований → анализ рисков → матрица покрытия → генерация сценариев → проектирование оракула → тестовый код → проверка человеком, с защитой от галлюцинаций API и слабых утверждений. Используйте, когда: «генерировать тесты из спецификации», «тесты из PRD», «тесты из пользовательской истории», «автоматически генерировать тестовые случаи», «ИИ напиши тесты для меня». Не для: тестирования функций ИИ/LLM в вашем продукте — используйте ai-system-testing. Не для: аудита существующего набора тестов, который вы только что не сгенерировали — используйте ai-qa-review (Шаг 7 здесь проверяет только тесты, созданные ЭТИМ конвейером). Связанные темы: playwright-automation, unit-testing, api-testing, qa-project-context.
машинный переводПоказать оригиналСкрыть оригинал«Use AI to write NEW test code from specs, PRDs, user stories, code dif…»
Use AI to write NEW test code from specs, PRDs, user stories, code diffs, bug reports, or OpenAPI specs. Staged pipeline: requirements extraction → risk analysis → coverage matrix → scenario generation → oracle design → test code → human review, with guardrails against hallucinated APIs and weak assertions. Use when: "generate tests from spec," "tests from PRD," "tests from user story," "auto-generate test cases," "AI write tests for me." Not for: testing AI/LLM features in your product — use ai-system-testing. Not for: auditing a pre-existing test suite you did not just generate — use ai-qa-review (Step 7 here only reviews tests THIS pipeline produced). Related: playwright-automation, unit-testing, api-testing, qa-project-context.
Используйте ИИ для написания НОВОГО тестового кода по спецификациям, PRD, пользовательским историям, различиям в коде, отчетам об ошибках или спецификациям…
Как процесс C 51/100 · Есть пробелы — слабые места: результат и критерий готовности, входы и предусловия, ошибки и развилки
Как улучшить
- Свои кейсы (evals/evals.json, 4–6 реальных запросов с ожидаемыми ответами): тогда полная проверка прогонит именно их, а не черновик от модели.
- spec.yaml с триггерными фразами и утверждениями — контракт поведения для CI; `skilltest init` создаст шаблон.
Находки guard · 1
✓ Критических и высоких находок нет
Средние и низкие: 1
-
низкая Рискованное назначение
intent-offensive-securitySKILL.md:125Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение) (определение детектора / чёрного списка)| Security | Auth bypass, injection, privilege escalation |
детектор
Просканировано файлов: 2. Улики замаскированы. Пометки в серых чипах объясняют, почему серьёзность понижена.
По спецификации Agent Skills
✓ По спецификации Agent Skills замечаний нет
Процессный рейтинг: все десять параметров 51/100
- 0Входы и предусловия. Не сказано, что нужно иметь на входе
- 0Ошибки и развилки. Линейный процесс без обработки сбоев
- 0Отчётность по ходу. Скилл ничего не сообщает по ходу работы
- 30Повторный запуск. Изменяющих операций: 3, без проверки текущего состояния
- 40Результат и критерий готовности. Не сказано, что считать результатом
- 50Когда включается. Не сказано, при каком запросе скилл включается
- 60Инструменты и файлы. Используются инструменты (python), но во frontmatter они не объявлены
- 70Стоимость исполнения. Тело инструкции 4599 токенов
- 100Шаги. Шагов: 66
- 100Согласованность. Имя и обязательные поля на месте
- medium Правила безопасности и запреты внутри скилла: их место в системном промпте, здесь они не защищают
- low Разделов верхнего уровня: 11. Похоже на несколько доменов в одном скилле
- low Ответ описан самодельной разметкой (3 тегов): типизированный вызов надёжнее
Всё перечисленное измерено по тексту скилла, а не оценено моделью: цифры проверяемы. Вес параметра тем больше, чем чаще из-за него процесс встаёт.
Сигналы качества
- +3Формат ответа не описан: модель каждый раз решает сама
- +2Инструкции на одном языке
- +5В description 5 примера фраз-триггеров в кавычках
- +4Описание говорит, когда скилл НЕ применять
- +3Длина description 741 символов: достаточно сигнала, не съедает бюджет
- +4Структура: 18 заголовков
- +3Пошаговые инструкции: 66 пунктов
- +4Есть примеры (3 блоков кода)
- +4Справочные файлы упоминаются в инструкциях (1 из 1)
- +1Лицензия указана
База качества 70; замечания lint вычитаются, сигналы прибавляют до 100. Итог: 98.