BC qa-architecture-auditor
Выполняет анализ кодовой базы на уровне криминалистики и генерирует исчерпывающие отчеты о стратегии обеспечения качества и тестирования. Действует как независимый главный архитектор QA, старший аудитор безопасности программного обеспечения и аудитор ИТ-систем. Использует политику нулевого доверия (игнорирует существующие тесты) и охватывает все методологии тестирования: Black Box, White Box, ручное, автоматизированное, модульное, интеграционное, системное, функциональное, дымовое, санитарное, сквозное (E2E), регрессионное, API, целостность базы данных, производительность, безопасность, удобство использования, совместимость, доступность, локализация, приемочное и исследовательское тестирование. Используется, когда требуется полная, независимая стратегия тестирования с нуля для любого репозитория кода.
машинный переводПоказать оригиналСкрыть оригинал«Perform forensic-level codebase analysis and generate comprehensive Qu…»
Perform forensic-level codebase analysis and generate comprehensive Quality Assurance and Testing Strategy Reports. Acts as Independent Principal QA Architect, Senior Software Security Auditor, and IT Systems Auditor. Uses zero-trust policy (ignores existing tests) and addresses all testing methodologies: Black Box, White Box, Manual, Automated, Unit, Integration, System, Functional, Smoke, Sanity, E2E, Regression, API, Database Integrity, Performance, Security, Usability, Compatibility, Accessibility, Localization, Acceptance, and Exploratory Testing. Use when needing a complete, independent testing strategy from scratch for any code repository.
Выполняет анализ кодовой базы на уровне криминалистики и генерирует исчерпывающие отчеты о стратегии обеспечения качества и тестирования.
Как процесс C 52/100 · Есть пробелы — слабые места: результат и критерий готовности, когда включается, входы и предусловия
Как улучшить
- Свои кейсы (evals/evals.json, 4–6 реальных запросов с ожидаемыми ответами): тогда полная проверка прогонит именно их, а не черновик от модели.
- spec.yaml с триггерными фразами и утверждениями — контракт поведения для CI; `skilltest init` создаст шаблон.
Находки guard · 9
✓ Критических и высоких находок нет
Средние и низкие: 9
-
низкая Рискованное назначение
intent-offensive-securityreferences/compliance-frameworks.md:26Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение) (определение детектора / чёрного списка)- **Security**: Security testing section covers OWASP Top 10, vulnerability scanning, penetration testing.
детектор -
низкая Рискованное назначение
intent-offensive-securityreferences/compliance-frameworks.md:43Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение) (определение детектора / чёрного списка)- **Incident Management**: Security testing includes vulnerability scanning and penetration testing.
детектор -
низкая Рискованное назначение
intent-offensive-securityreferences/methodologies.md:372Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)- Manual penetration testing at least annually or before major releases
-
низкая Рискованное назначение
intent-offensive-securityreferences/methodologies.md:378Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)- **Authorization Flaws**: Horizontal privilege escalation (User A access User B data); Vertical privilege escalation (user access admin functions)
-
низкая Рискованное назначение
intent-offensive-securityreferences/methodologies.md:393Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)- Penetration Testing: Manual with Burp Suite, custom scripts
-
низкая Рискованное назначение
intent-offensive-securityreferences/risk-assessment.md:200Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)- **Critical**: Test exhaustively using all methodologies. Red team exercises. Penetration testing.
-
низкая Рискованное назначение
intent-offensive-securityreferences/tooling-matrix.md:240Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)| | **Burp Suite** | Professional penetration testing | Manual + automated |
-
низкая Рискованное назначение
intent-offensive-securityreferences/tooling-matrix.md:298Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)17. **Penetration Testing**: Annual or release-based manual testing
-
низкая Рискованное назначение
intent-offensive-securityself-audit.md:241Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение) (определение детектора / чёрного списка)**Strategy:** Automated scanning, penetration testing, code reviews for OWASP Top 10, dependency vulnerability checks, and threat modeling.
детектор
Просканировано файлов: 10. Улики замаскированы. Пометки в серых чипах объясняют, почему серьёзность понижена.
По спецификации Agent Skills
- заметка
frontmatter-keyнеизвестное поле фронтматтера "homepage"
Процессный рейтинг: все десять параметров 52/100
- 0Входы и предусловия. Не сказано, что нужно иметь на входе
- 0Ошибки и развилки. Линейный процесс без обработки сбоев
- 0Отчётность по ходу. Скилл ничего не сообщает по ходу работы
- 20Когда включается. Не сказано, при каком запросе скилл включается
- 40Результат и критерий готовности. Не сказано, что считать результатом
- 60Инструменты и файлы. Используются инструменты (bash, web, git, python), но во frontmatter они не объявлены
- 100Шаги. Шагов: 40
- 100Согласованность. Имя и обязательные поля на месте
- 100Стоимость исполнения. Тело инструкции 1529 токенов
- 100Повторный запуск. Изменяющих операций нет
- medium Правила безопасности и запреты внутри скилла: их место в системном промпте, здесь они не защищают
- low Разделов верхнего уровня: 13. Похоже на несколько доменов в одном скилле
Всё перечисленное измерено по тексту скилла, а не оценено моделью: цифры проверяемы. Вес параметра тем больше, чем чаще из-за него процесс встаёт.
Сигналы качества
- +5В description нет примеров фраз, по которым скилл должен срабатывать
- +4Описание не говорит, когда скилл НЕ применять (ложные срабатывания)
- +3Формат ответа не описан: модель каждый раз решает сама
- -31 из 1 скриптов не упомянуты в SKILL.md
- +1Лицензия не указана
- +2Инструкции на одном языке
- +3Длина description 654 символов: достаточно сигнала, не съедает бюджет
- +4Структура: 14 заголовков
- +3Пошаговые инструкции: 40 пунктов
- +4Есть примеры (2 блоков кода)
- +4Справочные файлы упоминаются в инструкциях (4 из 4)
База качества 70; замечания lint вычитаются, сигналы прибавляют до 100. Итог: 84.