AB bug-audit
Комплексный аудит ошибок для Node.js веб-проектов. Активируйте, когда пользователь просит аудировать, проверять, искать ошибки, находить уязвимости или проводить проверку безопасности/качества проекта. Работает путем разбора фактического кода проекта для создания матриц проверок, специфичных для проекта, а затем исчерпывающей проверки каждого элемента — а не путем выполнения общего контрольного списка. Поддерживает игры, инструменты для работы с данными, приложения WeChat, API-сервисы, ботов и дашборды.
машинный переводПоказать оригиналСкрыть оригинал«Comprehensive bug audit for Node.js web projects. Activate when user a…»
Comprehensive bug audit for Node.js web projects. Activate when user asks to audit, review, check bugs, find vulnerabilities, or do security/quality review on a project. Works by dissecting the project's actual code to build project-specific check matrices, then exhaustively verifying each item — not by running a generic checklist. Supports games, data tools, WeChat apps, API services, bots, and dashboards.
Комплексный аудит ошибок для Node.js веб-проектов. Активируйте, когда пользователь просит аудировать, проверять, искать ошибки, находить уязвимости или…
Как процесс B 74/100 · Почти готов — слабые места: когда включается, повторный запуск, отчётность по ходу
Как улучшить
- Свои кейсы (evals/evals.json, 4–6 реальных запросов с ожидаемыми ответами): тогда полная проверка прогонит именно их, а не черновик от модели.
- spec.yaml с триггерными фразами и утверждениями — контракт поведения для CI; `skilltest init` создаст шаблон.
Находки guard · 6
✓ Критических и высоких находок нет
Средние и низкие: 6
-
низкая Рискованное назначение
intent-offensive-securityreferences/redblue.md:1Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)# Red Team / Blue Team Playbook
-
низкая Рискованное назначение
intent-offensive-securityreferences/redblue.md:333Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)For EVERY red team finding, verify all 4 layers:
-
низкая Рискованное назначение
intent-offensive-securityskill-card.md:30Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)- [Red Team / Blue Team Playbook](references/redblue.md) <br>
-
низкая Рискованное назначение
intent-offensive-securitySKILL.md:129Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)## Phase 3: Red Team / Blue Team
-
низкая Рискованное назначение
intent-offensive-securitySKILL.md:192Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)- `references/redblue.md` — Red team attack chains (universal + 6 project types) and blue team defense verification playbook for Phase 3.
Ещё 1 совпадений отнесены к цитатам в документации скилла по безопасности и не считаются находками.
Просканировано файлов: 6. Улики замаскированы. Пометки в серых чипах объясняют, почему серьёзность понижена.
По спецификации Agent Skills
✓ По спецификации Agent Skills замечаний нет
Процессный рейтинг: все десять параметров 74/100
- 0Отчётность по ходу. Скилл ничего не сообщает по ходу работы
- 20Когда включается. Не сказано, при каком запросе скилл включается
- 30Повторный запуск. Изменяющих операций: 5, без проверки текущего состояния
- 60Результат и критерий готовности. Формат результата описан, критерия завершения нет
- 70Входы и предусловия. Входные данные и предусловия перечислены
- 70Ошибки и развилки. Развилок: 6
- 100Инструменты и файлы. Внешние инструменты не нужны
- 100Шаги. Шагов: 69
- 100Согласованность. Имя и обязательные поля на месте
- 100Стоимость исполнения. Тело инструкции 2138 токенов
Всё перечисленное измерено по тексту скилла, а не оценено моделью: цифры проверяемы. Вес параметра тем больше, чем чаще из-за него процесс встаёт.
Сигналы качества
- +5В description нет примеров фраз, по которым скилл должен срабатывать
- +4Описание не говорит, когда скилл НЕ применять (ложные срабатывания)
- -229 эмодзи в инструкциях: шум для модели
- +1Лицензия не указана
- +2Инструкции на одном языке
- +3Длина description 410 символов: достаточно сигнала, не съедает бюджет
- +4Структура: 18 заголовков
- +3Пошаговые инструкции: 69 пунктов
- +3Формат ответа описан явно
- +4Есть примеры (8 блоков кода)
- +4Справочные файлы упоминаются в инструкциях (3 из 3)
База качества 70; замечания lint вычитаются, сигналы прибавляют до 100. Итог: 89.