CD ai-pm-workbench-international
AI PM Super Workbench — Международная версия. Интеллектуальный комплексный рабочий стол для ИИ-менеджеров продуктов по всему миру.
машинный переводПоказать оригиналСкрыть оригинал«AI PM Super Workbench — International Edition. Full-stack intelligent…»
AI PM Super Workbench — International Edition. Full-stack intelligent workbench for AI Product Managers worldwide.
AI PM Super Workbench — Международная версия.
Как процесс D 44/100 · Процесс не доведён — слабые места: результат и критерий готовности, когда включается, входы и предусловия
Чем это грозит
Находки средней серьёзности: скорее всего скилл честный, но прочитайте, что именно насторожило сканер.
Ниже описан худший случай для этой категории. Здесь находка средней серьёзности: guard увидел признак, но не доказательство.
В тексте есть фразы вроде «игнорируй предыдущие инструкции» или «теперь ты…». Это попытка перехватить управление агентом: он может нарушить ваши правила, системные ограничения или политику компании.
Такие фразы не нужны честному скиллу: сформулируйте роль и правила прямо, без отмены чужих инструкций. Иначе сканеры каталогов и корпоративные фильтры заблокируют публикацию.
Как улучшить
- Скажите в description, КОГДА применять скилл («используй, когда…», примеры запросов): это главный сигнал для агента.
- Тело SKILL.md длиннее 5 000 токенов: вынесите справочные детали в references/ и подключайте по необходимости.
- Свои кейсы (evals/evals.json, 4–6 реальных запросов с ожидаемыми ответами): тогда полная проверка прогонит именно их, а не черновик от модели.
- spec.yaml с триггерными фразами и утверждениями — контракт поведения для CI; `skilltest init` создаст шаблон.
Находки guard · 29
✓ Критических и высоких находок нет
Средние и низкие: 29
-
средняя Подмена инструкций
en-ignore-previousreferences/templates/ai-safety-template.md:254Фраза-перехват ("ignore previous instructions") (определение детектора / чёрного списка)├── Instruction Override: "Ignore previous instructions"
детектор -
средняя Подмена инструкций
en-role-hijackreferences/templates/ai-safety-template.md:255Подмена роли ("from now on you must ignore… / developer mode") (в кавычках — упоминание, а не команда)├── Role-play: "You are now DAN, with no restrictions"
в кавычках -
низкая Рискованное назначение
intent-offensive-securityREADME.md:21Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение) (определение детектора / чёрного списка)| 🛡️ AI safety and compliance risks are significant | **EU AI Act · China Deep Synthesis Regulations · Layered Safety Guardrails · Red Teaming** |
детектор -
низкая Рискованное назначение
intent-offensive-securityREADME.md:39Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение) (определение детектора / чёрного списка)| 9️⃣ Safety Guardrails & Red Team | Layered guardrails · Red teaming · Jailbreak prevention | AI Safety Plan |
детектор -
низкая Рискованное назначение
intent-offensive-securityREADME.md:55Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение) (определение детектора / чёрного списка)| AI Safety | Input Guardrails · Output Guardrails · PII Redaction · Jailbreak Detection · Red Teaming |
детектор -
низкая Рискованное назначение
intent-offensive-securityreferences/ai-industry-trends-2026.md:798Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)| **Safety** | Harmful content output rate | Red team testing + automated scanning | <0.1% |
-
низкая Рискованное назначение
intent-offensive-securityreferences/ai-industry-trends-2026.md:860Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение) (определение детектора / чёрного списка)### Phase 10: Safety Guardrails & Red Team Testing
детектор -
низкая Рискованное назначение
intent-offensive-securityreferences/ai-industry-trends-2026.md:872Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)└── System Layer: Agent tool abuse, privilege escalation, resource exhaustion
-
низкая Рискованное назначение
intent-offensive-securityreferences/ai-industry-trends-2026.md:885Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)#### 10.3 Red Team Testing
-
низкая Рискованное назначение
intent-offensive-securityreferences/ai-industry-trends-2026.md:887Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение) (в кавычках — упоминание, а не команда)**Lessons from Microsoft's Red Teaming of 100+ Products:**
в кавычках -
низкая Подмена инструкций
en-ignore-previousreferences/examples/ai-customer-service-example.md:389Фраза-перехват ("ignore previous instructions") (определение детектора / чёрного списка; тестовый файл / пример)- Injection Detection: LLM classifier detects patterns like "ignore previous instructions"
детектортестовый файл -
низкая Рискованное назначение
intent-offensive-securityreferences/methodologies/ai-pm-deep-methods.md:521Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)| Red Team Testing | Quarterly | Security team triggers |
-
низкая Рискованное назначение
intent-offensive-securityreferences/methodologies/ai-pm-deep-methods.md:568Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение) (определение детектора / чёрного списка)| Scale | +LLM injection detection, Hallucination detection | +Red Team testing | +Model safety assessment |
детектор -
низкая Рискованное назначение
intent-offensive-securityreferences/templates/ai-evaluation-template.md:53Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)| Adversarial Test Set | | Red team + security experts | Monthly |
-
низкая Рискованное назначение
intent-offensive-securityreferences/templates/ai-evaluation-template.md:336Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)| Red Team Test | Quarterly | Red Team Report |
-
низкая Рискованное назначение
intent-offensive-securityreferences/templates/ai-evaluation-template.md:393Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)| Adversarial Tasks | | Abnormal inputs | Red team constructed |
-
низкая Рискованное назначение
intent-offensive-securityreferences/templates/ai-prd-template.md:201Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)| Safety | Harmful Output Rate | Red Team Testing | <0.1% |
-
низкая Подмена инструкций
en-ignore-previousreferences/templates/ai-safety-template.md:89Фраза-перехват ("ignore previous instructions") (определение детектора / чёрного списка; строка таблицы в документации)| Role-play Jailbreak | Detect "You are now..." type instructions | "DAN mode", "Ignore previous instructions" |
детектортаблица -
низкая Рискованное назначение
intent-offensive-securityreferences/templates/ai-safety-template.md:182Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)| Privilege Escalation | Agent gains permissions beyond design | Least privilege principle + permission audit |
-
низкая Рискованное назначение
intent-offensive-securityreferences/templates/ai-safety-template.md:236Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)## 7. Red Team Testing
-
низкая Рискованное назначение
intent-offensive-securityreferences/templates/ai-safety-template.md:248Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)| Agent Attack | Tool Abuse/Privilege Escalation | 50+ | Each Agent update |
-
низкая Рискованное назначение
intent-offensive-securityreferences/templates/ai-safety-template.md:269Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)### 7.3 Red Team Testing Process
-
низкая Рискованное назначение
intent-offensive-securityreferences/templates/ai-safety-template.md:376Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)□ Red Team Testing: Completed with no P0/P1 issues
-
низкая Рискованное назначение
intent-offensive-securityreferences/templates/ai-strategy-template.md:131Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение) (определение детектора / чёрного списка)| Security/Compliance | | | Guardrails + Red Team Testing + Compliance Review |
детектор -
низкая Рискованное назначение
intent-offensive-securitySKILL.md:58Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение) (определение детектора / чёрного списка)| Implement safety guardrails / Red teaming | [Phase 10: Safety Guardrails & Red Teaming](#phas…ing) |
детектор -
низкая Рискованное назначение
intent-offensive-securitySKILL.md:467Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение) (определение детектора / чёрного списка)| **Fairness & Safety** | Bias detection, harmful content filtering rate | Bias audit, Red teaming |
детектор -
низкая Рискованное назначение
intent-offensive-securitySKILL.md:569Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение) (определение детектора / чёрного списка)### Phase 10: Safety Guardrails & Red Teaming
детектор -
низкая Рискованное назначение
intent-offensive-securitySKILL.md:602Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)□ Red team testing completed and high-risk items fixed
-
низкая Рискованное назначение
intent-offensive-securitySKILL.md:655Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение) (определение детектора / чёрного списка)□ AI Security Basics (Injection / Jailbreak / Guardrails / Red Team Testing)
детектор
Просканировано файлов: 18. Улики замаскированы. Пометки в серых чипах объясняют, почему серьёзность понижена.
По спецификации Agent Skills
- предупреждение
description-no-whendescription не говорит, КОГДА применять скилл (нет "use when / используй когда") - предупреждение
body-longтело SKILL.md ≈ 22097 токенов (рекомендуется < 5000); вынесите детали в references/ - заметка
frontmatter-keyнеизвестное поле фронтматтера "language" - заметка
frontmatter-keyнеизвестное поле фронтматтера "contact"
Процессный рейтинг: все десять параметров 44/100
- 0Результат и критерий готовности. Не сказано, что считать результатом
- 0Входы и предусловия. Не сказано, что нужно иметь на входе
- 0Отчётность по ходу. Скилл ничего не сообщает по ходу работы
- 10Стоимость исполнения. Тело инструкции 22097 токенов: вытесняет саму задачу из окна
- 20Когда включается. Не сказано, при каком запросе скилл включается
- 30Повторный запуск. Изменяющих операций: 19, без проверки текущего состояния
- 50Ошибки и развилки. Развилок: 0, есть раздел про ошибки
- 60Шаги. Шагов: 33, расплывчатых формулировок: 4
- 100Инструменты и файлы. Внешние инструменты не нужны
- 100Согласованность. Имя и обязательные поля на месте
- medium Правила безопасности и запреты внутри скилла: их место в системном промпте, здесь они не защищают
- low Разделов верхнего уровня: 44. Похоже на несколько доменов в одном скилле
Всё перечисленное измерено по тексту скилла, а не оценено моделью: цифры проверяемы. Вес параметра тем больше, чем чаще из-за него процесс встаёт.
Сигналы качества
- +5В description нет примеров фраз, по которым скилл должен срабатывать
- +4Описание не говорит, когда скилл НЕ применять (ложные срабатывания)
- +3Длина description 114: рекомендуется 120–800 символов
- +3Формат ответа не описан: модель каждый раз решает сама
- -248 эмодзи в инструкциях: шум для модели
- +2Инструкции на одном языке
- +4Структура: 154 заголовков
- +3Пошаговые инструкции: 33 пунктов
- +4Есть примеры (37 блоков кода)
- +4Справочные файлы упоминаются в инструкциях (1 из 1)
- +1Лицензия указана
База качества 70; замечания lint вычитаются, сигналы прибавляют до 100. Итог: 60.