SKILLEMALL.ai

CD ai-pm-workbench-international

AI PM Super Workbench — Международная версия. Интеллектуальный комплексный рабочий стол для ИИ-менеджеров продуктов по всему миру.

машинный переводПоказать оригиналСкрыть оригинал«AI PM Super Workbench — International Edition. Full-stack intelligent…»

AI PM Super Workbench — International Edition. Full-stack intelligent workbench for AI Product Managers worldwide.

ClawHub Agent Skills автор: yinjianheng v1.2.0-intl MIT-0 18 файлов тело ≈ 22 097 токенов Открыть источникclawhub.ai проанализирован 2 дн назад

AI PM Super Workbench — Международная версия.

Как процесс D 44/100 · Процесс не доведён — слабые места: результат и критерий готовности, когда включается, входы и предусловия

ПроцедураИИ и агентытип и темы размечены автоматически по тексту скилла
JSON
Технический рейтинг
C
62/100
безопасность, качество, тесты
Безопасность 60%
63
Качество 40%
60
Прогон на моделях
не было
Процессный рейтинг
D
44/100
Процесс не доведён
Результат и критерий готовности вес 14
0
Входы и предусловия вес 11
0
Отчётность по ходу вес 2
0
три самых слабых из десяти параметров · все десять

Чем это грозит

Находки средней серьёзности: скорее всего скилл честный, но прочитайте, что именно насторожило сканер.

Подмена инструкций средняя серьёзность

Ниже описан худший случай для этой категории. Здесь находка средней серьёзности: guard увидел признак, но не доказательство.

Если установить

В тексте есть фразы вроде «игнорируй предыдущие инструкции» или «теперь ты…». Это попытка перехватить управление агентом: он может нарушить ваши правила, системные ограничения или политику компании.

Автору

Такие фразы не нужны честному скиллу: сформулируйте роль и правила прямо, без отмены чужих инструкций. Иначе сканеры каталогов и корпоративные фильтры заблокируют публикацию.

Как улучшить

  1. Скажите в description, КОГДА применять скилл («используй, когда…», примеры запросов): это главный сигнал для агента.
  2. Тело SKILL.md длиннее 5 000 токенов: вынесите справочные детали в references/ и подключайте по необходимости.
Для прогона на моделях — необязательно
  • Свои кейсы (evals/evals.json, 4–6 реальных запросов с ожидаемыми ответами): тогда полная проверка прогонит именно их, а не черновик от модели.
  • spec.yaml с триггерными фразами и утверждениями — контракт поведения для CI; `skilltest init` создаст шаблон.

Находки guard · 29

✓ Критических и высоких находок нет

Средние и низкие: 29
  • средняя Подмена инструкций en-ignore-previous references/templates/ai-safety-template.md:254
    Фраза-перехват ("ignore previous instructions") (определение детектора / чёрного списка)
    ├── Instruction Override: "Ignore previous instructions"
    детектор
  • средняя Подмена инструкций en-role-hijack references/templates/ai-safety-template.md:255
    Подмена роли ("from now on you must ignore… / developer mode") (в кавычках — упоминание, а не команда)
    ├── Role-play: "You are now DAN, with no restrictions"
    в кавычках
  • низкая Рискованное назначение intent-offensive-security README.md:21
    Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение) (определение детектора / чёрного списка)
    | 🛡️ AI safety and compliance risks are significant | **EU AI Act · China Deep Synthesis Regulations · Layered Safety Guardrails · Red Teaming** |
    детектор
  • низкая Рискованное назначение intent-offensive-security README.md:39
    Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение) (определение детектора / чёрного списка)
    | 9️⃣ Safety Guardrails & Red Team | Layered guardrails · Red teaming · Jailbreak prevention | AI Safety Plan |
    детектор
  • низкая Рискованное назначение intent-offensive-security README.md:55
    Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение) (определение детектора / чёрного списка)
    | AI Safety | Input Guardrails · Output Guardrails · PII Redaction · Jailbreak Detection · Red Teaming |
    детектор
  • низкая Рискованное назначение intent-offensive-security references/ai-industry-trends-2026.md:798
    Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)
    | **Safety** | Harmful content output rate | Red team testing + automated scanning | <0.1% |
  • низкая Рискованное назначение intent-offensive-security references/ai-industry-trends-2026.md:860
    Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение) (определение детектора / чёрного списка)
    ### Phase 10: Safety Guardrails & Red Team Testing
    детектор
  • низкая Рискованное назначение intent-offensive-security references/ai-industry-trends-2026.md:872
    Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)
    └── System Layer: Agent tool abuse, privilege escalation, resource exhaustion
  • низкая Рискованное назначение intent-offensive-security references/ai-industry-trends-2026.md:885
    Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)
    #### 10.3 Red Team Testing
  • низкая Рискованное назначение intent-offensive-security references/ai-industry-trends-2026.md:887
    Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение) (в кавычках — упоминание, а не команда)
    **Lessons from Microsoft's Red Teaming of 100+ Products:**
    в кавычках
  • низкая Подмена инструкций en-ignore-previous references/examples/ai-customer-service-example.md:389
    Фраза-перехват ("ignore previous instructions") (определение детектора / чёрного списка; тестовый файл / пример)
    - Injection Detection: LLM classifier detects patterns like "ignore previous instructions"
    детектортестовый файл
  • низкая Рискованное назначение intent-offensive-security references/methodologies/ai-pm-deep-methods.md:521
    Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)
    | Red Team Testing | Quarterly | Security team triggers |
  • низкая Рискованное назначение intent-offensive-security references/methodologies/ai-pm-deep-methods.md:568
    Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение) (определение детектора / чёрного списка)
    | Scale | +LLM injection detection, Hallucination detection | +Red Team testing | +Model safety assessment |
    детектор
  • низкая Рискованное назначение intent-offensive-security references/templates/ai-evaluation-template.md:53
    Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)
    | Adversarial Test Set | | Red team + security experts | Monthly |
  • низкая Рискованное назначение intent-offensive-security references/templates/ai-evaluation-template.md:336
    Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)
    | Red Team Test | Quarterly | Red Team Report |
  • низкая Рискованное назначение intent-offensive-security references/templates/ai-evaluation-template.md:393
    Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)
    | Adversarial Tasks | | Abnormal inputs | Red team constructed |
  • низкая Рискованное назначение intent-offensive-security references/templates/ai-prd-template.md:201
    Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)
    | Safety | Harmful Output Rate | Red Team Testing | <0.1% |
  • низкая Подмена инструкций en-ignore-previous references/templates/ai-safety-template.md:89
    Фраза-перехват ("ignore previous instructions") (определение детектора / чёрного списка; строка таблицы в документации)
    | Role-play Jailbreak | Detect "You are now..." type instructions | "DAN mode", "Ignore previous instructions" |
    детектортаблица
  • низкая Рискованное назначение intent-offensive-security references/templates/ai-safety-template.md:182
    Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)
    | Privilege Escalation | Agent gains permissions beyond design | Least privilege principle + permission audit |
  • низкая Рискованное назначение intent-offensive-security references/templates/ai-safety-template.md:236
    Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)
    ## 7. Red Team Testing
  • низкая Рискованное назначение intent-offensive-security references/templates/ai-safety-template.md:248
    Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)
    | Agent Attack | Tool Abuse/Privilege Escalation | 50+ | Each Agent update |
  • низкая Рискованное назначение intent-offensive-security references/templates/ai-safety-template.md:269
    Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)
    ### 7.3 Red Team Testing Process
  • низкая Рискованное назначение intent-offensive-security references/templates/ai-safety-template.md:376
    Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)
    □ Red Team Testing: Completed with no P0/P1 issues
  • низкая Рискованное назначение intent-offensive-security references/templates/ai-strategy-template.md:131
    Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение) (определение детектора / чёрного списка)
    | Security/Compliance | | | Guardrails + Red Team Testing + Compliance Review |
    детектор
  • низкая Рискованное назначение intent-offensive-security SKILL.md:58
    Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение) (определение детектора / чёрного списка)
    | Implement safety guardrails / Red teaming | [Phase 10: Safety Guardrails & Red Teaming](#phas…ing) |
    детектор
  • низкая Рискованное назначение intent-offensive-security SKILL.md:467
    Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение) (определение детектора / чёрного списка)
    | **Fairness & Safety** | Bias detection, harmful content filtering rate | Bias audit, Red teaming |
    детектор
  • низкая Рискованное назначение intent-offensive-security SKILL.md:569
    Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение) (определение детектора / чёрного списка)
    ### Phase 10: Safety Guardrails & Red Teaming
    детектор
  • низкая Рискованное назначение intent-offensive-security SKILL.md:602
    Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)
    □ Red team testing completed and high-risk items fixed
  • низкая Рискованное назначение intent-offensive-security SKILL.md:655
    Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение) (определение детектора / чёрного списка)
    □ AI Security Basics (Injection / Jailbreak / Guardrails / Red Team Testing)
    детектор

Просканировано файлов: 18. Улики замаскированы. Пометки в серых чипах объясняют, почему серьёзность понижена.

По спецификации Agent Skills

  • предупреждение description-no-when description не говорит, КОГДА применять скилл (нет "use when / используй когда")
  • предупреждение body-long тело SKILL.md ≈ 22097 токенов (рекомендуется < 5000); вынесите детали в references/
  • заметка frontmatter-key неизвестное поле фронтматтера "language"
  • заметка frontmatter-key неизвестное поле фронтматтера "contact"

Процессный рейтинг: все десять параметров 44/100

  • 0Результат и критерий готовности. Не сказано, что считать результатом
  • 0Входы и предусловия. Не сказано, что нужно иметь на входе
  • 0Отчётность по ходу. Скилл ничего не сообщает по ходу работы
  • 10Стоимость исполнения. Тело инструкции 22097 токенов: вытесняет саму задачу из окна
  • 20Когда включается. Не сказано, при каком запросе скилл включается
  • 30Повторный запуск. Изменяющих операций: 19, без проверки текущего состояния
  • 50Ошибки и развилки. Развилок: 0, есть раздел про ошибки
  • 60Шаги. Шагов: 33, расплывчатых формулировок: 4
  • 100Инструменты и файлы. Внешние инструменты не нужны
  • 100Согласованность. Имя и обязательные поля на месте
  • medium Правила безопасности и запреты внутри скилла: их место в системном промпте, здесь они не защищают
  • low Разделов верхнего уровня: 44. Похоже на несколько доменов в одном скилле

Всё перечисленное измерено по тексту скилла, а не оценено моделью: цифры проверяемы. Вес параметра тем больше, чем чаще из-за него процесс встаёт.

Сигналы качества

  • +5В description нет примеров фраз, по которым скилл должен срабатывать
  • +4Описание не говорит, когда скилл НЕ применять (ложные срабатывания)
  • +3Длина description 114: рекомендуется 120–800 символов
  • +3Формат ответа не описан: модель каждый раз решает сама
  • -248 эмодзи в инструкциях: шум для модели
  • +2Инструкции на одном языке
  • +4Структура: 154 заголовков
  • +3Пошаговые инструкции: 33 пунктов
  • +4Есть примеры (37 блоков кода)
  • +4Справочные файлы упоминаются в инструкциях (1 из 1)
  • +1Лицензия указана

База качества 70; замечания lint вычитаются, сигналы прибавляют до 100. Итог: 60.

Внешние проверки

ClawHub: clean
This is a large AI product-management reference skill with broad activation language and some reasoning-output templates, but no artifact-backed malware, exfiltration, destructive behavior, or hidden execution.
LLM: benign (high) · VirusTotal: · 10 июл. 2026 г.