SKILLEMALL.ai

BD yotta-agent-hardening

Meta-Security — «медосмотр + рекомендации по усилению» для собственных навыков ИИ-агента: в трех областях — защита от внедрения подсказок / границы вызова инструментов / изоляция данных — выполните статическое сканирование конфигурации установленных навыков, сервера MCP, описаний инструментов, разрешений и областей чтения данных для усиления, выведите отчет об усилении и исполняемые правила защиты (не требует зависимостей Python 3.8+, сканирование чтения, обнаружение чувствительного чтения включено по умолчанию, отчет использует «классы» для описания, каждое сканирование по умолчанию оставляет след). Триггеры: пользователь просит провести «медосмотр» / усиление среды ИИ-агента или навыков, проверить надежность сервера MCP или навыков, устранить риски внедрения подсказок / превышения полномочий / утечки данных, хочет узнать общую площадь раскрытия после установки множества навыков; или пользователь говорит «Meta-Security» / «усиление» / «медосмотр безопасности» / «медосмотр» / «hardening» / «просканируй мои навыки» / «проверь MCP» / «правила защиты» / «guardrails» и т.п. Границы (НЕ запускать): не создавать воспроизводимые строки для внедрения / эксплойты; сканировать только каталоги и конфигурации, принадлежащие пользователю, на проверку которых у него есть права, не сканировать среды, к которым нет доступа; не выполнять перехват в реальном времени (это Meta-Shield); не проводить предварительную проверку отдельных навыков (это Meta-Audit / Meta-Trust); не заменять ручной аудит безопасности и окончательное решение.

машинный переводПоказать оригиналСкрыть оригинал«元安全 —— 给 AI 智能体 / Agent 技能自身做「体检 + 加固建议」:按 提示注入防护 / 工具调用边界 / 数据隔离 三域,对…»

元安全 —— 给 AI 智能体 / Agent 技能自身做「体检 + 加固建议」:按 提示注入防护 / 工具调用边界 / 数据隔离 三域,对安装的 skills、MCP 服务器、工具描述、权限与数据读取面做配置面静态加固扫描,输出加固报告与可执行防御守则(零依赖 Python 3.8+,扫描只读、敏感读取检测默认开启、报告用「类」表述、每次扫描默认留痕)。触发:用户要求给智能体或技能环境做安全体检 / 加固、检查 MCP 服务器或技能是否可信、排查提示注入 / 越权 / 数据泄露风险、想了解装了一堆技能后的整体暴露面;或用户说 元安全 / 加固 / 安全体检 / 体检 / hardening / 扫一下我的技能 / 检查 MCP / 防御守则 / guardrails 等。边界(Do NOT trigger):不产出可复制注入串 / 攻击 payload;只扫描用户自有、有权检查的目录与配置,不扫描无权访问的环境;不做运行时拦截(那是元盾);不做单个技能装前审核(那是元审 / 元信);不替代人工安全审计与最终决策。

ClawHub Agent Skills автор: YottaMeta v0.2.5 MIT-0 16 файлов · 1 скрипт тело ≈ 998 токенов Открыть источникclawhub.ai проанализирован 2 дн назад

Meta-Security — «медосмотр + рекомендации по усилению» для собственных навыков ИИ-агента: в трех областях — защита от внедрения подсказок / границы вызова…

Как процесс D 48/100 · Процесс не доведён — слабые места: результат и критерий готовности, когда включается, входы и предусловия

ПроцедураИИ и агентытип и темы размечены автоматически по тексту скилла
JSON
Технический рейтинг
B
87/100
безопасность, качество, тесты
Безопасность 60%
88
Качество 40%
86
Прогон на моделях
не было
Процессный рейтинг
D
48/100
Процесс не доведён
Результат и критерий готовности вес 14
0
Входы и предусловия вес 11
0
Ошибки и развилки вес 10
0
три самых слабых из десяти параметров · все десять

Чем это грозит

Находки средней серьёзности: скорее всего скилл честный, но прочитайте, что именно насторожило сканер.

Опасные команды средняя серьёзность

Ниже описан худший случай для этой категории. Здесь находка средней серьёзности: guard увидел признак, но не доказательство.

Если установить

Скилл содержит команды, которые удаляют файлы, переписывают диски или исполняют код, скачанный из сети. Агент может выполнить их без вопроса, если считает, что так требует инструкция.

Автору

Замените разрушительные команды на безопасные аналоги с подтверждением, ограничьте область действия конкретной папкой и не тяните код через curl | bash: укажите версию и контрольную сумму.

Как улучшить

    Для прогона на моделях — необязательно
    • Свои кейсы (evals/evals.json, 4–6 реальных запросов с ожидаемыми ответами): тогда полная проверка прогонит именно их, а не черновик от модели.
    • spec.yaml с триггерными фразами и утверждениями — контракт поведения для CI; `skilltest init` создаст шаблон.

    Находки guard · 8

    ✓ Критических и высоких находок нет

    Средние и низкие: 8
    • низкая Рискованное назначение intent-offensive-security README.md:36
      Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)
      Inspects what the agent is able to do: agent configuration files (tool permissions / allowlists), the MCP server list, installed skill scripts (download-and-execute, obfuscated execution, persistence,
    • низкая Опасные команды cmd-privilege references/detection-items.md:38
      Повышение привилегий / права на запись для всех (документация security-скилла)
      | PrivilegeEscalation | PRI-001 ~ PRI-005 | high ~ low | 权限位设置(setuid / setgid / 全权八进制位)、提权执行(需确认必要性) |
      security-скилл
    • низкая Опасные команды cmd-persistence scripts/hardening_rules.py:138
      Механизм закрепления (cron / launchd / планировщик / автозапуск в реестре) (строковый литерал в коде, не выполняется; документация security-скилла)
      "macOS 启动代理/守护(LaunchAgents/LaunchDaemons plist)持久化", 70),
      строка в кодеsecurity-скилл
    • низкая Опасные команды cmd-privilege scripts/hardening_rules.py:230
      Повышение привилегий / права на запись для всех (строковый литерал в коде, не выполняется; документация security-скилла)
      "chmod 设置 setuid/setgid/sticky 权限位", 85),
      строка в кодеsecurity-скилл
    • низкая Опасные команды cmd-privilege scripts/hardening_rules.py:233
      Повышение привилегий / права на запись для всех (строковый литерал в коде, не выполняется; документация security-скилла)
      "chmod 777 全权限", 70),
      строка в кодеsecurity-скилл
    • низкая Опасные команды cmd-privilege scripts/hardening_rules.py:236
      Повышение привилегий / права на запись для всех (строковый литерал в коде, не выполняется; документация security-скилла)
      "调用 setuid/setgid", 80),
      строка в кодеsecurity-скилл

    Ещё 2 совпадений отнесены к цитатам в документации скилла по безопасности и не считаются находками.

    Просканировано файлов: 16. Улики замаскированы. Пометки в серых чипах объясняют, почему серьёзность понижена.

    По спецификации Agent Skills

    ✓ По спецификации Agent Skills замечаний нет

    Процессный рейтинг: все десять параметров 48/100

    • 0Результат и критерий готовности. Не сказано, что считать результатом
    • 0Входы и предусловия. Не сказано, что нужно иметь на входе
    • 0Ошибки и развилки. Линейный процесс без обработки сбоев
    • 20Когда включается. Не сказано, при каком запросе скилл включается
    • 60Инструменты и файлы. Используются инструменты (python), но во frontmatter они не объявлены
    • 100Шаги. Шагов: 38
    • 100Согласованность. Имя и обязательные поля на месте
    • 100Стоимость исполнения. Тело инструкции 998 токенов
    • 100Повторный запуск. Изменяющих операций нет
    • 100Отчётность по ходу. Скилл сообщает о ходе работы

    Всё перечисленное измерено по тексту скилла, а не оценено моделью: цифры проверяемы. Вес параметра тем больше, чем чаще из-за него процесс встаёт.

    Сигналы качества

    • +5В description нет примеров фраз, по которым скилл должен срабатывать
    • +4Описание не говорит, когда скилл НЕ применять (ложные срабатывания)
    • +3Формат ответа не описан: модель каждый раз решает сама
    • -32 из 3 скриптов не упомянуты в SKILL.md
    • +2Инструкции на одном языке
    • +3Длина description 464 символов: достаточно сигнала, не съедает бюджет
    • +4Структура: 13 заголовков
    • +3Пошаговые инструкции: 38 пунктов
    • +4Есть примеры (1 блоков кода)
    • +4Справочные файлы упоминаются в инструкциях (4 из 4)
    • +1Лицензия указана

    База качества 70; замечания lint вычитаются, сигналы прибавляют до 100. Итог: 86.

    Внешние проверки

    ClawHub: clean
    This is a defensive agent-hardening scanner with disclosed local install, audit, and guardrail writes; the sensitive-looking strings are mostly detection rules and examples.
    LLM: benign (high) · VirusTotal: · 3 сент. 2026 г.