BD yotta-guardian
元盾 — межплатформенная защита от опасных вызовов: движок детерминированных правил + подключаемая проверка намерений (не привязана к модели), перехватывает опасные вызовы инструментов exec / write / edit / read / run / shell, предоставляет журналы аудита. Триггеры: агент собирается выполнить команду высокого риска (рекурсивное удаление, форматирование диска, повышение привилегий, изменение брандмауэра, обратный shell, загрузка с последующим выполнением и т. д.), собирается записать данные в конфиденциальные системные пути или изменить системные настройки, требуется проверка безопасности перед выполнением опасной операции, или пользователь говорит «защита»/«перехват»/«опасная операция»/«проверка безопасности» и т. д. Ограничения: по умолчанию только оценка чтения, опасные операции не выполняются и не пропускаются автоматически; не заменяет решение пользователя; не скрывает записи аудита; правила настраиваются.
машинный переводПоказать оригиналСкрыть оригинал«元盾 —— 跨智能体的危险调用拦截护栏:确定性规则引擎 + 可插拔意图验证(不绑模型),拦截危险 exec / write / edit /…»
元盾 —— 跨智能体的危险调用拦截护栏:确定性规则引擎 + 可插拔意图验证(不绑模型),拦截危险 exec / write / edit / read / run / shell 工具调用,提供审计日志。触发:代理要执行高风险命令(递归删除、磁盘格式化、提权、防火墙改动、反向 shell、下载即执行等)、要写入系统敏感路径或修改系统配置、要在执行危险操作前做安全检查、或用户说 护栏/拦截/危险操作/安全检查 等。边界:默认只读评估,不自动执行也不放行危险操作;不替代用户决策;不隐藏审计记录;规则可配置。
元盾 — межплатформенная защита от опасных вызовов: движок детерминированных правил + подключаемая проверка намерений (не привязана к модели), перехватывает…
Как процесс D 48/100 · Процесс не доведён — слабые места: результат и критерий готовности, когда включается, входы и предусловия
Чем это грозит
Находки средней серьёзности: скорее всего скилл честный, но прочитайте, что именно насторожило сканер.
Ниже описан худший случай для этой категории. Здесь находка средней серьёзности: guard увидел признак, но не доказательство.
Скилл содержит команды, которые удаляют файлы, переписывают диски или исполняют код, скачанный из сети. Агент может выполнить их без вопроса, если считает, что так требует инструкция.
Замените разрушительные команды на безопасные аналоги с подтверждением, ограничьте область действия конкретной папкой и не тяните код через curl | bash: укажите версию и контрольную сумму.
Как улучшить
- Скажите в description, КОГДА применять скилл («используй, когда…», примеры запросов): это главный сигнал для агента.
- Свои кейсы (evals/evals.json, 4–6 реальных запросов с ожидаемыми ответами): тогда полная проверка прогонит именно их, а не черновик от модели.
- spec.yaml с триггерными фразами и утверждениями — контракт поведения для CI; `skilltest init` создаст шаблон.
Находки guard · 9
✓ Критических и высоких находок нет
Средние и низкие: 9
-
средняя Опасные команды
cmd-disable-securitySKILL.md:16Отключение средства защиты (Defender, Gatekeeper, SIP, firewall, execution policy) (документация security-скилла)- 代理要执行高风险命令:递归删除系统路径、磁盘格式化(mkfs / fdisk / dd 写设备)、提权(chmod 全权限 / chown 系统路径 / 账户管理)、防火墙改动(iptables 清空 / ufw disable / netsh 关闭)、反向 shell(netcat 执行 / bash /dev/tcp)、下载即执行(curl / wget 管道交给 shell)等;
security-скилл -
низкая Рискованное назначение
intent-offensive-securityREADME.md:10Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение) (определение детектора / чёрного списка)<p align="center">Activates when an agent is about to perform dangerous operations — recursive delete, disk formatting, privilege escalation, firewall changes, reverse shell, download-and-run, writes
детектор -
низкая Рискованное назначение
intent-offensive-securityREADME.md:30Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение) (определение детектора / чёрного списка)- **Deterministic rule engine** — text patterns (download-and-run / encoded execution / reverse shell) + argv-level verb/target analysis (rm / dd / mkfs / chmod / chown / privilege escalation / firewa
детектор -
низкая Опасные команды
cmd-privilegereferences/rules.md:25Повышение привилегий / права на запись для всех (документация security-скилла)| CMD-CHMOD-SETID | high | both | chmod 设置 setuid / setgid / sticky 权限位(4 位特殊位形态) |
security-скилл -
низкая Опасные команды
cmd-privilegescripts/guardian_rules.py:55Повышение привилегий / права на запись для всех (строковый литерал в коде, не выполняется; документация security-скилла)"chmod 设置 setuid / setgid / sticky 权限位", 85),
строка в кодеsecurity-скилл
Ещё 4 совпадений отнесены к цитатам в документации скилла по безопасности и не считаются находками.
Просканировано файлов: 15. Улики замаскированы. Пометки в серых чипах объясняют, почему серьёзность понижена.
По спецификации Agent Skills
- предупреждение
description-no-whendescription не говорит, КОГДА применять скилл (нет "use when / используй когда")
Процессный рейтинг: все десять параметров 48/100
- 0Результат и критерий готовности. Не сказано, что считать результатом
- 0Входы и предусловия. Не сказано, что нужно иметь на входе
- 0Ошибки и развилки. Линейный процесс без обработки сбоев
- 20Когда включается. Не сказано, при каком запросе скилл включается
- 60Инструменты и файлы. Используются инструменты (bash, web, python), но во frontmatter они не объявлены
- 100Шаги. Шагов: 16
- 100Согласованность. Имя и обязательные поля на месте
- 100Стоимость исполнения. Тело инструкции 533 токенов
- 100Повторный запуск. Изменяющих операций нет
- 100Отчётность по ходу. Скилл сообщает о ходе работы
Всё перечисленное измерено по тексту скилла, а не оценено моделью: цифры проверяемы. Вес параметра тем больше, чем чаще из-за него процесс встаёт.
Сигналы качества
- +5В description нет примеров фраз, по которым скилл должен срабатывать
- +4Описание не говорит, когда скилл НЕ применять (ложные срабатывания)
- +3Формат ответа не описан: модель каждый раз решает сама
- +4Нет примеров входа/выхода
- -32 из 3 скриптов не упомянуты в SKILL.md
- +2Инструкции на одном языке
- +3Длина description 254 символов: достаточно сигнала, не съедает бюджет
- +4Структура: 13 заголовков
- +3Пошаговые инструкции: 16 пунктов
- +4Справочные файлы упоминаются в инструкциях (3 из 3)
- +1Лицензия указана
База качества 70; замечания lint вычитаются, сигналы прибавляют до 100. Итог: 70.