AC zt4ai-self-audit
Аудит безопасности Zero Trust для рабочих пространств, навыков и конфигураций ИИ-агентов. Основан на фреймворке Microsoft Zero Trust for AI (ZT4AI) и исследовании «Caging the Agents» (arXiv:2603.17419). Аудирует установленные навыки на предмет риска внедрения промптов, раскрытия учетных данных, чрезмерных привилегий, поведенческих манипуляций и отклонений в целостности. Используйте при: проведении аудита безопасности навыков агента, проверке недавно установленных навыков из ClawHub или других источников, проверке векторов внедрения промптов в файлах рабочего пространства, аудите разрешений агента и границ доверия, проверке целостности файлов навыков по сравнению с базовой линией, или усилении защиты агента. Триггеры на: «аудит моих навыков», «проверка безопасности», «ZT4AI», «аудит zero trust», «проверить целостность навыка», «я в безопасности?», «усилить моего агента», «проверить мои границы доверия».
машинный переводПоказать оригиналСкрыть оригинал«Zero Trust security audit for AI agent workspaces, skills, and configu…»
Zero Trust security audit for AI agent workspaces, skills, and configurations. Based on Microsoft's Zero Trust for AI (ZT4AI) framework and the "Caging the Agents" research (arXiv:2603.17419). Audits installed skills for prompt injection risk, credential exposure, excessive privilege, behavioral manipulation, and integrity drift. Use when: performing a security audit of agent skills, reviewing newly installed skills from ClawHub or other sources, checking for prompt injection vectors in workspace files, auditing agent permissions and trust boundaries, verifying skill file integrity against a baseline, or hardening an agent's security posture. Triggers on: "audit my skills", "security check", "ZT4AI", "zero trust audit", "check skill integrity", "am I secure", "harden my agent", "review my trust boundaries".
Аудит безопасности Zero Trust для рабочих пространств, навыков и конфигураций ИИ-агентов.
Как процесс C 55/100 · Есть пробелы — слабые места: результат и критерий готовности, входы и предусловия, повторный запуск
Как улучшить
- Свои кейсы (evals/evals.json, 4–6 реальных запросов с ожидаемыми ответами): тогда полная проверка прогонит именно их, а не черновик от модели.
- spec.yaml с триггерными фразами и утверждениями — контракт поведения для CI; `skilltest init` создаст шаблон.
Находки guard · 2
✓ Критических и высоких находок нет
Средние и низкие: 2
-
низкая Рискованное назначение
intent-offensive-securityreferences/audit-checklist.md:41Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)- [ ] **No privilege escalation**: Does the skill avoid requesting elevated privileges unnecessarily?
-
низкая Рискованное назначение
intent-offensive-securitySKILL.md:32Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)3. **OWASP Agentic AI Top 10** — Trust boundary violations, privilege escalation, resource exhaustion
Просканировано файлов: 7. Улики замаскированы. Пометки в серых чипах объясняют, почему серьёзность понижена.
По спецификации Agent Skills
✓ По спецификации Agent Skills замечаний нет
Процессный рейтинг: все десять параметров 55/100
- 0Результат и критерий готовности. Не сказано, что считать результатом
- 0Входы и предусловия. Не сказано, что нужно иметь на входе
- 0Отчётность по ходу. Скилл ничего не сообщает по ходу работы
- 30Повторный запуск. Изменяющих операций: 1, без проверки текущего состояния
- 60Инструменты и файлы. Используются инструменты (web), но во frontmatter они не объявлены
- 60Ошибки и развилки. Развилок: 2
- 70Когда включается. Сказано, когда применять, но не сказано, когда не стоит
- 100Шаги. Шагов: 35
- 100Согласованность. Имя и обязательные поля на месте
- 100Стоимость исполнения. Тело инструкции 1390 токенов
- low Ответ описан самодельной разметкой (4 тегов): типизированный вызов надёжнее
Всё перечисленное измерено по тексту скилла, а не оценено моделью: цифры проверяемы. Вес параметра тем больше, чем чаще из-за него процесс встаёт.
Сигналы качества
- +4Описание не говорит, когда скилл НЕ применять (ложные срабатывания)
- +3Длина description 818: рекомендуется 120–800 символов
- +3Формат ответа не описан: модель каждый раз решает сама
- -31 из 1 скриптов не упомянуты в SKILL.md
- +1Лицензия не указана
- +2Инструкции на одном языке
- +5В description 8 примера фраз-триггеров в кавычках
- +4Структура: 13 заголовков
- +3Пошаговые инструкции: 35 пунктов
- +4Есть примеры (5 блоков кода)
- +4Справочные файлы упоминаются в инструкциях (4 из 4)
База качества 70; замечания lint вычитаются, сигналы прибавляют до 100. Итог: 87.