BD yotta-logwatch
元察 — навык безопасного анализа и обнаружения журналов между интеллектуальными агентами: самописный парсинг auth/secure, журналов веб-доступа (common/combined), блоков скриптов PowerShell, журналов событий Windows (Security/System) без зависимостей; обнаружение брутфорса / webshell / сканирования / аномальных входов / подозрительных блоков скриптов / подозрительных процессов / операций с учетными записями / очистки журналов; вывод временной шкалы и обучающего отчета на китайском языке. Триггеры: когда пользователь предоставляет журналы входа / журналы веб-доступа / журналы PowerShell / журналы событий Windows для анализа следов вторжения, проверки аномальной активности, аудита локальных журналов. Границы: только чтение локальных файлов журналов; без подключения к сети, без активного сканирования, без изменения какого-либо содержимого; только для аудита безопасности авторизованных / собственных активов.
машинный переводПоказать оригиналСкрыть оригинал«元察 —— 跨智能体的安全日志分析检测技能:零依赖自研解析 auth/secure、Web 访问日志(common/combined)、Po…»
元察 —— 跨智能体的安全日志分析检测技能:零依赖自研解析 auth/secure、Web 访问日志(common/combined)、PowerShell 脚本块日志、Windows 事件日志(Security/System),检测爆破 / webshell / 扫描 / 异常登录 / 可疑脚本块 / 可疑进程 / 账户操作 / 日志清空,输出时间线与中文教学报告。触发:用户给出登录日志 / Web 访问日志 / PowerShell 日志 / Windows 事件日志,要分析入侵痕迹、排查异常活动、审计本地日志时。边界:只读本地日志文件;不联网、不主动扫描、不修改任何其内容;仅用于已获授权 / 自有资产的安全审计。
元察 — навык безопасного анализа и обнаружения журналов между интеллектуальными агентами: самописный парсинг auth/secure, журналов веб-доступа…
Как процесс D 48/100 · Процесс не доведён — слабые места: результат и критерий готовности, когда включается, входы и предусловия
Чем это грозит
Находки средней серьёзности: скорее всего скилл честный, но прочитайте, что именно насторожило сканер.
Ниже описан худший случай для этой категории. Здесь находка средней серьёзности: guard увидел признак, но не доказательство.
Скилл содержит команды, которые удаляют файлы, переписывают диски или исполняют код, скачанный из сети. Агент может выполнить их без вопроса, если считает, что так требует инструкция.
Замените разрушительные команды на безопасные аналоги с подтверждением, ограничьте область действия конкретной папкой и не тяните код через curl | bash: укажите версию и контрольную сумму.
Как улучшить
- Скажите в description, КОГДА применять скилл («используй, когда…», примеры запросов): это главный сигнал для агента.
- Свои кейсы (evals/evals.json, 4–6 реальных запросов с ожидаемыми ответами): тогда полная проверка прогонит именно их, а не черновик от модели.
- spec.yaml с триггерными фразами и утверждениями — контракт поведения для CI; `skilltest init` создаст шаблон.
Находки guard · 6
✓ Критических и высоких находок нет
Средние и низкие: 6
-
средняя Опасные команды
cmd-persistencereferences/windows-event-rules.md:64Механизм закрепления (cron / launchd / планировщик / автозапуск в реестре) (документация security-скилла)| powershell / pwsh / cmd /c / wscript / cscript / schtasks /create / sc create | medium | 脚本宿主 / 持久化命令 |
security-скилл -
средняя Опасные команды
cmd-encoded-execscripts/test_yotta_logwatch.py:46Выполнение закодированного (base64) кода (тестовый файл / пример; в кавычках — упоминание, а не команда)'powershell -EncodedCommand SQBF…GoA')
тестовый файлв кавычках -
средняя Опасные команды
cmd-persistencescripts/yotta_logwatch.py:120Механизм закрепления (cron / launchd / планировщик / автозапуск в реестре) (строковый литерал в коде, не выполняется)"invoke-command", "register-scheduledtask", "set-content", "out-file",
строка в коде -
средняя Опасные команды
cmd-persistencescripts/yotta_logwatch.py:856Механизм закрепления (cron / launchd / планировщик / автозапуск в реестре) (строковый литерал в коде, не выполняется)("schtasks /create", "计划任务创建(持久化)", "medium"),строка в коде -
низкая Секреты в коде
secret-high-entropy-tokenscripts/test_yotta_logwatch.py:46Строка, похожая на токен (может быть id, хеш или секрет) (тестовый файл / пример; в кавычках — упоминание, а не команда)'powershell -EncodedCommand SQBF…GoA')
тестовый файлв кавычках
Ещё 1 совпадений отнесены к цитатам в документации скилла по безопасности и не считаются находками.
Просканировано файлов: 16. Улики замаскированы. Пометки в серых чипах объясняют, почему серьёзность понижена.
По спецификации Agent Skills
- предупреждение
description-no-whendescription не говорит, КОГДА применять скилл (нет "use when / используй когда")
Процессный рейтинг: все десять параметров 48/100
- 0Результат и критерий готовности. Не сказано, что считать результатом
- 0Входы и предусловия. Не сказано, что нужно иметь на входе
- 0Ошибки и развилки. Линейный процесс без обработки сбоев
- 20Когда включается. Не сказано, при каком запросе скилл включается
- 60Инструменты и файлы. Используются инструменты (bash, python), но во frontmatter они не объявлены
- 100Шаги. Шагов: 30
- 100Согласованность. Имя и обязательные поля на месте
- 100Стоимость исполнения. Тело инструкции 1226 токенов
- 100Повторный запуск. Изменяющих операций нет
- 100Отчётность по ходу. Скилл сообщает о ходе работы
Всё перечисленное измерено по тексту скилла, а не оценено моделью: цифры проверяемы. Вес параметра тем больше, чем чаще из-за него процесс встаёт.
Сигналы качества
- +5В description нет примеров фраз, по которым скилл должен срабатывать
- +4Описание не говорит, когда скилл НЕ применять (ложные срабатывания)
- +3Формат ответа не описан: модель каждый раз решает сама
- -31 из 2 скриптов не упомянуты в SKILL.md
- +2Инструкции на одном языке
- +3Длина description 313 символов: достаточно сигнала, не съедает бюджет
- +4Структура: 9 заголовков
- +3Пошаговые инструкции: 30 пунктов
- +4Есть примеры (1 блоков кода)
- +4Справочные файлы упоминаются в инструкциях (5 из 5)
- +1Лицензия указана
База качества 70; замечания lint вычитаются, сигналы прибавляют до 100. Итог: 74.