BD browser-harness
Управление реальным Chrome пользователя (CDP) в формате, удобном для LLM. Одна команда для выполнения JS, кликов, прокрутки, снимков экрана, чтения DOM, заполнения форм, загрузки файлов на текущей вкладке — общий доступ к cookie/сессии/состоянию входа, кроссплатформенное управление одним браузером между Agent на Python и TypeScript. На основе browser-use/browser-harness (демон Python) + browser-harness-ts (клиент TS + bhts CLI). Высокорисковая возможность: по умолчанию sensitive-deny (отказ в операциях записи в режимах банковских/почтовых/внутренних/административных), опциональная жесткая изоляция BH_PUBLIC_ONLY, журналы аудита только метаданных, изоляция подпроцессов без импорта в процессе, точное закрепление версии вышестоящего компонента.
машинный переводПоказать оригиналСкрыть оригинал«用 LLM 友好的方式控制用户已登录的真实 Chrome(CDP)。一行命令在当前标签页跑 JS、点击、滚动、截图、读 DOM、填表、上传文…»
用 LLM 友好的方式控制用户已登录的真实 Chrome(CDP)。一行命令在当前标签页跑 JS、点击、滚动、截图、读 DOM、填表、上传文件——共享 cookie/session/登录态,跨 Python 与 TypeScript Agent 操作同一个浏览器。基于 browser-use/browser-harness(Python 守护进程)+ browser-harness-ts(TS 客户端 + bhts CLI)。HIGH-RISK 能力:默认 sensitive-deny(银行/邮箱/内网/admin 模式拒绝写操作)、可选 BH_PUBLIC_ONLY 硬隔离、metadata-only 审计日志、subprocess 隔离不做 in-process import、上游版本精确钉死。
Управление реальным Chrome пользователя (CDP) в формате, удобном для LLM.
Как процесс D 48/100 · Процесс не доведён — слабые места: результат и критерий готовности, когда включается, входы и предусловия
Чем это грозит
Находки средней серьёзности: скорее всего скилл честный, но прочитайте, что именно насторожило сканер.
Ниже описан худший случай для этой категории. Здесь находка средней серьёзности: guard увидел признак, но не доказательство.
Скилл содержит команды, которые удаляют файлы, переписывают диски или исполняют код, скачанный из сети. Агент может выполнить их без вопроса, если считает, что так требует инструкция.
Замените разрушительные команды на безопасные аналоги с подтверждением, ограничьте область действия конкретной папкой и не тяните код через curl | bash: укажите версию и контрольную сумму.
Как улучшить
- Свои кейсы (evals/evals.json, 4–6 реальных запросов с ожидаемыми ответами): тогда полная проверка прогонит именно их, а не черновик от модели.
- spec.yaml с триггерными фразами и утверждениями — контракт поведения для CI; `skilltest init` создаст шаблон.
Находки guard · 5
✓ Критических и высоких находок нет
Средние и низкие: 5
-
средняя Опасные команды
cmd-shell-rcscripts/run.sh:140Запись в файл автозагрузки shell (.bashrc / .zshrc / .profile)printf ' echo '\''export PATH="$(npm prefix -g)/bin:$PATH"'\'' >> ~/.zshrc && source ~/.zshrc\n'
-
средняя Опасные команды
cmd-shell-rcscripts/run.sh:164Запись в файл автозагрузки shell (.bashrc / .zshrc / .profile)printf ' echo '\''export PATH="$HOME/.local/bin:$PATH"'\'' >> ~/.zshrc && source ~/.zshrc\n'
-
средняя Опасные команды
cmd-pipe-to-shell-known-hostsetup.md:25Установщик через pipe в shell с известного хоста (всё равно выполняет удалённый код)curl -LsSf https://astral.sh/uv/install.sh | sh # 官方
-
средняя Опасные команды
cmd-shell-rcsetup.md:139Запись в файл автозагрузки shell (.bashrc / .zshrc / .profile)echo 'export PATH="$(npm prefix -g)/bin:$PATH"' >> ~/.zshrc && source ~/.zshrc
-
низкая Опасные команды
cmd-pipe-to-shell-known-hostscripts/run.sh:120Установщик через pipe в shell с известного хоста (всё равно выполняет удалённый код) (строковый литерал в коде, не выполняется)printf " curl -LsSf https://astral.sh/uv/install.sh | sh\n"
строка в коде
Просканировано файлов: 9. Улики замаскированы. Пометки в серых чипах объясняют, почему серьёзность понижена.
По спецификации Agent Skills
- заметка
frontmatter-keyнеизвестное поле фронтматтера "requiredEnvVars"
Процессный рейтинг: все десять параметров 48/100
- 0Результат и критерий готовности. Не сказано, что считать результатом
- 0Входы и предусловия. Не сказано, что нужно иметь на входе
- 20Когда включается. Не сказано, при каком запросе скилл включается
- 40Согласованность. Имя во frontmatter (browser-harness) не совпадает с папкой (browser-harness-skill)
- 50Ошибки и развилки. Развилок: 0, есть раздел про ошибки
- 60Инструменты и файлы. Используются инструменты (python, node), но во frontmatter они не объявлены
- 100Шаги. Шагов: 42
- 100Стоимость исполнения. Тело инструкции 2410 токенов
- 100Повторный запуск. Изменяющих операций нет
- 100Отчётность по ходу. Скилл сообщает о ходе работы
- low Ответ описан самодельной разметкой (19 тегов): типизированный вызов надёжнее
Всё перечисленное измерено по тексту скилла, а не оценено моделью: цифры проверяемы. Вес параметра тем больше, чем чаще из-за него процесс встаёт.
Сигналы качества
- +5В description нет примеров фраз, по которым скилл должен срабатывать
- +4Описание не говорит, когда скилл НЕ применять (ложные срабатывания)
- +3Формат ответа не описан: модель каждый раз решает сама
- +1Лицензия не указана
- +2Инструкции на одном языке
- +3Длина description 354 символов: достаточно сигнала, не съедает бюджет
- +4Структура: 23 заголовков
- +3Пошаговые инструкции: 42 пунктов
- +4Есть примеры (8 блоков кода)
- +3Все 1 скриптов описаны в инструкциях
База качества 70; замечания lint вычитаются, сигналы прибавляют до 100. Итог: 86.