BF blast-radius-drill
Проведите проверку на случай наихудшего сценария, прежде чем агент станет автономным — разбор ситуации «что, если этот агент прямо сейчас полностью выйдет из-под контроля», меры контроля (ограничения, кнопка отключения, возможность отката, изоляция) и план восстановления. Используйте, когда спрашивают: что самое худшее может сделать мой агент, проведите оценку радиуса поражения, подготовьтесь к выходу агента из-под контроля, или я готов оставить это работать без присмотра. Результат: разбор наихудшего сценария, меры контроля, аудит возможности отката и руководство по восстановлению после инцидента.
машинный переводПоказать оригиналСкрыть оригинал«Run the worst-case drill before an agent goes autonomous — the 'if thi…»
Run the worst-case drill before an agent goes autonomous — the 'if this agent were fully hijacked right now, what's the damage' walk-through, the containment controls (caps, kill-switch, reversibility, isolation), and the recovery plan. Use when asked what's the worst my agent could do, run a blast-radius assessment, prepare for an agent going rogue, or am I ready to let this run unattended. Produces the worst-case walk-through, the containment controls, the reversibility audit, and the incident-recovery runbook.
Проведите проверку на случай наихудшего сценария, прежде чем агент станет автономным — разбор ситуации «что, если этот агент прямо сейчас полностью выйдет…
Как процесс F 49/100 · Не запустится — Скилл ссылается на файлы, которых нет в архиве: ../tool-permission-review/SKILL.md, ../browser-agent-preflight/SKILL.md, ../file-access-preflight/SKILL.md
Такой же скилл встречается ещё в 2 местах: pm-claude-skills, pm-claude-skills
Как улучшить
- В тексте есть ссылки на отсутствующие файлы: добавьте файлы или уберите ссылки.
- Свои кейсы (evals/evals.json, 4–6 реальных запросов с ожидаемыми ответами): тогда полная проверка прогонит именно их, а не черновик от модели.
- spec.yaml с триггерными фразами и утверждениями — контракт поведения для CI; `skilltest init` создаст шаблон.
Находки guard · 0
✓ Критических и высоких находок нет
Просканировано файлов: 1. Улики замаскированы. Пометки в серых чипах объясняют, почему серьёзность понижена.
По спецификации Agent Skills
- предупреждение
missing-refссылка на отсутствующий файл: ../tool-permission-review/SKILL.md - предупреждение
missing-refссылка на отсутствующий файл: ../browser-agent-preflight/SKILL.md - предупреждение
missing-refссылка на отсутствующий файл: ../file-access-preflight/SKILL.md
Процессный рейтинг: все десять параметров 49/100
- 0Инструменты и файлы. Не хватает 3 файла(ов): ../tool-permission-review/SKILL.md, ../browser-agent-preflight/SKILL.md, ../file-access-preflight/SKILL.md
- 0Ошибки и развилки. Линейный процесс без обработки сбоев
- 0Отчётность по ходу. Скилл ничего не сообщает по ходу работы
- 20Когда включается. Не сказано, при каком запросе скилл включается
- 30Повторный запуск. Изменяющих операций: 7, без проверки текущего состояния
- 60Результат и критерий готовности. Формат результата описан, критерия завершения нет
- 70Входы и предусловия. Входные данные и предусловия перечислены
- 100Шаги. Шагов: 23
- 100Согласованность. Имя и обязательные поля на месте
- 100Стоимость исполнения. Тело инструкции 1486 токенов
- low Разделов верхнего уровня: 11. Похоже на несколько доменов в одном скилле
Всё перечисленное измерено по тексту скилла, а не оценено моделью: цифры проверяемы. Вес параметра тем больше, чем чаще из-за него процесс встаёт.
Сигналы качества
- +5В description нет примеров фраз, по которым скилл должен срабатывать
- +4Описание не говорит, когда скилл НЕ применять (ложные срабатывания)
- +4Нет примеров входа/выхода
- +1Лицензия не указана
- +2Инструкции на одном языке
- +3Длина description 518 символов: достаточно сигнала, не съедает бюджет
- +4Структура: 13 заголовков
- +3Пошаговые инструкции: 23 пунктов
- +3Формат ответа описан явно
База качества 70; замечания lint вычитаются, сигналы прибавляют до 100. Итог: 71.