SKILLEMALL.ai

BC harness

Этот навык следует использовать для автономной работы агента в нескольких сеансах, требующей сохранения прогресса, восстановления после сбоев и управления зависимостями задач. Активируется командой '/harness' или когда задача включает множество подзадач, требующих сохранения прогресса, циклов сна/возобновления между контекстными окнами, восстановления после сбоев в середине задачи с частичным состоянием или распределенной работы в нескольких сеансах агента. Синтезировано на основе инженерных практик Anthropic и OpenAI для долгосрочных агентов.

машинный переводПоказать оригиналСкрыть оригинал«This skill should be used for multi-session autonomous agent work requ…»

This skill should be used for multi-session autonomous agent work requiring progress checkpointing, failure recovery, and task dependency management. Triggers on '/harness' command, or when a task involves many subtasks needing progress persistence, sleep/resume cycles across context windows, recovery from mid-task failures with partial state, or distributed work across multiple agent sessions. Synthesized from Anthropic and OpenAI engineering practices for long-running agents.

ClawHub Agent Skills автор: eohmig v1.0.0 MIT-0 13 файлов · 10 скриптов тело ≈ 4 936 токенов Открыть источникclawhub.ai↗ проанализирован 13 дн назад

Этот навык следует использовать для автономной работы агента в нескольких сеансах, требующей сохранения прогресса, восстановления после сбоев и управления…

Как процесс C 62/100 · Есть пробелы — слабые места: результат и критерий готовности, входы и предусловия

ПроцедураИИ и агентытип и темы размечены автоматически по тексту скилла
JSON
Технический рейтинг
B
93/100
безопасность, качество, тесты
Безопасность 60%
100
Качество 40%
82
Прогон на моделях
не было
Процессный рейтинг
C
62/100
Есть пробелы
Результат и критерий готовности вес 14
0
Входы и предусловия вес 11
0
Инструменты и файлы вес 18
60
три самых слабых из десяти параметров · все десять

Как улучшить

    Для прогона на моделях — необязательно
    • Свои кейсы (evals/evals.json, 4–6 реальных запросов с ожидаемыми ответами): тогда полная проверка прогонит именно их, а не черновик от модели.
    • spec.yaml с триггерными фразами и утверждениями — контракт поведения для CI; `skilltest init` создаст шаблон.

    Находки guard · 0

    ✓ Критических и высоких находок нет

    Просканировано файлов: 11. Улики замаскированы. Пометки в серых чипах объясняют, почему серьёзность понижена.

    По спецификации Agent Skills

    ✓ По спецификации Agent Skills замечаний нет

    Процессный рейтинг: все десять параметров 62/100

    • 0Результат и критерий готовности. Не сказано, что считать результатом
    • 0Входы и предусловия. Не сказано, что нужно иметь на входе
    • 60Инструменты и файлы. Используются инструменты (bash, git), но во frontmatter они не объявлены
    • 70Когда включается. Сказано, когда применять, но не сказано, когда не стоит
    • 70Стоимость исполнения. Тело инструкции 4936 токенов
    • 100Шаги. Шагов: 57
    • 100Ошибки и развилки. Развилок: 2, есть раздел про ошибки
    • 100Согласованность. Имя и обязательные поля на месте
    • 100Повторный запуск. Изменяющие операции проверяют текущее состояние
    • 100Отчётность по ходу. Скилл сообщает о ходе работы
    • low Разделов верхнего уровня: 15. Похоже на несколько доменов в одном скилле
    • low Ответ описан самодельной разметкой (20 тегов): типизированный вызов надёжнее

    Всё перечисленное измерено по тексту скилла, а не оценено моделью: цифры проверяемы. Вес параметра тем больше, чем чаще из-за него процесс встаёт.

    Сигналы качества

    • +5В description нет примеров фраз, по которым скилл должен срабатывать
    • +4Описание не говорит, когда скилл НЕ применять (ложные срабатывания)
    • +3Формат ответа не описан: модель каждый раз решает сама
    • -2Ссылки на localhost: у другого пользователя не заработает
    • +1Лицензия не указана
    • +2Инструкции на одном языке
    • +3Длина description 482 символов: достаточно сигнала, не съедает бюджет
    • +4Структура: 22 заголовков
    • +3Пошаговые инструкции: 57 пунктов
    • +4Есть примеры (10 блоков кода)

    База качества 70; замечания lint вычитаются, сигналы прибавляют до 100. Итог: 82.

    Внешние проверки

    ClawHub: suspicious
    The skill is a coherent long-running task harness, but it gives agents broad automatic control that can reset and clean a repository, run task-supplied commands, and block stopping without enough guardrails.
    LLM: suspicious (high) · 19 сент. 2026 г.