SKILLEMALL.ai

BF harness-engineering

Проектирование, создание, диагностика и развитие каркасов агентов: инструкции, инструменты, среды выполнения, постоянное состояние, управление контекстом, проверка, восстановление и ограниченные автономные циклы. Используйте для ненадежных кодирующих агентов, дрейфа между сессиями, преждевременного завершения, аудита каркасов или изменений во времени выполнения вокруг модели. Не используйте только для перезаписи промптов, обучения моделей, общего проектирования приложений или эксплуатации уже оцененного агента в производственной среде; передавайте эти вопросы их специализированным навыкам.

машинный переводПоказать оригиналСкрыть оригинал«Design, build, diagnose, and evolve agent harnesses: instructions, too…»

Design, build, diagnose, and evolve agent harnesses: instructions, tools, execution environments, durable state, context management, verification, recovery, and bounded autonomous loops. Use for unreliable coding agents, cross-session drift, premature completion, harness audits, or changes to the runtime around a model. Do not use for prompt rewriting alone, model training, general application architecture, or operating an already evaluated agent in production; route those concerns to their specialist skills.

magnus919/agent-skills Agent Skills автор: magnus919 MIT 49 файлов · 4 скрипта тело ≈ 2 850 токенов Открыть источникgithub.com↗ проанализирован 26 ч назад

Проектирование, создание, диагностика и развитие каркасов агентов: инструкции, инструменты, среды выполнения, постоянное состояние, управление контекстом…

Как процесс F 47/100 · Не запустится — Скилл ссылается на файлы, которых нет в архиве: ../systematic-debugging/SKILL.md, ../langgraph/SKILL.md, ../pydanticai/SKILL.md

АнализаторИИ и агентытип и темы размечены автоматически по тексту скилла
JSON
Технический рейтинг
B
91/100
безопасность, качество, тесты
Безопасность 60%
100
Качество 40%
78
Прогон на моделях
не было
Процессный рейтинг
F
47/100
Не запустится
Скилл ссылается на файлы, которых нет в архиве: ../systematic-debugging/SKILL.md, ../langgraph/SKILL.md, ../pydanticai/SKILL.md
Инструменты и файлы вес 18
0
Входы и предусловия вес 11
0
Отчётность по ходу вес 2
0
три самых слабых из десяти параметров · все десять

Как улучшить

  1. В тексте есть ссылки на отсутствующие файлы: добавьте файлы или уберите ссылки.
Для прогона на моделях — необязательно
  • spec.yaml с триггерными фразами и утверждениями — контракт поведения для CI; `skilltest init` создаст шаблон.

Находки guard · 0

✓ Критических и высоких находок нет

Просканировано файлов: 41. Улики замаскированы. Пометки в серых чипах объясняют, почему серьёзность понижена.

По спецификации Agent Skills

  • предупреждение missing-ref ссылка на отсутствующий файл: ../systematic-debugging/SKILL.md
  • предупреждение missing-ref ссылка на отсутствующий файл: ../langgraph/SKILL.md
  • предупреждение missing-ref ссылка на отсутствующий файл: ../pydanticai/SKILL.md
  • предупреждение missing-ref ссылка на отсутствующий файл: ../autogen/SKILL.md
  • предупреждение missing-ref ссылка на отсутствующий файл: ../agent-evals-and-observability/SKILL.md
  • предупреждение missing-ref ссылка на отсутствующий файл: ../agent-production-operations/SKILL.md
  • предупреждение missing-ref ссылка на отсутствующий файл: ../agent-skills/SKILL.md
  • предупреждение missing-ref ссылка на отсутствующий файл: ../secure-software-engineering/SKILL.md
  • предупреждение missing-ref ссылка на отсутствующий файл: ../ai-governance/SKILL.md

Процессный рейтинг: все десять параметров 47/100

Не запустится. Скилл ссылается на файлы, которых нет в архиве: ../systematic-debugging/SKILL.md, ../langgraph/SKILL.md, ../pydanticai/SKILL.md
  • 0Инструменты и файлы. Не хватает 9 файла(ов): ../systematic-debugging/SKILL.md, ../langgraph/SKILL.md, ../pydanticai/SKILL.md
  • 0Входы и предусловия. Не сказано, что нужно иметь на входе
  • 0Отчётность по ходу. Скилл ничего не сообщает по ходу работы
  • 30Повторный запуск. Изменяющих операций: 3, без проверки текущего состояния
  • 40Результат и критерий готовности. Не сказано, что считать результатом
  • 50Когда включается. Не сказано, при каком запросе скилл включается
  • 50Ошибки и развилки. Развилок: 0, есть раздел про ошибки
  • 100Шаги. Шагов: 12
  • 100Согласованность. Имя и обязательные поля на месте
  • 100Стоимость исполнения. Тело инструкции 2850 токенов
  • low Среди тестов нет случая на инъекцию через данные

Всё перечисленное измерено по тексту скилла, а не оценено моделью: цифры проверяемы. Вес параметра тем больше, чем чаще из-за него процесс встаёт.

Сигналы качества

  • +5В description нет примеров фраз, по которым скилл должен срабатывать
  • +3Формат ответа не описан: модель каждый раз решает сама
  • -32 из 4 скриптов не упомянуты в SKILL.md
  • +2Инструкции на одном языке
  • +4Описание говорит, когда скилл НЕ применять
  • +3Длина description 514 символов: достаточно сигнала, не съедает бюджет
  • +4Структура: 10 заголовков
  • +3Пошаговые инструкции: 12 пунктов
  • +4Есть примеры (2 блоков кода)
  • +4Справочные файлы упоминаются в инструкциях (16 из 16)
  • +1Лицензия указана

База качества 70; замечания lint вычитаются, сигналы прибавляют до 100. Итог: 78.