AF long-running-agent
Фреймворк для оркестрации долгосрочных агентов. Позволяет AI-агентам непрерывно работать между сеансами и выполнять сложные задачи. Сценарии использования: - Пользователь говорит «создать новый проект», «начать проект», «создать задачу», «запустить проект» - Пользователь говорит «продолжить проект», «продолжить работу», «продолжать», «продолжать разработку» - Пользователь говорит «обновить прогресс», «записать прогресс», «сохранить прогресс» - Пользователь говорит «статус проекта», «посмотреть прогресс», «до чего дошли» - Пользователь говорит «список проектов», «все проекты», «какие у меня проекты» - Пользователь говорит «приостановить проект», «архивировать проект» - Пользователю необходимо выполнить многоэтапные, длительные задачи, выходящие за рамки одного сеанса - Пользователю необходимо, чтобы AI постоянно отслеживал ход работы и контекст - Пользователю необходимо, чтобы AI запоминал ранее предпринятые, но неудачные методы Основные функции: - Создание нового проекта (автоматически генерирует PROJECT.md, CHANGELOG.md) - Продолжение проекта (автоматически считывает прогресс, продолжает с точки прерывания) - Обновление прогресса (автоматически обновляет CHANGELOG.md) - Автоматическое продвижение Ralph Loop (решает проблему лени агента) - Управление несколькими проектами - Обзор статуса проекта - Запись неудачных методов (предотвращает повторные попытки)
машинный переводПоказать оригиналСкрыть оригинал«长时间运行智能体编排框架。让AI智能体能够跨会话持续工作并完成复杂任务。 使用场景: - 用户说 "创建一个新项目"、"开始一个项目"、"…»
长时间运行智能体编排框架。让AI智能体能够跨会话持续工作并完成复杂任务。 使用场景: - 用户说 "创建一个新项目"、"开始一个项目"、"新建任务"、"启动项目" - 用户说 "继续项目"、"继续工作"、"接着做"、"继续开发" - 用户说 "更新进度"、"记录进度"、"保存进度" - 用户说 "项目状态"、"查看进度"、"做到哪了" - 用户说 "列出项目"、"所有项目"、"我有哪些项目" - 用户说 "暂停项目"、"存档项目" - 用户需要执行多步骤、长时间、跨会话的任务 - 用户需要AI持续追踪工作进度和上下文 - 用户需要AI记住之前尝试过但失败的方法 核心功能: - 创建新项目(自动生成 PROJECT.md, CHANGELOG.md) - 继续项目(自动读取进度,从断点继续) - 更新进度(自动更新 CHANGELOG.md) - Ralph Loop 自动推进(解决智能体惰性) - 多项目管理 - 项目状态概览 - 失败方法记录(防止重复尝试)
Фреймворк для оркестрации долгосрочных агентов.
Как процесс F 35/100 · Не запустится — Скилл ссылается на файлы, которых нет в архиве: examples/task-planner-demo/
Как улучшить
- Скажите в description, КОГДА применять скилл («используй, когда…», примеры запросов): это главный сигнал для агента.
- В тексте есть ссылки на отсутствующие файлы: добавьте файлы или уберите ссылки.
- Свои кейсы (evals/evals.json, 4–6 реальных запросов с ожидаемыми ответами): тогда полная проверка прогонит именно их, а не черновик от модели.
- spec.yaml с триггерными фразами и утверждениями — контракт поведения для CI; `skilltest init` создаст шаблон.
Находки guard · 0
✓ Критических и высоких находок нет
Просканировано файлов: 8. Улики замаскированы. Пометки в серых чипах объясняют, почему серьёзность понижена.
По спецификации Agent Skills
- предупреждение
description-no-whendescription не говорит, КОГДА применять скилл (нет "use when / используй когда") - предупреждение
missing-refссылка на отсутствующий файл: examples/task-planner-demo/
Процессный рейтинг: все десять параметров 35/100
- 0Инструменты и файлы. Не хватает 1 файла(ов): examples/task-planner-demo/
- 0Результат и критерий готовности. Не сказано, что считать результатом
- 0Входы и предусловия. Не сказано, что нужно иметь на входе
- 0Ошибки и развилки. Линейный процесс без обработки сбоев
- 0Отчётность по ходу. Скилл ничего не сообщает по ходу работы
- 20Когда включается. Не сказано, при каком запросе скилл включается
- 100Шаги. Шагов: 20
- 100Согласованность. Имя и обязательные поля на месте
- 100Стоимость исполнения. Тело инструкции 1263 токенов
- 100Повторный запуск. Изменяющих операций нет
- low Разделов верхнего уровня: 13. Похоже на несколько доменов в одном скилле
Всё перечисленное измерено по тексту скилла, а не оценено моделью: цифры проверяемы. Вес параметра тем больше, чем чаще из-за него процесс встаёт.
Сигналы качества
- +4Описание не говорит, когда скилл НЕ применять (ложные срабатывания)
- +3Формат ответа не описан: модель каждый раз решает сама
- -214 эмодзи в инструкциях: шум для модели
- +1Лицензия не указана
- +2Инструкции на одном языке
- +5В description 3 примера фраз-триггеров в кавычках
- +3Длина description 438 символов: достаточно сигнала, не съедает бюджет
- +4Структура: 29 заголовков
- +3Пошаговые инструкции: 20 пунктов
- +4Есть примеры (18 блоков кода)
- +4Справочные файлы упоминаются в инструкциях (4 из 4)
- +3Все 2 скриптов описаны в инструкциях
База качества 70; замечания lint вычитаются, сигналы прибавляют до 100. Итог: 76.