SKILLEMALL.ai

AC constraint-driven-development

Устанавливает планку качества проекта в виде письменного контракта и не позволяет агентам тихо ее снижать. Опрашивает пользователя о том, какие параметры важны, предоставляет разумные пороговые значения по умолчанию, когда у него нет числа на уме, записывает все в CONSTRAINTS.md и отслеживает изменения на предмет ослабления планки — новые подавления @ts-ignore или eslint-disable, пропущенные или удаленные тесты, удаленные утверждения, нереализованные заглушки, измененные в сторону уменьшения пороговые значения. Используйте, когда планка качества не записана, когда пользователь говорит «установить ограничения» или «определить наши стандарты», когда пользователь хочет, чтобы важные для него параметры — доступность, веб-производительность, покрытие — были установлены как принудительные ограничения, когда агент постоянно отключает проверки или пропускает тесты, чтобы получить зеленый свет, когда вам нужен порог покрытия или производительности, и вы не знаете, какое число выбрать, или когда агент пишет больше кода, чем кто-либо будет читать.

машинный переводПоказать оригиналСкрыть оригинал«Establishes a project's quality bar as a written contract and stops ag…»

Establishes a project's quality bar as a written contract and stops agents quietly lowering it. Interviews the user on which dimensions matter, supplies sane default thresholds when they have no number in mind, records everything in CONSTRAINTS.md, and watches the diff for a weakened bar — new @ts-ignore or eslint-disable suppressions, skipped or deleted tests, assertions stripped out, unimplemented stubs, thresholds edited down. Use when no quality bar is written down, when the user says "set up constraints" or "define our standards", when the user wants dimensions they care about — accessibility, web performance, coverage — set up as enforced constraints, when an agent keeps silencing checks or skipping tests to get to green, when you need a coverage or performance threshold and don't know what number to pick, or when an agent writes more code than anyone will read.

addyosmani/agent-skills Agent Skills автор: addyosmani MIT 2 файла тело ≈ 5 005 токенов Открыть источникgithub.com проанализирован 2 дн назад

Устанавливает планку качества проекта в виде письменного контракта и не позволяет агентам тихо ее снижать.

Как процесс C 52/100 · Есть пробелы — слабые места: результат и критерий готовности, входы и предусловия, ошибки и развилки

ПроцедураИИ и агентыРазработкатип и темы размечены автоматически по тексту скилла
JSON
Технический рейтинг
A
90/100
безопасность, качество, тесты
Безопасность 60%
100
Качество 40%
75
Прогон на моделях
не было
Процессный рейтинг
C
52/100
Есть пробелы
Результат и критерий готовности вес 14
0
Входы и предусловия вес 11
0
Ошибки и развилки вес 10
0
три самых слабых из десяти параметров · все десять

Как улучшить

  1. Тело SKILL.md длиннее 5 000 токенов: вынесите справочные детали в references/ и подключайте по необходимости.
Для прогона на моделях — необязательно
  • Свои кейсы (evals/evals.json, 4–6 реальных запросов с ожидаемыми ответами): тогда полная проверка прогонит именно их, а не черновик от модели.
  • spec.yaml с триггерными фразами и утверждениями — контракт поведения для CI; `skilltest init` создаст шаблон.

Находки guard · 0

✓ Критических и высоких находок нет

Просканировано файлов: 2. Улики замаскированы. Пометки в серых чипах объясняют, почему серьёзность понижена.

По спецификации Agent Skills

  • предупреждение body-long тело SKILL.md ≈ 5005 токенов (рекомендуется < 5000); вынесите детали в references/
  • заметка edit-residue в тексте есть пометки об устаревшем (строки 133): проверьте, не остались ли старые правила рядом с новыми — полная проверка читает текст на противоречия

Процессный рейтинг: все десять параметров 52/100

  • 0Результат и критерий готовности. Не сказано, что считать результатом
  • 0Входы и предусловия. Не сказано, что нужно иметь на входе
  • 0Ошибки и развилки. Линейный процесс без обработки сбоев
  • 60Инструменты и файлы. Используются инструменты (bash, python, node), но во frontmatter они не объявлены
  • 70Когда включается. Сказано, когда применять, но не сказано, когда не стоит
  • 70Стоимость исполнения. Тело инструкции 5005 токенов
  • 100Шаги. Шагов: 53
  • 100Согласованность. Имя и обязательные поля на месте
  • 100Повторный запуск. Изменяющие операции проверяют текущее состояние
  • 100Отчётность по ходу. Скилл сообщает о ходе работы
  • low Разделов верхнего уровня: 10. Похоже на несколько доменов в одном скилле
  • low Скилл сам сортирует и ранжирует выдачу: это работа системы на той стороне, а не модели

Всё перечисленное измерено по тексту скилла, а не оценено моделью: цифры проверяемы. Вес параметра тем больше, чем чаще из-за него процесс встаёт.

Сигналы качества

  • +4Описание не говорит, когда скилл НЕ применять (ложные срабатывания)
  • +3Длина description 880: рекомендуется 120–800 символов
  • +3Формат ответа не описан: модель каждый раз решает сама
  • -5В тексте остались TODO / заглушки
  • +1Лицензия не указана
  • +2Инструкции на одном языке
  • +5В description 2 примера фраз-триггеров в кавычках
  • +4Структура: 18 заголовков
  • +3Пошаговые инструкции: 53 пунктов
  • +4Есть примеры (6 блоков кода)
  • +4Справочные файлы упоминаются в инструкциях (1 из 1)

База качества 70; замечания lint вычитаются, сигналы прибавляют до 100. Итог: 75.