AC cold-review
Напишите краткое изложение для одного независимого холодного рецензента и оцените то, что он вернет, изолировав его от группы, которая уже оценила изменение. Читается тем, кто СОСТАВЛЯЕТ краткое изложение; оцениваемое место никогда не загружает этот файл. Охватывает, что предоставляется месту, на что влияет его вердикт, кто может его отменить и как правила ухудшаются, когда набор поставщика короток. Используйте, когда группа достигла консенсуса, и вам нужно второе мнение, которое не может быть закреплено консенсусом, когда изменение чувствительно к безопасности или его трудно отменить, или когда вы являетесь автором и, следовательно, худшим доступным читателем своей собственной работы.
машинный переводПоказать оригиналСкрыть оригинал«Write the brief for a single independent cold reviewer and grade what…»
Write the brief for a single independent cold reviewer and grade what it returns, keeping it isolated from the panel that already graded the change. Read by whoever AUTHORS the brief; the graded seat never loads this file. Covers what the seat is given, what its verdict binds, who may override it, and how the rules degrade when the vendor set is short. Use when a panel has reached consensus and you want a second opinion consensus cannot anchor, when a change is security-sensitive or hard to reverse, or when you are the author and therefore the worst available reader of your own work.
Напишите краткое изложение для одного независимого холодного рецензента и оцените то, что он вернет, изолировав его от группы, которая уже оценила изменение.
Как процесс C 58/100 · Есть пробелы — слабые места: результат и критерий готовности, повторный запуск, отчётность по ходу
Как улучшить
- Свои кейсы (evals/evals.json, 4–6 реальных запросов с ожидаемыми ответами): тогда полная проверка прогонит именно их, а не черновик от модели.
- spec.yaml с триггерными фразами и утверждениями — контракт поведения для CI; `skilltest init` создаст шаблон.
Находки guard · 0
✓ Критических и высоких находок нет
Просканировано файлов: 1. Улики замаскированы. Пометки в серых чипах объясняют, почему серьёзность понижена.
По спецификации Agent Skills
✓ По спецификации Agent Skills замечаний нет
Процессный рейтинг: все десять параметров 58/100
- 0Результат и критерий готовности. Не сказано, что считать результатом
- 0Отчётность по ходу. Скилл ничего не сообщает по ходу работы
- 30Повторный запуск. Изменяющих операций: 9, без проверки текущего состояния
- 50Когда включается. Не сказано, при каком запросе скилл включается
- 50Ошибки и развилки. Развилок: 0, есть раздел про ошибки
- 60Инструменты и файлы. Используются инструменты (bash, web), но во frontmatter они не объявлены
- 70Входы и предусловия. Входные данные и предусловия перечислены
- 70Стоимость исполнения. Тело инструкции 4076 токенов
- 100Шаги. Шагов: 36
- 100Согласованность. Имя и обязательные поля на месте
- medium Правила безопасности и запреты внутри скилла: их место в системном промпте, здесь они не защищают
- low Разделов верхнего уровня: 11. Похоже на несколько доменов в одном скилле
Всё перечисленное измерено по тексту скилла, а не оценено моделью: цифры проверяемы. Вес параметра тем больше, чем чаще из-за него процесс встаёт.
Сигналы качества
- +5В description нет примеров фраз, по которым скилл должен срабатывать
- +4Описание не говорит, когда скилл НЕ применять (ложные срабатывания)
- +3Формат ответа не описан: модель каждый раз решает сама
- +1Лицензия не указана
- +2Инструкции на одном языке
- +3Длина description 590 символов: достаточно сигнала, не съедает бюджет
- +4Структура: 12 заголовков
- +3Пошаговые инструкции: 36 пунктов
- +4Есть примеры (0 блоков кода)
База качества 70; замечания lint вычитаются, сигналы прибавляют до 100. Итог: 84.