AC assess-me
Аудит когнитивного состояния: проверка текущего рассуждения на наличие неопределенности, противоречий или слепых зон. Необходимо использовать этот навык, когда пользователь ставит под сомнение ("Вы уверены?", "Проверьте еще раз", "review"), результаты инструмента ненормальны или пусты, или требуется проверка полноты после исправления. Ключевые слова: вы уверены, проверьте еще раз, review, verify, аудит, double check, проверка полноты. Даже если пользователь явно не говорит "аудит", он должен срабатывать, как только пользователь ставит под сомнение ваше суждение или инструмент возвращает неожиданный результат.
машинный переводПоказать оригиналСкрыть оригинал«认知状态审计:检查当前推理是否存在不确定性、矛盾或盲点。 当用户质疑("你确定吗"、"再检查"、"review")、工具结果异常或为空、 或…»
认知状态审计:检查当前推理是否存在不确定性、矛盾或盲点。 当用户质疑("你确定吗"、"再检查"、"review")、工具结果异常或为空、 或修复后需验证完整性时,必须使用此 Skill。 关键词:你确定吗、再检查、review、verify、审计、double check、检查完整性。 即使用户没有明确说"审计",只要用户质疑你的判断或工具返回意外结果,都应触发。
Аудит когнитивного состояния: проверка текущего рассуждения на наличие неопределенности, противоречий или слепых зон.
Как процесс C 55/100 · Есть пробелы — слабые места: когда включается, входы и предусловия, ошибки и развилки
Как улучшить
- Скажите в description, КОГДА применять скилл («используй, когда…», примеры запросов): это главный сигнал для агента.
- Свои кейсы (evals/evals.json, 4–6 реальных запросов с ожидаемыми ответами): тогда полная проверка прогонит именно их, а не черновик от модели.
- spec.yaml с триггерными фразами и утверждениями — контракт поведения для CI; `skilltest init` создаст шаблон.
Находки guard · 0
✓ Критических и высоких находок нет
Просканировано файлов: 2. Улики замаскированы. Пометки в серых чипах объясняют, почему серьёзность понижена.
По спецификации Agent Skills
- предупреждение
description-no-whendescription не говорит, КОГДА применять скилл (нет "use when / используй когда")
Процессный рейтинг: все десять параметров 55/100
- 0Входы и предусловия. Не сказано, что нужно иметь на входе
- 0Ошибки и развилки. Линейный процесс без обработки сбоев
- 0Отчётность по ходу. Скилл ничего не сообщает по ходу работы
- 20Когда включается. Не сказано, при каком запросе скилл включается
- 60Инструменты и файлы. Используются инструменты (read), но во frontmatter они не объявлены
- 60Результат и критерий готовности. Формат результата описан, критерия завершения нет
- 100Шаги. Шагов: 28
- 100Согласованность. Имя и обязательные поля на месте
- 100Стоимость исполнения. Тело инструкции 676 токенов
- 100Повторный запуск. Изменяющих операций нет
Всё перечисленное измерено по тексту скилла, а не оценено моделью: цифры проверяемы. Вес параметра тем больше, чем чаще из-за него процесс встаёт.
Сигналы качества
- +5В description нет примеров фраз, по которым скилл должен срабатывать
- +4Описание не говорит, когда скилл НЕ применять (ложные срабатывания)
- +1Лицензия не указана
- +2Инструкции на одном языке
- +3Длина description 183 символов: достаточно сигнала, не съедает бюджет
- +4Структура: 8 заголовков
- +3Пошаговые инструкции: 28 пунктов
- +3Формат ответа описан явно
- +4Есть примеры (2 блоков кода)
База качества 70; замечания lint вычитаются, сигналы прибавляют до 100. Итог: 75.