CD paper-review-lite
Проводит аудит рукописи перед подачей, охватывающий аргументацию, числовую согласованность, ссылки и DOI, написание, рисунки, блок CONSORT, предварительную регистрацию и архив воспроизводимости. Используйте перед подачей статьи или когда черновик нуждается во враждебном, основанном на цитатах обзоре с контрольным списком готовности к публикации в журнале. Добавьте `--codex`, чтобы независимо запустить спецификацию на Claude и Codex, GPT-6 Astra и перекрестно проверить результаты.
машинный переводПоказать оригиналСкрыть оригинал«Provides a pre-submission manuscript audit covering argument, numerica…»
Provides a pre-submission manuscript audit covering argument, numerical consistency, references and DOIs, writing, figures, CONSORT flow, pre-registration, and the replication archive. Use before paper submission or when a draft needs an adversarial, quote-grounded review with a journal-readiness checklist. Add `--codex` to run the specification independently on Claude and Codex, GPT-6 Astra, and cross-check findings.
Проводит аудит рукописи перед подачей, охватывающий аргументацию, числовую согласованность, ссылки и DOI, написание, рисунки, блок CONSORT, предварительную…
Как процесс D 45/100 · Процесс не доведён — Скилл ссылается на файлы, которых нет в архиве: ../orchestrate/SKILL.md
Чем это грозит
Находки средней серьёзности: скорее всего скилл честный, но прочитайте, что именно насторожило сканер.
Ниже описан худший случай для этой категории. Здесь находка средней серьёзности: guard увидел признак, но не доказательство.
Скилл просит больше прав, чем нужно для задачи: широкий доступ к инструментам, секретные переменные окружения, бинарные файлы. Каждое лишнее право расширяет ущерб при ошибке или взломе.
Сузьте allowed-tools и список переменных до минимума, замените бинарники на исходники или скрипты, которые можно прочитать.
Как улучшить
- Тело SKILL.md длиннее 5 000 токенов: вынесите справочные детали в references/ и подключайте по необходимости.
- В тексте есть ссылки на отсутствующие файлы: добавьте файлы или уберите ссылки.
- Свои кейсы (evals/evals.json, 4–6 реальных запросов с ожидаемыми ответами): тогда полная проверка прогонит именно их, а не черновик от модели.
- spec.yaml с триггерными фразами и утверждениями — контракт поведения для CI; `skilltest init` создаст шаблон.
Находки guard · 6
✓ Критических и высоких находок нет
Средние и низкие: 6
-
средняя Широкие права
meta-broad-allowed-toolsSKILL.md:1Заранее разрешены широкие инструменты: Bashallowed-tools: AskUserQuestion Read Write Edit Bash Glob Grep WebSearch WebFetch Agent
-
низкая Рискованное назначение
intent-offensive-securitySKILL.md:38Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)**Sub-agent model and effort assignment.** Route by task type, not by agent number — argument-level dimensions (evaluating logical structure, cross-referencing claims, detecting silent discrepancies)
-
низкая Рискованное назначение
intent-offensive-securitySKILL.md:74Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение) (определение детектора / чёрного списка)**Agent 1 — Content & Argument (Red Team primary)**: Read the full paper. Your posture is adversarial but fair: find every place the argument is weaker than the paper presents it to be. Check logical
детектор -
низкая Рискованное назначение
intent-offensive-securitySKILL.md:188Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение) (в кавычках — упоминание, а не команда)Two reviewers — Claude (the orchestrator) and Codex (GPT-6 Astra at `xhigh` reasoning effort by default, invoked via Bash `codex exec`) — independently apply the § 2 specification to the same paper, t
в кавычках -
низкая Рискованное назначение
intent-offensive-securitySKILL.md:190Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)Roughly 22 model calls total (9 Claude Red Team, 9 Codex Red Team, 4 cross-model Blue Team) plus orientation and synthesis by the orchestrator. Reach for it before submission when you want maximum adv
-
низкая Рискованное назначение
intent-offensive-securitySKILL.md:192Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение) (в кавычках — упоминание, а не команда)**`--codex-effort <low|medium|high|xhigh>`** sets the reasoning effort for every Codex call in the run (default `xhigh`). Use it when the paper is short, the run is a mid-draft pass rather than the fi
в кавычках
Просканировано файлов: 2. Улики замаскированы. Пометки в серых чипах объясняют, почему серьёзность понижена.
По спецификации Agent Skills
- предупреждение
body-longтело SKILL.md ≈ 11546 токенов (рекомендуется < 5000); вынесите детали в references/ - предупреждение
missing-refссылка на отсутствующий файл: ../orchestrate/SKILL.md
Процессный рейтинг: все десять параметров 45/100
- 0Инструменты и файлы. Не хватает 1 файла(ов): ../orchestrate/SKILL.md
- 0Входы и предусловия. Не сказано, что нужно иметь на входе
- 20Когда включается. Не сказано, при каком запросе скилл включается
- 40Стоимость исполнения. Тело инструкции 11546 токенов: вытесняет саму задачу из окна
- 50Ошибки и развилки. Развилок: 0, есть раздел про ошибки
- 60Результат и критерий готовности. Формат результата описан, критерия завершения нет
- 85Шаги. Шагов: 54, расплывчатых формулировок: 1
- 100Согласованность. Имя и обязательные поля на месте
- 100Повторный запуск. Изменяющие операции проверяют текущее состояние
- 100Отчётность по ходу. Скилл сообщает о ходе работы
Всё перечисленное измерено по тексту скилла, а не оценено моделью: цифры проверяемы. Вес параметра тем больше, чем чаще из-за него процесс встаёт.
Сигналы качества
- +5В description нет примеров фраз, по которым скилл должен срабатывать
- +4Описание не говорит, когда скилл НЕ применять (ложные срабатывания)
- +1Лицензия не указана
- +2Инструкции на одном языке
- +3Длина description 421 символов: достаточно сигнала, не съедает бюджет
- +4Структура: 17 заголовков
- +3Пошаговые инструкции: 54 пунктов
- +3Формат ответа описан явно
- +4Есть примеры (6 блоков кода)
- +4Справочные файлы упоминаются в инструкциях (1 из 1)
База качества 70; замечания lint вычитаются, сигналы прибавляют до 100. Итог: 75.