DF Decision Economic Optimizer
API для детерминированного ранжирования решений с платежами в USDC по HTTP 402 и кредитными баллами за результат (скидки).
машинный переводПоказать оригиналСкрыть оригинал«Deterministic decision-ranking API with HTTP 402 USDC payments and out…»
Deterministic decision-ranking API with HTTP 402 USDC payments and outcome credits (discounts).
API для детерминированного ранжирования решений с платежами в USDC по HTTP 402 и кредитными баллами за результат (скидки).
Как процесс F 38/100 · Не запустится — Скилл ссылается на файлы, которых нет в архиве: "https://api.which-llm.com/report/wrong_address"
Чем это грозит
Скилл содержит фрагменты, которые в чужих руках стоят денег или данных. Ниже, что рискует потерять тот, кто установит, и что должен сделать автор.
Скилл содержит команды, которые удаляют файлы, переписывают диски или исполняют код, скачанный из сети. Агент может выполнить их без вопроса, если считает, что так требует инструкция.
Замените разрушительные команды на безопасные аналоги с подтверждением, ограничьте область действия конкретной папкой и не тяните код через curl | bash: укажите версию и контрольную сумму.
Ниже описан худший случай для этой категории. Здесь находка средней серьёзности: guard увидел признак, но не доказательство.
Назначение скилла само по себе рискованное: работа с кошельками, паролями браузера, наступательная безопасность. Даже честная реализация даёт агенту доступ к тому, что стоит денег.
Объясните в description, зачем нужен доступ и как он ограничен; добавьте тесты, которые показывают отказ на опасных запросах.
Как улучшить
- Разберите находки высокой серьёзности: каждая стоит 18 баллов безопасности. Если это ложное срабатывание, добавьте код правила в guard.allow в spec.yaml.
- Скажите в description, КОГДА применять скилл («используй, когда…», примеры запросов): это главный сигнал для агента.
- Тело SKILL.md длиннее 5 000 токенов: вынесите справочные детали в references/ и подключайте по необходимости.
- В тексте есть ссылки на отсутствующие файлы: добавьте файлы или уберите ссылки.
- Свои кейсы (evals/evals.json, 4–6 реальных запросов с ожидаемыми ответами): тогда полная проверка прогонит именно их, а не черновик от модели.
- spec.yaml с триггерными фразами и утверждениями — контракт поведения для CI; `skilltest init` создаст шаблон.
Находки guard · 7
-
высокая Опасные команды
cmd-pipe-to-shellSKILL.md:314Скачивание и запуск удалённого кода с неизвестного хоста (pipe в shell)curl -L https://foundry.paradigm.xyz | bash
Средние и низкие: 6
-
средняя Рискованное назначение
intent-wallet-secretsSKILL.md:84Работает с секретами криптокошелька (сид-фраза / приватный ключ) — классическая цель стилеров#### Option 2: Mnemonic Phrase
-
средняя Рискованное назначение
intent-wallet-secretsSKILL.md:86Работает с секретами криптокошелька (сид-фраза / приватный ключ) — классическая цель стилеров**Format:** 12 or 24-word BIP-39 seed phrase
-
средняя Рискованное назначение
intent-wallet-secretsSKILL.md:102Работает с секретами криптокошелька (сид-фраза / приватный ключ) — классическая цель стилеров#### Option 3: Keystore File + Password
-
средняя Рискованное назначение
intent-wallet-secretsSKILL.md:104Работает с секретами криптокошелька (сид-фраза / приватный ключ) — классическая цель стилеров**Format:** Encrypted JSON keystore file (Ethereum standard) + password
-
средняя Рискованное назначение
intent-wallet-secretsSKILL.md:116Работает с секретами криптокошелька (сид-фраза / приватный ключ) — классическая цель стилеров- ⚠️ **File management overhead** - Must securely store keystore file
-
низкая Рискованное назначение
intent-wallet-secretsskill.json:53Работает с секретами криптокошелька (сид-фраза / приватный ключ) — классическая цель стилеров (в кавычках — упоминание, а не команда)"format": "12 or 24-word BIP-39 seed phrase",
в кавычках
Просканировано файлов: 2. Улики замаскированы. Пометки в серых чипах объясняют, почему серьёзность понижена.
По спецификации Agent Skills
- предупреждение
name-formatname должен быть в kebab-case (строчные буквы, цифры, дефисы) - предупреждение
description-no-whendescription не говорит, КОГДА применять скилл (нет "use when / используй когда") - предупреждение
body-longтело SKILL.md ≈ 8220 токенов (рекомендуется < 5000); вынесите детали в references/ - предупреждение
missing-refссылка на отсутствующий файл: "https://api.which-llm.com/report/wrong_address" - заметка
frontmatter-keyнеизвестное поле фронтматтера "homepage" - заметка
frontmatter-keyнеизвестное поле фронтматтера "credentials_required" - заметка
frontmatter-keyнеизвестное поле фронтматтера "primary_credential"
Процессный рейтинг: все десять параметров 38/100
- 0Инструменты и файлы. Не хватает 1 файла(ов): "https://api.which-llm.com/report/wrong_address"
- 0Результат и критерий готовности. Не сказано, что считать результатом
- 0Отчётность по ходу. Скилл ничего не сообщает по ходу работы
- 30Повторный запуск. Изменяющих операций: 20, без проверки текущего состояния
- 40Согласованность. Имя во frontmatter (Decision Economic Optimizer) не совпадает с папкой (which-llm)
- 40Стоимость исполнения. Тело инструкции 8220 токенов: вытесняет саму задачу из окна
- 50Когда включается. Не сказано, при каком запросе скилл включается
- 50Ошибки и развилки. Развилок: 0, есть раздел про ошибки
- 70Входы и предусловия. Входные данные и предусловия перечислены
- 85Шаги. Шагов: 179, расплывчатых формулировок: 1
- medium Правила безопасности и запреты внутри скилла: их место в системном промпте, здесь они не защищают
- low Разделов верхнего уровня: 10. Похоже на несколько доменов в одном скилле
Всё перечисленное измерено по тексту скилла, а не оценено моделью: цифры проверяемы. Вес параметра тем больше, чем чаще из-за него процесс встаёт.
Сигналы качества
- +5В description нет примеров фраз, по которым скилл должен срабатывать
- +4Описание не говорит, когда скилл НЕ применять (ложные срабатывания)
- +3Длина description 95: рекомендуется 120–800 символов
- +3Формат ответа не описан: модель каждый раз решает сама
- -227 эмодзи в инструкциях: шум для модели
- +1Лицензия не указана
- +2Инструкции на одном языке
- +4Структура: 49 заголовков
- +3Пошаговые инструкции: 179 пунктов
- +4Есть примеры (31 блоков кода)
База качества 70; замечания lint вычитаются, сигналы прибавляют до 100. Итог: 43.