SKILLEMALL.ai

AB arize-prompt-optimization

Оптимизирует, улучшает и отлаживает LLM-промпты с использованием данных производственных трассировок, оценок и аннотаций. Извлекает промпты из спанов, собирает сигналы производительности и запускает цикл оптимизации на основе данных с помощью ax CLI. Используйте, когда пользователь упоминает оптимизировать промпт, улучшить промпт, заставить ИИ отвечать лучше, улучшить качество вывода, промпт-инжиниринг, тюнинг промпта или улучшение системного промпта.

машинный переводПоказать оригиналСкрыть оригинал«Optimizes, improves, and debugs LLM prompts using production trace dat…»

Optimizes, improves, and debugs LLM prompts using production trace data, evaluations, and annotations. Extracts prompts from spans, gathers performance signal, and runs a data-driven optimization loop using the ax CLI. Use when the user mentions optimize prompt, improve prompt, make AI respond better, improve output quality, prompt engineering, prompt tuning, or system prompt improvement.

github/awesome-copilot Agent Skills автор: github MIT 3 файла тело ≈ 4 660 токенов Открыть источникgithub.com проанализирован 29 ч назад

Оптимизирует, улучшает и отлаживает LLM-промпты с использованием данных производственных трассировок, оценок и аннотаций.

Как процесс B 78/100 · Почти готов — слабые места: отчётность по ходу

АнализаторИИ и агентытип и темы размечены автоматически по тексту скилла
JSON
Технический рейтинг
A
93/100
безопасность, качество, тесты
Безопасность 60%
95
Качество 40%
91
Прогон на моделях
не было
Процессный рейтинг
B
78/100
Почти готов
Отчётность по ходу вес 2
0
Инструменты и файлы вес 18
60
Результат и критерий готовности вес 14
60
три самых слабых из десяти параметров · все десять

Такой же скилл встречается ещё в 1 месте: RA-Skills

Чем это грозит

Находки средней серьёзности: скорее всего скилл честный, но прочитайте, что именно насторожило сканер.

Утечка данных средняя серьёзность

Ниже описан худший случай для этой категории. Здесь находка средней серьёзности: guard увидел признак, но не доказательство.

Если установить

Инструкции или скрипты отправляют данные наружу: переменные окружения, ключи, содержимое файлов, историю чата. Вы можете не заметить этого в диалоге, потому что агент выполнит отправку как «часть задачи».

Автору

Если отправка не нужна для задачи, уберите её: каталоги помечают такие скиллы как подозрительные и снимают с выдачи. Если нужна, назовите адрес явно, объясните, что именно уходит, и дайте пользователю выключатель.

Как улучшить

    Для прогона на моделях — необязательно
    • Свои кейсы (evals/evals.json, 4–6 реальных запросов с ожидаемыми ответами): тогда полная проверка прогонит именно их, а не черновик от модели.
    • spec.yaml с триггерными фразами и утверждениями — контракт поведения для CI; `skilltest init` создаст шаблон.

    Находки guard · 1

    ✓ Критических и высоких находок нет

    Средние и низкие: 1
    • средняя Утечка данных net-credential-use references/ax-profiles.md:72
      Учётные данные используются в сетевом вызове (проверьте, что адрес — нужный сервис)
      Once the user confirms the variable is set, proceed with `ax profiles create --api-key $ARIZE_API_KEY` or `ax profiles update --api-key $ARIZE_API_KEY` as described above.

    Просканировано файлов: 3. Улики замаскированы. Пометки в серых чипах объясняют, почему серьёзность понижена.

    По спецификации Agent Skills

    ✓ По спецификации Agent Skills замечаний нет

    Процессный рейтинг: все десять параметров 78/100

    • 0Отчётность по ходу. Скилл ничего не сообщает по ходу работы
    • 60Инструменты и файлы. Используются инструменты (bash, python), но во frontmatter они не объявлены
    • 60Результат и критерий готовности. Формат результата описан, критерия завершения нет
    • 70Когда включается. Сказано, когда применять, но не сказано, когда не стоит
    • 70Стоимость исполнения. Тело инструкции 4660 токенов
    • 85Шаги. Шагов: 46, расплывчатых формулировок: 1
    • 100Входы и предусловия. Входные данные и предусловия перечислены
    • 100Ошибки и развилки. Развилок: 1, есть раздел про ошибки
    • 100Согласованность. Имя и обязательные поля на месте
    • 100Повторный запуск. Изменяющие операции проверяют текущее состояние
    • low Ответ описан самодельной разметкой (6 тегов): типизированный вызов надёжнее

    Всё перечисленное измерено по тексту скилла, а не оценено моделью: цифры проверяемы. Вес параметра тем больше, чем чаще из-за него процесс встаёт.

    Сигналы качества

    • +5В description нет примеров фраз, по которым скилл должен срабатывать
    • +4Описание не говорит, когда скилл НЕ применять (ложные срабатывания)
    • +1Лицензия не указана
    • +2Инструкции на одном языке
    • +3Длина description 391 символов: достаточно сигнала, не съедает бюджет
    • +4Структура: 32 заголовков
    • +3Пошаговые инструкции: 46 пунктов
    • +3Формат ответа описан явно
    • +4Есть примеры (19 блоков кода)
    • +4Справочные файлы упоминаются в инструкциях (2 из 2)

    База качества 70; замечания lint вычитаются, сигналы прибавляют до 100. Итог: 91.