BC pibox
pi-coding-agent (earendil-works) работает в сети внутри контейнера aicodebox. Предоставляет семь программных интерфейсов в одном образе — интерактивную оболочку, одноразовое выполнение (`-p "..."`), HTTP REST API (run/async/cancel, операции с файлами в рабочей области), совместимую с OpenAI конечную точку `/openai/v1/chat/completions` (потоковая передача, вызов инструментов клиентом, response_format/JSON-schema), MCP-сервер по адресу `/mcp` (смонтированный в режиме API или как sidecar), Telegram-бота и планировщик cron, который запускает pi по расписанию. Режимы работы (API/Telegram/Cron) взаимоисключающие, кроме Telegram+Cron; MCP сосуществует с любым из них. Аутентификация по Bearer-токену для каждого интерфейса (`PIBOX_API_MODE_TOKEN`, `PIBOX_MCP_MODE_TOKEN`), пустое значение = нет аутентификации. Используйте, когда пользователь хочет управлять pi-coding-agent программно через HTTP/MCP/Telegram/cron вместо локальной сессии терминала или когда нужно определить, какой режим/конечная точка pibox подходит для данной интеграции.
машинный переводПоказать оригиналСкрыть оригинал«pi-coding-agent (earendil-works) running on the network inside an aico…»
pi-coding-agent (earendil-works) running on the network inside an aicodebox container. Exposes seven programmatic surfaces on one image — interactive shell, one-shot exec (`-p "..."`), an HTTP REST API (run/async/cancel, workspace file ops), an OpenAI-compatible `/openai/v1/chat/completions` endpoint (streaming, client-executed tool calling, response_format/JSON-schema), an MCP server at `/mcp` (mounted in API mode or as a sidecar), a Telegram bot, and a cron scheduler that fires pi on a schedule. Foreground modes (API/Telegram/Cron) are mutually exclusive except Telegram+Cron; MCP coexists with any of them. Bearer-token auth per surface (`PIBOX_API_MODE_TOKEN`, `PIBOX_MCP_MODE_TOKEN`), empty = no auth. Use when the user wants to drive pi-coding-agent programmatically over HTTP/MCP/Telegram/cron instead of a local terminal session, or needs to reason about which pibox mode/endpoint fits a given integration.
pi-coding-agent (earendil-works) работает в сети внутри контейнера aicodebox.
Как процесс C 52/100 · Есть пробелы — слабые места: результат и критерий готовности, входы и предусловия, повторный запуск
Чем это грозит
Находки средней серьёзности: скорее всего скилл честный, но прочитайте, что именно насторожило сканер.
Ниже описан худший случай для этой категории. Здесь находка средней серьёзности: guard увидел признак, но не доказательство.
Инструкции или скрипты отправляют данные наружу: переменные окружения, ключи, содержимое файлов, историю чата. Вы можете не заметить этого в диалоге, потому что агент выполнит отправку как «часть задачи».
Если отправка не нужна для задачи, уберите её: каталоги помечают такие скиллы как подозрительные и снимают с выдачи. Если нужна, назовите адрес явно, объясните, что именно уходит, и дайте пользователю выключатель.
Как улучшить
- Свои кейсы (evals/evals.json, 4–6 реальных запросов с ожидаемыми ответами): тогда полная проверка прогонит именно их, а не черновик от модели.
- spec.yaml с триггерными фразами и утверждениями — контракт поведения для CI; `skilltest init` создаст шаблон.
Находки guard · 2
✓ Критических и высоких находок нет
Средние и низкие: 2
-
средняя Утечка данных
net-credential-useSKILL.md:272Учётные данные используются в сетевом вызове (проверьте, что адрес — нужный сервис)curl -s http://loca…080/run -H "Authorization: Bearer $SECRET" \
-
средняя Утечка данных
net-credential-useSKILL.md:279Учётные данные используются в сетевом вызове (проверьте, что адрес — нужный сервис)curl -s http://loca…080/run -H "Authorization: Bearer $SECRET" \
Просканировано файлов: 3. Улики замаскированы. Пометки в серых чипах объясняют, почему серьёзность понижена.
По спецификации Agent Skills
- заметка
frontmatter-keyнеизвестное поле фронтматтера "homepage"
Процессный рейтинг: все десять параметров 52/100
- 0Результат и критерий готовности. Не сказано, что считать результатом
- 0Входы и предусловия. Не сказано, что нужно иметь на входе
- 30Повторный запуск. Изменяющих операций: 30, без проверки текущего состояния
- 50Ошибки и развилки. Развилок: 0, есть раздел про ошибки
- 60Инструменты и файлы. Используются инструменты (bash, web), но во frontmatter они не объявлены
- 70Когда включается. Сказано, когда применять, но не сказано, когда не стоит
- 70Стоимость исполнения. Тело инструкции 4730 токенов
- 85Шаги. Шагов: 18, расплывчатых формулировок: 2
- 100Согласованность. Имя и обязательные поля на месте
- 100Отчётность по ходу. Скилл сообщает о ходе работы
- medium Правила безопасности и запреты внутри скилла: их место в системном промпте, здесь они не защищают
- low Разделов верхнего уровня: 12. Похоже на несколько доменов в одном скилле
- low Ответ описан самодельной разметкой (6 тегов): типизированный вызов надёжнее
Всё перечисленное измерено по тексту скилла, а не оценено моделью: цифры проверяемы. Вес параметра тем больше, чем чаще из-за него процесс встаёт.
Сигналы качества
- +5В description нет примеров фраз, по которым скилл должен срабатывать
- +4Описание не говорит, когда скилл НЕ применять (ложные срабатывания)
- +3Длина description 920: рекомендуется 120–800 символов
- +3Формат ответа не описан: модель каждый раз решает сама
- -2Ссылки на localhost: у другого пользователя не заработает
- +1Лицензия не указана
- +2Инструкции на одном языке
- +4Структура: 13 заголовков
- +3Пошаговые инструкции: 18 пунктов
- +4Есть примеры (14 блоков кода)
- +4Справочные файлы упоминаются в инструкциях (1 из 1)
База качества 70; замечания lint вычитаются, сигналы прибавляют до 100. Итог: 82.