SKILLEMALL.ai

Скиллы в компании: процесс вместо папки с файлами

Скиллы заводятся в компании сами. Их пишет аналитик, чтобы агент отвечал на вопросы по отчётности; поддержка копирует что-то из открытого каталога и правит под себя; разработчик кладёт в репозиторий папку с инструкцией и забывает про неё на полгода. Через год их сотня, и на простой вопрос — какие из них ещё работают, какие дублируют друг друга, какие уносят данные наружу — в компании нет ответа. Мы ставим процесс, при котором ответ есть в любой день, и оставляем его вам вместе с людьми, которые умеют его поддерживать.

Через месяц пилота у команды есть список её скиллов с оценками, гейт, который не пускает опасное в общий каталог, и люди, умеющие это поддерживать.

Что мы делаем

1. Создание: чтобы скиллы писали одинаково

Стандарт компании: что обязано быть в SKILL.md, как описываются триггеры, какие тесты прилагаются к скиллу, чтобы его вообще приняли. Шаблоны под ваши типовые задачи и правила именования, чтобы два скилла не перехватывали друг у друга одну и ту же просьбу пользователя — это самая частая причина, по которой «агент почему-то не делает то, что просили».

2. Верификация: проверка до публикации и потом каждый месяц

Тот же движок, что считает публичный рейтинг, встаёт внутрь вашего процесса. Перед публикацией скилл проходит гейт: сканирование на секреты, автозапуск команд, инъекции и подмену инструкций — на русском и английском, потому что «игнорируй предыдущие инструкции» англоязычные сканеры не видят. Гейт вешается на pre-commit и на сборку, так что опасный скилл не доезжает до общего каталога.

Дальше — регулярный прогон на моделях: каждый кейс выполняется дважды, со скиллом и без, и видно, даёт ли скилл прирост или уже нет. Работает на тех моделях, что есть у вас, включая GigaChat и YandexGPT.

Модели меняются, и скилл, который работал в марте, к осени может тихо перестать срабатывать. Прогон ловит это раньше, чем пользователи.

Результат — внутренний каталог с теми же двумя оценками, что в публичном: техническая (безопасность и качество текста) и зрелость процесса (есть ли у скилла тесты, версия, лицензия, следы сопровождения). Закрытый, только для вас.

3. Обучение: чтобы это жило без нас

Воркшоп для команд: как устроен скилл, почему он срабатывает не тогда, когда ждали, как писать проверяемые утверждения вместо пожеланий. Разбираем не абстрактные примеры, а ваши собственные скиллы — обычно это самая полезная часть. Отдельно — короткая сессия для тех, кто будет держать гейт: как читать отчёт, когда находка настоящая, а когда сканер придирается к строчке из документации.

Как идёт работа

Аудит. Забираем то, что уже написано, прогоняем через проверки и показываем карту: что живо, что дублируется, что опасно, где лежат ключи в открытом виде. Обычно на этом этапе выясняется, что скиллов вдвое больше, чем думали. Аудит даёт смету на всё остальное.

Пилот. Одна команда: стандарт, гейт перед публикацией, внутренний каталог. Месяц — чтобы понять, приживается ли, до того как это касается всех.

Внедрение. Остальные команды, подключение к вашей сборке, обучение, передача правил.

Сопровождение. Ежемесячный прогон и отчёт, обновление правил под новые модели. По желанию — мы просто присылаем отчёт, а процесс держите вы.

Что остаётся у вас

Сколько это стоит

Начните с аудита: пара недель, недорого — и честная смета на остальное вместе с ответом, нужно ли вам внедрение вообще.

Дальше цена зависит от числа команд и от того, сколько скиллов уже написано. Публичный сервис при этом остаётся бесплатным: рейтинг и быстрый скан не требуют ни оплаты, ни регистрации, и ими можно пользоваться параллельно.

Написать о внедрении

Ответим на указанную почту. Ничего, кроме адреса для ответа, заполнять не обязательно.