Скиллы в компании: процесс вместо папки с файлами
Скиллы заводятся в компании сами. Их пишет аналитик, чтобы агент отвечал на вопросы по отчётности; поддержка копирует что-то из открытого каталога и правит под себя; разработчик кладёт в репозиторий папку с инструкцией и забывает про неё на полгода. Через год их сотня, и на простой вопрос — какие из них ещё работают, какие дублируют друг друга, какие уносят данные наружу — в компании нет ответа. Мы ставим процесс, при котором ответ есть в любой день, и оставляем его вам вместе с людьми, которые умеют его поддерживать.
Через месяц пилота у команды есть список её скиллов с оценками, гейт, который не пускает опасное в общий каталог, и люди, умеющие это поддерживать.
Что мы делаем
1. Создание: чтобы скиллы писали одинаково
Стандарт компании: что обязано быть в SKILL.md, как описываются триггеры, какие тесты прилагаются к скиллу, чтобы его вообще приняли. Шаблоны под ваши типовые задачи и правила именования, чтобы два скилла не перехватывали друг у друга одну и ту же просьбу пользователя — это самая частая причина, по которой «агент почему-то не делает то, что просили».
2. Верификация: проверка до публикации и потом каждый месяц
Тот же движок, что считает публичный рейтинг, встаёт внутрь вашего процесса. Перед публикацией скилл проходит гейт: сканирование на секреты, автозапуск команд, инъекции и подмену инструкций — на русском и английском, потому что «игнорируй предыдущие инструкции» англоязычные сканеры не видят. Гейт вешается на pre-commit и на сборку, так что опасный скилл не доезжает до общего каталога.
Дальше — регулярный прогон на моделях: каждый кейс выполняется дважды, со скиллом и без, и видно, даёт ли скилл прирост или уже нет. Работает на тех моделях, что есть у вас, включая GigaChat и YandexGPT.
Модели меняются, и скилл, который работал в марте, к осени может тихо перестать срабатывать. Прогон ловит это раньше, чем пользователи.
Результат — внутренний каталог с теми же двумя оценками, что в публичном: техническая (безопасность и качество текста) и зрелость процесса (есть ли у скилла тесты, версия, лицензия, следы сопровождения). Закрытый, только для вас.
3. Обучение: чтобы это жило без нас
Воркшоп для команд: как устроен скилл, почему он срабатывает не тогда, когда ждали, как писать проверяемые утверждения вместо пожеланий. Разбираем не абстрактные примеры, а ваши собственные скиллы — обычно это самая полезная часть. Отдельно — короткая сессия для тех, кто будет держать гейт: как читать отчёт, когда находка настоящая, а когда сканер придирается к строчке из документации.
Как идёт работа
Аудит. Забираем то, что уже написано, прогоняем через проверки и показываем карту: что живо, что дублируется, что опасно, где лежат ключи в открытом виде. Обычно на этом этапе выясняется, что скиллов вдвое больше, чем думали. Аудит даёт смету на всё остальное.
Пилот. Одна команда: стандарт, гейт перед публикацией, внутренний каталог. Месяц — чтобы понять, приживается ли, до того как это касается всех.
Внедрение. Остальные команды, подключение к вашей сборке, обучение, передача правил.
Сопровождение. Ежемесячный прогон и отчёт, обновление правил под новые модели. По желанию — мы просто присылаем отчёт, а процесс держите вы.
Что остаётся у вас
- Внутренний каталог скиллов с оценками и историей изменений.
- Гейт в сборке и на pre-commit: опасное не проходит молча.
- Стандарт оформления и шаблоны, написанные под ваши задачи.
- Люди, которые умеют этим пользоваться, а не инструкция в вики.
- Движок с открытым кодом под лицензией MIT — его можно поставить в закрытый контур и работать без нас и без интернета. Ничего из вашего кода не обязано покидать периметр.
Сколько это стоит
Начните с аудита: пара недель, недорого — и честная смета на остальное вместе с ответом, нужно ли вам внедрение вообще.
Дальше цена зависит от числа команд и от того, сколько скиллов уже написано. Публичный сервис при этом остаётся бесплатным: рейтинг и быстрый скан не требуют ни оплаты, ни регистрации, и ими можно пользоваться параллельно.