AC smart-model-switching-glm
Автоматически направляйте задачи к самой дешевой модели z.ai (GLM), которая работает корректно. Трехуровневая прогрессия: Flash → Standard → Plus/32B. Классифицируйте перед ответом. FLASH (по умолчанию): фактические вопросы и ответы, приветствия, напоминания, проверки статуса, поиск, простые операции с файлами, проверки работоспособности, непринужденная беседа, задачи на 1-2 предложения, cron-задания. ПЕРЕХОД НА STANDARD: код >10 строк, анализ, сравнения, планирование, отчеты, многошаговое рассуждение, таблицы, длинные тексты >3 абзацев, обобщение, синтез исследований, большинство пользовательских разговоров. ПЕРЕХОД НА PLUS/32B: решения по архитектуре, сложная отладка, рефакторинг нескольких файлов, стратегическое планирование, тонкие суждения, глубокие исследования, критические производственные решения. Правило: Если человеку требуется >30 секунд сосредоточенного обдумывания, переходите на более высокий уровень. Если Standard испытывает трудности со сложностью, переходите на Plus/32B. Экономьте на основных расходах по API, начиная с дешевых и переходя на более дорогие только при необходимости.
машинный переводПоказать оригиналСкрыть оригинал«Auto-route tasks to the cheapest z.ai (GLM) model that works correctly…»
Auto-route tasks to the cheapest z.ai (GLM) model that works correctly. Three-tier progression: Flash → Standard → Plus/32B. Classify before responding. FLASH (default): factual Q&A, greetings, reminders, status checks, lookups, simple file ops, heartbeats, casual chat, 1–2 sentence tasks, cron jobs. ESCALATE TO STANDARD: code >10 lines, analysis, comparisons, planning, reports, multi-step reasoning, tables, long writing >3 paragraphs, summarization, research synthesis, most user conversations. ESCALATE TO PLUS/32B: architecture decisions, complex debugging, multi-file refactoring, strategic planning, nuanced judgment, deep research, critical production decisions. Rule: If a human needs >30 seconds of focused thinking, escalate. If Standard struggles with complexity, go to Plus/32B. Save major API costs by starting cheap and escalating only when needed.
Автоматически направляйте задачи к самой дешевой модели z.ai (GLM), которая работает корректно. Трехуровневая прогрессия: Flash → Standard → Plus/32B.…
Как процесс C 52/100 · Есть пробелы — слабые места: результат и критерий готовности, когда включается, входы и предусловия
Как улучшить
- Свои кейсы (evals/evals.json, 4–6 реальных запросов с ожидаемыми ответами): тогда полная проверка прогонит именно их, а не черновик от модели.
- spec.yaml с триггерными фразами и утверждениями — контракт поведения для CI; `skilltest init` создаст шаблон.
Находки guard · 0
✓ Критических и высоких находок нет
Просканировано файлов: 2. Улики замаскированы. Пометки в серых чипах объясняют, почему серьёзность понижена.
По спецификации Agent Skills
- заметка
frontmatter-keyнеизвестное поле фронтматтера "homepage"
Процессный рейтинг: все десять параметров 52/100
- 0Результат и критерий готовности. Не сказано, что считать результатом
- 0Входы и предусловия. Не сказано, что нужно иметь на входе
- 0Отчётность по ходу. Скилл ничего не сообщает по ходу работы
- 20Когда включается. Не сказано, при каком запросе скилл включается
- 30Повторный запуск. Изменяющих операций: 1, без проверки текущего состояния
- 40Согласованность. Имя во frontmatter (smart-model-switching-glm) не совпадает с папкой (smart-model-routing-for-zai)
- 60Ошибки и развилки. Развилок: 2
- 100Инструменты и файлы. Внешние инструменты не нужны
- 100Шаги. Шагов: 37
- 100Стоимость исполнения. Тело инструкции 1256 токенов
Всё перечисленное измерено по тексту скилла, а не оценено моделью: цифры проверяемы. Вес параметра тем больше, чем чаще из-за него процесс встаёт.
Сигналы качества
- +5В description нет примеров фраз, по которым скилл должен срабатывать
- +4Описание не говорит, когда скилл НЕ применять (ложные срабатывания)
- +3Длина description 865: рекомендуется 120–800 символов
- +3Формат ответа не описан: модель каждый раз решает сама
- +4Нет примеров входа/выхода
- -216 эмодзи в инструкциях: шум для модели
- +1Лицензия не указана
- +2Инструкции на одном языке
- +4Структура: 15 заголовков
- +3Пошаговые инструкции: 37 пунктов
База качества 70; замечания lint вычитаются, сигналы прибавляют до 100. Итог: 74.