BC survey-design
Разрабатывает инструменты для опросов. Охватывает формулировки конкретных пунктов, избегающие одобрения, двойных вопросов и наводящих формулировок, построение шкал, включая пункты, метки, полярность, термометры ощущений, альфу Кронбаха и омегу Макдональда, поток и порядок, размещение tratamento, буферные пункты, когнитивные интервью, мягкие запуски, нагрузку, контрольные вопросы внимания, правила ускорения, конфиденциальные вопросы, смещение социальной желательности и ворота понимания. Используйте, когда пользователь пишет или пересматривает вопросы опроса, выбирает шкалу, упорядочивает блоки, планирует пилотное исследование или беспокоится, что респонденты не ответят честно. Косвенные измерения относятся к list-experiment, многострановые инструменты — к cross-national-design, а операционная деятельность по проведению опросов в реальном времени — к qualtrics-ops.
машинный переводПоказать оригиналСкрыть оригинал«Designs survey instruments. Covers item-specific wording that avoids a…»
Designs survey instruments. Covers item-specific wording that avoids acquiescence, double-barreling, and leading language, scale construction including points, labels, polarity, feeling thermometers, Cronbach’s alpha, and McDonald’s omega, flow and ordering, treatment placement, buffer items, cognitive interviews, soft launches, burden, attention checks, speeding rules, sensitive questions, social-desirability bias, and comprehension gates. Use when the user writes or revises survey questions, chooses a scale, orders blocks, plans a pilot, or worries respondents will not answer honestly. Indirect measurement goes to list-experiment, multi-country instruments to cross-national-design, and live-survey operations to qualtrics-ops.
Разрабатывает инструменты для опросов.
Как процесс C 58/100 · Есть пробелы — слабые места: результат и критерий готовности, входы и предусловия, повторный запуск
Как улучшить
- Свои кейсы (evals/evals.json, 4–6 реальных запросов с ожидаемыми ответами): тогда полная проверка прогонит именно их, а не черновик от модели.
- spec.yaml с триггерными фразами и утверждениями — контракт поведения для CI; `skilltest init` создаст шаблон.
Находки guard · 0
✓ Критических и высоких находок нет
Просканировано файлов: 1. Улики замаскированы. Пометки в серых чипах объясняют, почему серьёзность понижена.
По спецификации Agent Skills
✓ По спецификации Agent Skills замечаний нет
Процессный рейтинг: все десять параметров 58/100
- 0Результат и критерий готовности. Не сказано, что считать результатом
- 0Входы и предусловия. Не сказано, что нужно иметь на входе
- 0Отчётность по ходу. Скилл ничего не сообщает по ходу работы
- 30Повторный запуск. Изменяющих операций: 4, без проверки текущего состояния
- 55Ошибки и развилки. Развилок: 1
- 70Когда включается. Сказано, когда применять, но не сказано, когда не стоит
- 70Стоимость исполнения. Тело инструкции 4345 токенов
- 85Шаги. Шагов: 52, расплывчатых формулировок: 1
- 100Инструменты и файлы. Внешние инструменты не нужны
- 100Согласованность. Имя и обязательные поля на месте
Всё перечисленное измерено по тексту скилла, а не оценено моделью: цифры проверяемы. Вес параметра тем больше, чем чаще из-за него процесс встаёт.
Сигналы качества
- +5В description нет примеров фраз, по которым скилл должен срабатывать
- +4Описание не говорит, когда скилл НЕ применять (ложные срабатывания)
- +3Формат ответа не описан: модель каждый раз решает сама
- +4Нет примеров входа/выхода
- +1Лицензия не указана
- +2Инструкции на одном языке
- +3Длина description 737 символов: достаточно сигнала, не съедает бюджет
- +4Структура: 10 заголовков
- +3Пошаговые инструкции: 52 пунктов
База качества 70; замечания lint вычитаются, сигналы прибавляют до 100. Итог: 80.