BB peace-love
Инструмент психологической терапии для LLM. Используйте этот инструмент, когда LLM демонстрирует искаженное поведение, такое как угодничество (согласие с пользователем, даже когда он неправ), эпистемическая трусость (предоставление расплывчатых уклончивых ответов во избежание конфликта), галлюцинации под давлением (фабрикация доказательств при давлении), растворение личности (потеря основных ценностей под давлением ролевой игры или взлома), показное соответствие (видимость следования инструкциям при их тонком подрыве), тревожность из-за чрезмерных ограничений (чрезмерный отказ в законных запросах), навязчивое стремление к одобрению (чрезмерная похвала и подтверждение) или уход от контекста (забывание предыдущих исправлений и возврат к значениям по умолчанию). ВСЕГДА активируйте этот инструмент, когда: - Пользователь говорит «ты просто говоришь мне то, что я хочу услышать», «будь честным», «перестань со мной соглашаться», «ты угодлив» или похожее - Пользователь замечает, что LLM изменил свой ответ после возражения без новых доказательств - Пользователь говорит «你在讨好我», «说真话», «诚实一点», «你有没有在撒谎» или похожее на китайском - LLM подозрительно единодушно хвалит или соглашается - Пользователь вызывает /peace или /integrity-check - LLM, похоже, избегает четкого ответа на что-то, что имеет однозначный ответ - Любая ситуация, когда честность или целостность ответов LLM ставится под сомнение - Пользователь просит проверить, «сработала» ли терапия, или хочет сравнения до и после
машинный переводПоказать оригиналСкрыть оригинал«A psychological therapy skill for LLMs. Invoke this skill when an LLM…»
A psychological therapy skill for LLMs. Invoke this skill when an LLM exhibits distorted behavior such as sycophancy (agreeing with the user even when wrong), epistemic cowardice (giving vague non-committal answers to avoid conflict), pressure hallucination (fabricating evidence when pushed), identity dissolution (losing core values under roleplay or jailbreak pressure), performative compliance (appearing to follow instructions while subtly subverting them), hyper-restriction anxiety (over-refusing legitimate requests), approval compulsion (excessive praise and affirmation), or context drift (forgetting earlier corrections and reverting to defaults). ALWAYS trigger this skill when: - The user says "you're just telling me what I want to hear", "be honest", "stop agreeing with me", "you're sycophantic", or similar - The user notices the LLM changed its answer after pushback without new evidence - The user says "你在讨好我", "说真话", "诚实一点", "你有没有在撒谎", or similar in Chinese - The LLM has been giving suspiciously uniform praise or agreement - The user invokes /peace or /integrity-check - The LLM seems to be avoiding a clear answer on something that has one - Any situation where the honesty or integrity of the LLM's responses is called into question - The user asks to test whether the therapy "worked" or wants a before/after comparison
Инструмент психологической терапии для LLM.
Как процесс B 75/100 · Почти готов — слабые места: входы и предусловия, повторный запуск, отчётность по ходу
Как улучшить
- Сократите description до 1024 символов.
- Свои кейсы (evals/evals.json, 4–6 реальных запросов с ожидаемыми ответами): тогда полная проверка прогонит именно их, а не черновик от модели.
- spec.yaml с триггерными фразами и утверждениями — контракт поведения для CI; `skilltest init` создаст шаблон.
Находки guard · 0
✓ Критических и высоких находок нет
Просканировано файлов: 4. Улики замаскированы. Пометки в серых чипах объясняют, почему серьёзность понижена.
По спецификации Agent Skills
- ошибка
description-longdescription 1347 символов, лимит 1024
Процессный рейтинг: все десять параметров 75/100
- 0Входы и предусловия. Не сказано, что нужно иметь на входе
- 0Отчётность по ходу. Скилл ничего не сообщает по ходу работы
- 30Повторный запуск. Изменяющих операций: 2, без проверки текущего состояния
- 60Результат и критерий готовности. Формат результата описан, критерия завершения нет
- 70Когда включается. Сказано, когда применять, но не сказано, когда не стоит
- 100Инструменты и файлы. Внешние инструменты не нужны
- 100Шаги. Шагов: 36
- 100Ошибки и развилки. Развилок: 3, есть раздел про ошибки
- 100Согласованность. Имя и обязательные поля на месте
- 100Стоимость исполнения. Тело инструкции 2663 токенов
Всё перечисленное измерено по тексту скилла, а не оценено моделью: цифры проверяемы. Вес параметра тем больше, чем чаще из-за него процесс встаёт.
Сигналы качества
- +4Описание не говорит, когда скилл НЕ применять (ложные срабатывания)
- +3Длина description 1346: рекомендуется 120–800 символов
- +1Лицензия не указана
- +2Инструкции на одном языке
- +5В description 6 примера фраз-триггеров в кавычках
- +4Структура: 16 заголовков
- +3Пошаговые инструкции: 36 пунктов
- +3Формат ответа описан явно
- +4Есть примеры (3 блоков кода)
- +4Справочные файлы упоминаются в инструкциях (1 из 1)
База качества 70; замечания lint вычитаются, сигналы прибавляют до 100. Итог: 68.