AC opentable
ОБЯЗАТЕЛЬНО используйте для любого запроса на бронирование через OpenTable / ресторан. Два способа использования — (A) поиск («найди мне 3 итальянских ресторана сегодня вечером»): вызовите `list_restaurants.py` для получения отфильтрованного списка; (B) прямое бронирование («забронируй Carbone на 8 вечера», «забронируй Park Rose на 2 человека»): вызовите `book.py` НАПРЯМУЮ без предварительного поиска. `book.py` — это чистое построение URL, проверка не требуется. ЗАПРЕЩАЕТСЯ запись /tmp/cdp_*.js, использование exec+node для автоматизации Chrome, web_fetch на opentable.com, прямое скриптование CDP или вызов list_restaurants.py для «проверки» перед book.py. Агент должен остановиться после создания глубокой ссылки на бронирование — никогда не переходите к оформлению заказа, не заполняйте формы, не отправляйте бронирования.
машинный переводПоказать оригиналСкрыть оригинал«MUST use for any OpenTable / restaurant reservation request. Two entry…»
MUST use for any OpenTable / restaurant reservation request. Two entry points — (A) discovery ("find me 3 italian places tonight"): call `list_restaurants.py` for a filtered list; (B) direct book ("reserve Carbone at 8pm", "book Park Rose for 2"): call `book.py` DIRECTLY without searching first. `book.py` is pure URL construction, no verification needed. FORBIDS writing /tmp/cdp_*.js, using exec+node for Chrome automation, web_fetch on opentable.com, raw CDP scripting, or calling list_restaurants.py to "verify" before book.py. Agent must STOP after producing the booking deep link — never click checkout, never fill forms, never submit reservations.
ОБЯЗАТЕЛЬНО используйте для любого запроса на бронирование через OpenTable / ресторан.
Как процесс C 63/100 · Есть пробелы — слабые места: результат и критерий готовности, входы и предусловия, согласованность
Как улучшить
- Свои кейсы (evals/evals.json, 4–6 реальных запросов с ожидаемыми ответами): тогда полная проверка прогонит именно их, а не черновик от модели.
- spec.yaml с триггерными фразами и утверждениями — контракт поведения для CI; `skilltest init` создаст шаблон.
Находки guard · 0
✓ Критических и высоких находок нет
Просканировано файлов: 8. Улики замаскированы. Пометки в серых чипах объясняют, почему серьёзность понижена.
По спецификации Agent Skills
- предупреждение
frontmatter-yamlSKILL.md: фронтматтер не разбирается как YAML (YAML parse error: Nested mappings are not allowed in compact mappings at line 2, column 14: description: MUST use for any OpenTable / restaurant reservation request. Two e… ^ ); поля прочитаны построчно. Обычная причина — двоеточие в незакавыченном значении - заметка
frontmatter-keyнеизвестное поле фронтматтера "homepage"
Процессный рейтинг: все десять параметров 63/100
- 0Результат и критерий готовности. Не сказано, что считать результатом
- 30Входы и предусловия. Не сказано, что нужно иметь на входе
- 40Согласованность. Имя во frontmatter (opentable) не совпадает с папкой (opentable-reservations)
- 60Инструменты и файлы. Используются инструменты (bash, web, python, node), но во frontmatter они не объявлены
- 70Когда включается. Сказано, когда применять, но не сказано, когда не стоит
- 100Шаги. Шагов: 29
- 100Ошибки и развилки. Развилок: 11, есть раздел про ошибки
- 100Стоимость исполнения. Тело инструкции 3475 токенов
- 100Повторный запуск. Изменяющие операции проверяют текущее состояние
- 100Отчётность по ходу. Скилл сообщает о ходе работы
- low Ответ описан самодельной разметкой (5 тегов): типизированный вызов надёжнее
Всё перечисленное измерено по тексту скилла, а не оценено моделью: цифры проверяемы. Вес параметра тем больше, чем чаще из-за него процесс встаёт.
Сигналы качества
- +4Описание не говорит, когда скилл НЕ применять (ложные срабатывания)
- +3Формат ответа не описан: модель каждый раз решает сама
- +1Лицензия не указана
- +2Инструкции на одном языке
- +5В description 4 примера фраз-триггеров в кавычках
- +3Длина description 655 символов: достаточно сигнала, не съедает бюджет
- +4Структура: 21 заголовков
- +3Пошаговые инструкции: 29 пунктов
- +4Есть примеры (11 блоков кода)
- +3Все 4 скриптов описаны в инструкциях
База качества 70; замечания lint вычитаются, сигналы прибавляют до 100. Итог: 81.