BD tencentcloud-ocr-multimodaldocparse
Пакет навыков Tencent Cloud MultimodalDocParse (версия для документов). Когда пользователь предоставляет URL-адрес документа, следует автоматически вызвать интерфейс MultimodalDocParse для извлечения информации о содержимом документа. Поддерживает разбор документов в различных форматах, таких как PDF, Word, PPT, Excel, Markdown, TXT, изображения, WPS и т. д.; можно настроить диапазон страниц, разбор под-изображений, тип задачи, выходной формат и другие необязательные параметры; интерфейс возвращает адрес загрузки пакета результатов в формате ZIP, который содержит структурированные результаты разбора (*.md / *.xml / *_ocr_page{N}.json) и извлеченные изображения из документа (images/). Фактическая структура и описание полей пакета результатов см. в references/result-package-structure.md.
машинный переводПоказать оригиналСкрыть оригинал«腾讯云多模态解析(文档版)(MultimodalDocParse) 技能包。当用户提供文档 URL 地址时,应自动调用多模态解析(文档版)接…»
腾讯云多模态解析(文档版)(MultimodalDocParse) 技能包。当用户提供文档 URL 地址时,应自动调用多模态解析(文档版)接口提取文档内容信息。支持 PDF、Word、PPT、Excel、Markdown、TXT、图片、WPS 等多格式文档解析;可配置页码范围、子图解析、任务类型、输出格式等可选参数;接口返回 ZIP 格式结果包下载地址,包内含结构化解析结果(*.md / *.xml / *_ocr_page{N}.json)及文档内提取的图片素材(images/)。结果包的真实结构与字段说明详见 references/result-package-structure.md。
Пакет навыков Tencent Cloud MultimodalDocParse (версия для документов).
Как процесс D 41/100 · Процесс не доведён — слабые места: результат и критерий готовности, когда включается, входы и предусловия
Чем это грозит
Находки средней серьёзности: скорее всего скилл честный, но прочитайте, что именно насторожило сканер.
Ниже описан худший случай для этой категории. Здесь находка средней серьёзности: guard увидел признак, но не доказательство.
Скилл содержит команды, которые удаляют файлы, переписывают диски или исполняют код, скачанный из сети. Агент может выполнить их без вопроса, если считает, что так требует инструкция.
Замените разрушительные команды на безопасные аналоги с подтверждением, ограничьте область действия конкретной папкой и не тяните код через curl | bash: укажите версию и контрольную сумму.
Как улучшить
- Скажите в description, КОГДА применять скилл («используй, когда…», примеры запросов): это главный сигнал для агента.
- Свои кейсы (evals/evals.json, 4–6 реальных запросов с ожидаемыми ответами): тогда полная проверка прогонит именно их, а не черновик от модели.
- spec.yaml с триггерными фразами и утверждениями — контракт поведения для CI; `skilltest init` создаст шаблон.
Находки guard · 2
✓ Критических и высоких находок нет
Средние и низкие: 2
-
средняя Опасные команды
cmd-shell-rcSKILL.md:238Запись в файл автозагрузки shell (.bashrc / .zshrc / .profile)echo 'export TENCENTCLOUD_SECRET_ID="你的SecretId"' >> ~/.bashrc
-
средняя Опасные команды
cmd-shell-rcSKILL.md:239Запись в файл автозагрузки shell (.bashrc / .zshrc / .profile)echo 'export TENCENTCLOUD_SECRET_KEY="你的SecretKey"' >> ~/.bashrc
Просканировано файлов: 4. Улики замаскированы. Пометки в серых чипах объясняют, почему серьёзность понижена.
По спецификации Agent Skills
- предупреждение
description-no-whendescription не говорит, КОГДА применять скилл (нет "use when / используй когда")
Процессный рейтинг: все десять параметров 41/100
- 0Результат и критерий готовности. Не сказано, что считать результатом
- 0Входы и предусловия. Не сказано, что нужно иметь на входе
- 0Ошибки и развилки. Линейный процесс без обработки сбоев
- 0Отчётность по ходу. Скилл ничего не сообщает по ходу работы
- 20Когда включается. Не сказано, при каком запросе скилл включается
- 40Согласованность. Имя во frontmatter (tencentcloud-ocr-multimodaldocparse) не совпадает с папкой (tencentcloud-multimodaldocparse-ocr)
- 60Инструменты и файлы. Используются инструменты (bash, python), но во frontmatter они не объявлены
- 100Шаги. Шагов: 40
- 100Стоимость исполнения. Тело инструкции 2068 токенов
- 100Повторный запуск. Изменяющих операций нет
Всё перечисленное измерено по тексту скилла, а не оценено моделью: цифры проверяемы. Вес параметра тем больше, чем чаще из-за него процесс встаёт.
Сигналы качества
- +5В description нет примеров фраз, по которым скилл должен срабатывать
- +4Описание не говорит, когда скилл НЕ применять (ложные срабатывания)
- +3Формат ответа не описан: модель каждый раз решает сама
- -214 эмодзи в инструкциях: шум для модели
- +1Лицензия не указана
- +2Инструкции на одном языке
- +3Длина description 299 символов: достаточно сигнала, не съедает бюджет
- +4Структура: 21 заголовков
- +3Пошаговые инструкции: 40 пунктов
- +4Есть примеры (8 блоков кода)
- +4Справочные файлы упоминаются в инструкциях (1 из 1)
- +3Все 1 скриптов описаны в инструкциях
База качества 70; замечания lint вычитаются, сигналы прибавляют до 100. Итог: 77.