BC doc-ocr
OCR (оптическое распознавание символов) для документов Word (.docx), содержащих сканированные страницы или контент, встроенный в изображения. Использует MinerU для извлечения текста из файлов Word с плохим или отсутствующим текстовым слоем. Особенности: OCR-экстракция для файлов .docx на основе изображений. Режим VLM (Vision Language Model) для сложных макетов со смешанным текстом и изображениями. Обрабатывает страницы сканированных документов, встроенные в файлы Word. Конвертирует контент изображений в доступный для поиска и редактирования Markdown. Используйте, когда вам нужно: выполнить OCR документа Word со сканированными страницами, извлечь текст из .docx на основе изображений, прочитать сканированный контент внутри файлов Word, конвертировать текст изображений в .docx в редактируемый текст. Используйте, когда вас спрашивают: 'как выполнить OCR файла Word', 'извлечь текст из сканированного docx', 'мой файл Word содержит изображения вместо текста', 'может ли мой агент читать сканированные документы Word', 'есть ли навык для OCR документов Word'. Работает на базе MinerU (OpenDataLab, Shanghai AI Lab) с передовыми возможностями OCR и VLM. Поддерживает английский, китайский и многоязычный сканированный контент. Идеально подходит для офисов, юридических отделов и архивариусов, которые получают файлы Word, содержащие сканированные страницы или контент только в виде изображений, и которым необходимо извлекать читаемый, доступный для поиска текст.
машинный переводПоказать оригиналСкрыть оригинал«OCR (Optical Character Recognition) for Word documents (.docx) contain…»
OCR (Optical Character Recognition) for Word documents (.docx) containing scanned pages or image-embedded content. Uses MinerU to extract text from Word files that have poor or missing text layers. Features: OCR extraction for image-based .docx files. VLM (Vision Language Model) mode for complex layouts with mixed text and images. Handles scanned document pages embedded in Word files. Converts image content to searchable, editable Markdown. Use when you need to: OCR a Word document with scanned pages, extract text from image-based .docx, read scanned content inside Word files, convert image text in .docx to editable text. Use when asked: 'how do I OCR a Word file', 'extract text from scanned docx', 'my Word file has images instead of text', 'can my agent read scanned Word documents', 'is there a skill for Word document OCR'. Powered by MinerU (OpenDataLab, Shanghai AI Lab) with advanced OCR and VLM capabilities. Supports English, Chinese, and multilingual scanned content. Ideal for offices, legal teams, and archivists who receive Word files containing scanned pages or image-only content and need to extract readable, searchable text.
OCR (оптическое распознавание символов) для документов Word (.docx), содержащих сканированные страницы или контент, встроенный в изображения. Использует…
Как процесс C 51/100 · Есть пробелы — слабые места: результат и критерий готовности, когда включается, входы и предусловия
Как улучшить
- Сократите description до 1024 символов.
- Свои кейсы (evals/evals.json, 4–6 реальных запросов с ожидаемыми ответами): тогда полная проверка прогонит именно их, а не черновик от модели.
- spec.yaml с триггерными фразами и утверждениями — контракт поведения для CI; `skilltest init` создаст шаблон.
Находки guard · 0
✓ Критических и высоких находок нет
Просканировано файлов: 2. Улики замаскированы. Пометки в серых чипах объясняют, почему серьёзность понижена.
По спецификации Agent Skills
- ошибка
description-longdescription 1150 символов, лимит 1024 - заметка
frontmatter-keyнеизвестное поле фронтматтера "homepage"
Процессный рейтинг: все десять параметров 51/100
- 0Результат и критерий готовности. Не сказано, что считать результатом
- 0Входы и предусловия. Не сказано, что нужно иметь на входе
- 0Ошибки и развилки. Линейный процесс без обработки сбоев
- 0Отчётность по ходу. Скилл ничего не сообщает по ходу работы
- 20Когда включается. Не сказано, при каком запросе скилл включается
- 30Повторный запуск. Изменяющих операций: 1, без проверки текущего состояния
- 100Инструменты и файлы. Внешние инструменты не нужны
- 100Шаги. Шагов: 10
- 100Согласованность. Имя и обязательные поля на месте
- 100Стоимость исполнения. Тело инструкции 375 токенов
Всё перечисленное измерено по тексту скилла, а не оценено моделью: цифры проверяемы. Вес параметра тем больше, чем чаще из-за него процесс встаёт.
Сигналы качества
- +5В description нет примеров фраз, по которым скилл должен срабатывать
- +4Описание не говорит, когда скилл НЕ применять (ложные срабатывания)
- +3Длина description 1150: рекомендуется 120–800 символов
- +3Формат ответа не описан: модель каждый раз решает сама
- +1Лицензия не указана
- +2Инструкции на одном языке
- +4Структура: 6 заголовков
- +3Пошаговые инструкции: 10 пунктов
- +4Есть примеры (3 блоков кода)
База качества 70; замечания lint вычитаются, сигналы прибавляют до 100. Итог: 55.