SKILLEMALL.ai

AF gipformer

Преобразование вьетнамской речи в текст с использованием Gipformer ASR (65 млн параметров, Zipformer-RNNT). Принимает аудио любой длины — сервер обрабатывает разделение на части VAD, пакетирование и возвращает транскрипцию. Поддерживает WAV, FLAC, OGG, MP3, M4A. Активируется, когда пользователь предоставляет аудиофайл (WAV, MP3, M4A, FLAC, OGG) или просит транскрибировать/распознать вьетнамскую речь, например: «транскрибируй это аудио», «nhận dạng giọng nói», «chuyển audio thành text».

машинный переводПоказать оригиналСкрыть оригинал«Vietnamese speech-to-text using Gipformer ASR (65M params, Zipformer-R…»

Vietnamese speech-to-text using Gipformer ASR (65M params, Zipformer-RNNT). Accepts audio of any length — the server handles VAD chunking, batching, and returns the transcript. Supports WAV, FLAC, OGG, MP3, M4A. Activated when the user provides an audio file (WAV, MP3, M4A, FLAC, OGG) or asks to transcribe/recognize Vietnamese speech, e.g. "transcribe this audio", "nhận dạng giọng nói", "chuyển audio thành text".

ClawHub Agent Skills автор: AI-GGroup v1.0.0 MIT-0 7 файлов тело ≈ 683 токенов Открыть источникclawhub.ai проанализирован 3 дн назад

Преобразование вьетнамской речи в текст с использованием Gipformer ASR (65 млн параметров, Zipformer-RNNT).

Как процесс F 34/100 · Не запустится — слабые места: шаги, результат и критерий готовности, входы и предусловия

ПроцедураИнфраструктуратип и темы размечены автоматически по тексту скилла
JSON
Технический рейтинг
A
94/100
безопасность, качество, тесты
Безопасность 60%
100
Качество 40%
85
Прогон на моделях
не было
Процессный рейтинг
F
34/100
Не запустится
Шаги вес 15
0
Результат и критерий готовности вес 14
0
Входы и предусловия вес 11
0
три самых слабых из десяти параметров · все десять

Как улучшить

    Для прогона на моделях — необязательно
    • Свои кейсы (evals/evals.json, 4–6 реальных запросов с ожидаемыми ответами): тогда полная проверка прогонит именно их, а не черновик от модели.
    • spec.yaml с триггерными фразами и утверждениями — контракт поведения для CI; `skilltest init` создаст шаблон.

    Находки guard · 0

    ✓ Критических и высоких находок нет

    Просканировано файлов: 7. Улики замаскированы. Пометки в серых чипах объясняют, почему серьёзность понижена.

    По спецификации Agent Skills

    ✓ По спецификации Agent Skills замечаний нет

    Процессный рейтинг: все десять параметров 34/100

    • 0Шаги. Инструкция сплошным текстом, шаги не выделены
    • 0Результат и критерий готовности. Не сказано, что считать результатом
    • 0Входы и предусловия. Не сказано, что нужно иметь на входе
    • 0Ошибки и развилки. Линейный процесс без обработки сбоев
    • 0Отчётность по ходу. Скилл ничего не сообщает по ходу работы
    • 30Повторный запуск. Изменяющих операций: 2, без проверки текущего состояния
    • 60Инструменты и файлы. Используются инструменты (web), но во frontmatter они не объявлены
    • 70Когда включается. Сказано, когда применять, но не сказано, когда не стоит
    • 100Согласованность. Имя и обязательные поля на месте
    • 100Стоимость исполнения. Тело инструкции 683 токенов

    Всё перечисленное измерено по тексту скилла, а не оценено моделью: цифры проверяемы. Вес параметра тем больше, чем чаще из-за него процесс встаёт.

    Сигналы качества

    • +4Описание не говорит, когда скилл НЕ применять (ложные срабатывания)
    • +3Нет пошаговых инструкций или чек-листа
    • +3Формат ответа не описан: модель каждый раз решает сама
    • -2Ссылки на localhost: у другого пользователя не заработает
    • -31 из 3 скриптов не упомянуты в SKILL.md
    • +1Лицензия не указана
    • +2Инструкции на одном языке
    • +5В description 3 примера фраз-триггеров в кавычках
    • +3Длина description 416 символов: достаточно сигнала, не съедает бюджет
    • +4Структура: 10 заголовков
    • +4Есть примеры (5 блоков кода)
    • +4Справочные файлы упоминаются в инструкциях (1 из 1)

    База качества 70; замечания lint вычитаются, сигналы прибавляют до 100. Итог: 85.

    Внешние проверки

    ClawHub: clean
    This is a local Vietnamese speech-to-text skill whose sensitive audio handling is expected for its purpose, with privacy precautions needed when choosing where to run the server.
    LLM: benign (high) · VirusTotal: · 29 мая 2026 г.