TAO генерация referring expressions
Four-step image referring-expression pipeline: turns images plus KITTI bounding-box labels into region descriptions, scene captions, grounded referring expressions, and (optionally) verified expressions via VLM distillation. Use when the user wants to generate referring-expression annotations from images with KITTI labels, build region descriptions, produce grouped grounding phrases tied to bboxes
Что делает навык
Четырехэтапный конвейер referring-выражений для изображений: превращает изображения и bounding box метки в формате KITTI в описания регионов, подписи к сценам, привязанные referring-выражения и (опционально) верифицированные выражения через дистилляцию VLM. Используйте, когда пользователь хочет сгенерировать аннотации referring-выражений из изображений с метками KITTI, построить описания регионов, получить сгруппированные фразы grounding, привязанные к bbox
Как подключить
SKILL.md к навыкам ассистентаНавык — папка с файлом SKILL.md (описание + инструкции) и опциональными скриптами. Ассистент (Claude, Claude Code и совместимые) подхватывает его по описанию и следует шагам.