Jetson: спекулятивное декодирование
Add EAGLE-3 or draft-model speculative decoding to a Jetson vLLM server when TPOT is the bottleneck.
AInvidia
official
Другое
Что делает навык
Добавляет спекулятивное декодирование EAGLE-3 или draft-model на сервер Jetson vLLM, когда узким местом является TPOT.
Как подключить
1Скачать навык
# возьмите папку навыка «jetson-speculative-decoding» из репозитория:
# https://github.com/nvidia/skills
2Положить папку с
SKILL.md к навыкам ассистента# положите папку навыка туда, где ассистент ищет skills:
cp -r jetson-speculative-decoding/ ~/.claude/skills/jetson-speculative-decoding/
Навык — папка с файлом SKILL.md (описание + инструкции) и опциональными скриптами. Ассистент (Claude, Claude Code и совместимые) подхватывает его по описанию и следует шагам.