AIKraft/Skills/Jetson: настройка памяти для инференса

Jetson: настройка памяти для инференса

Pick the serving stack and per-runtime memory flags (vLLM, SGLang, llama.cpp, TensorRT Edge-LLM) for an LLM/VLM workload on any NVIDIA Jetson.

nvidia official Данные

Что делает навык

Выбор стека обслуживания (serving) и флагов памяти для каждого рантайма (vLLM, SGLang, llama.cpp, TensorRT Edge-LLM) для рабочей нагрузки LLM/VLM на любом NVIDIA Jetson.

Как подключить

1Скачать навык
# возьмите папку навыка «jetson-inference-mem-tune» из репозитория: # https://github.com/nvidia/skills
2Положить папку с SKILL.md к навыкам ассистента
# положите папку навыка туда, где ассистент ищет skills: cp -r jetson-inference-mem-tune/ ~/.claude/skills/jetson-inference-mem-tune/

Навык — папка с файлом SKILL.md (описание + инструкции) и опциональными скриптами. Ассистент (Claude, Claude Code и совместимые) подхватывает его по описанию и следует шагам.