Jetson: настройка памяти для инференса
Pick the serving stack and per-runtime memory flags (vLLM, SGLang, llama.cpp, TensorRT Edge-LLM) for an LLM/VLM workload on any NVIDIA Jetson.
AInvidia
official
Данные
Что делает навык
Выбор стека обслуживания (serving) и флагов памяти для каждого рантайма (vLLM, SGLang, llama.cpp, TensorRT Edge-LLM) для рабочей нагрузки LLM/VLM на любом NVIDIA Jetson.
Как подключить
1Скачать навык
# возьмите папку навыка «jetson-inference-mem-tune» из репозитория:
# https://github.com/nvidia/skills
2Положить папку с
SKILL.md к навыкам ассистента# положите папку навыка туда, где ассистент ищет skills:
cp -r jetson-inference-mem-tune/ ~/.claude/skills/jetson-inference-mem-tune/
Навык — папка с файлом SKILL.md (описание + инструкции) и опциональными скриптами. Ассистент (Claude, Claude Code и совместимые) подхватывает его по описанию и следует шагам.