AIKraft/Skills/Инференс GKE

Инференс GKE

Deploys and optimizes AI/ML inference workloads on GKE, using GPUs, TPUs, and model servers. Use when deploying GKE inference servers, configuring GKE GPU resources for inference, or deploying LLMs on GKE. Don't use for generic batch jobs or HPC task queues (use gke-batch-hpc instead).

google official Разработка

Что делает навык

Развёртывает и оптимизирует рабочие нагрузки инференса AI/ML на GKE с использованием GPU, TPU и серверов моделей. Используйте при развёртывании серверов инференса GKE, настройке ресурсов GPU GKE для инференса или развёртывании LLM на GKE. Не используйте для обычных batch-задач или очередей задач HPC (используйте вместо этого gke-batch-hpc).

Как подключить

1Скачать навык
# возьмите папку навыка «gke-inference» из репозитория: # https://github.com/google/skills
2Положить папку с SKILL.md к навыкам ассистента
# положите папку навыка туда, где ассистент ищет skills: cp -r gke-inference/ ~/.claude/skills/gke-inference/

Навык — папка с файлом SKILL.md (описание + инструкции) и опциональными скриптами. Ассистент (Claude, Claude Code и совместимые) подхватывает его по описанию и следует шагам.