AIKraft/Skills/Обучение TRL

Обучение TRL

Train and fine-tune transformer language models using TRL (Transformers Reinforcement Learning). Supports SFT, DPO, GRPO, KTO, RLOO and Reward Model training via CLI commands.

huggingface official Другое

Что делает навык

Обучение и дообучение (fine-tuning) языковых моделей-трансформеров с помощью TRL (Transformers Reinforcement Learning). Поддерживает обучение SFT, DPO, GRPO, KTO, RLOO и Reward Model через CLI-команды.

Как подключить

1Скачать навык
# возьмите папку навыка «trl-training» из репозитория: # https://github.com/huggingface/skills
2Положить папку с SKILL.md к навыкам ассистента
# положите папку навыка туда, где ассистент ищет skills: cp -r trl-training/ ~/.claude/skills/trl-training/

Навык — папка с файлом SKILL.md (описание + инструкции) и опциональными скриптами. Ассистент (Claude, Claude Code и совместимые) подхватывает его по описанию и следует шагам.