Обучение TRL
Train and fine-tune transformer language models using TRL (Transformers Reinforcement Learning). Supports SFT, DPO, GRPO, KTO, RLOO and Reward Model training via CLI commands.
AIhuggingface
official
Другое
Что делает навык
Обучение и дообучение (fine-tuning) языковых моделей-трансформеров с помощью TRL (Transformers Reinforcement Learning). Поддерживает обучение SFT, DPO, GRPO, KTO, RLOO и Reward Model через CLI-команды.
Как подключить
1Скачать навык
# возьмите папку навыка «trl-training» из репозитория:
# https://github.com/huggingface/skills
2Положить папку с
SKILL.md к навыкам ассистента# положите папку навыка туда, где ассистент ищет skills:
cp -r trl-training/ ~/.claude/skills/trl-training/
Навык — папка с файлом SKILL.md (описание + инструкции) и опциональными скриптами. Ассистент (Claude, Claude Code и совместимые) подхватывает его по описанию и следует шагам.