AIKraft/Skills/preference-optimization

preference-optimization

Выполните тонкую настройку модели с использованием предпочтительных данных с помощью DPO, ORPO, KTO или SimPO. Используйте, когда существуют пары предпочтений или обратная связь в виде лайков/дизлайков, при выборе между методами оптимизации на основе предпочтений или когда требуется настроить гиперпараметры или отладить запуск DPO.

wshobson official Данные

Что делает навык

Выполните тонкую настройку модели с использованием предпочтительных данных с помощью DPO, ORPO, KTO или SimPO. Используйте, когда существуют пары предпочтений или обратная связь в виде лайков/дизлайков, при выборе между методами оптимизации на основе предпочтений или когда требуется настроить гиперпараметры или отладить запуск DPO.

Как подключить

1Скачать навык
# возьмите папку навыка «preference-optimization» из репозитория: # https://github.com/wshobson/agents
2Положить папку с SKILL.md к навыкам ассистента
# положите папку навыка туда, где ассистент ищет skills: cp -r preference-optimization/ ~/.claude/skills/preference-optimization/

Навык — папка с файлом SKILL.md (описание + инструкции) и опциональными скриптами. Ассистент (Claude, Claude Code и совместимые) подхватывает его по описанию и следует шагам.

preference-optimization — навык для AI | AIKraft