AIKraft/Skills/Оценка агента

Оценка агента

Use this when you need to EVALUATE OR IMPROVE or OPTIMIZE an existing LLM agent's output quality - including improving tool selection accuracy, answer quality, reducing costs, or fixing issues where the agent gives wrong/incomplete responses. Evaluates agents systematically using MLflow evaluation with datasets, scorers, and tracing. IMPORTANT - Always also load the instrumenting-with-mlflow-traci

mlflow official Данные

Что делает навык

Используйте это, когда нужно ОЦЕНИТЬ, УЛУЧШИТЬ или ОПТИМИЗИРОВАТЬ качество вывода существующего LLM-агента — включая повышение точности выбора инструментов, качества ответов, снижение затрат или исправление проблем, когда агент даёт неверные/неполные ответы. Систематически оценивает агентов с помощью MLflow evaluation с наборами данных, скорерами и трассировкой. ВАЖНО — всегда также загружайте instrumenting-with-mlflow-traci

Как подключить

1Скачать навык
# возьмите папку навыка «agent-evaluation» из репозитория: # https://github.com/mlflow/skills
2Положить папку с SKILL.md к навыкам ассистента
# положите папку навыка туда, где ассистент ищет skills: cp -r agent-evaluation/ ~/.claude/skills/agent-evaluation/

Навык — папка с файлом SKILL.md (описание + инструкции) и опциональными скриптами. Ассистент (Claude, Claude Code и совместимые) подхватывает его по описанию и следует шагам.