← MCP·스킬 라이브러리
스킬데이터·분석
llm-evaluation
자동 수집 항목입니다. 설치 설정은 저장소 README에서 그대로 가져왔지만, 한국어 설명과 부서 분류는 아직 확인하지 않았습니다. 설치 전에 저장소를 한 번 확인하세요.
자동화된 지표, 사람의 피드백, 벤치마킹을 활용해 LLM 애플리케이션의 종합적인 평가 전략을 구현합니다. LLM 성능 테스트, AI 애플리케이션 품질 측정, 평가 프레임워크 구축 시 사용합니다.
제공 Seth Hobson라이선스 MIT갱신 2026년 9월 22일
설치하기
Claude Code에서 위 두 줄을 차례로 실행합니다. `llm-application-dev` 묶음에 이 스킬이 들어 있습니다. 설치한 뒤에는 이름을 언급하면 발동합니다 — 예: "llm-evaluation 스킬로 정리해줘". 원본: https://github.com/wshobson/agents/tree/main/plugins/llm-application-dev/skills/llm-evaluation
/plugin marketplace add wshobson/agents /plugin install llm-application-dev@claude-code-workflows
설치와 실행은 사용자 환경에서 이뤄집니다. team-ai는 이 도구를 호스팅하거나 대신 실행하지 않습니다. 제공처와 저장소를 확인한 뒤 설치하세요.
설명
원문: Implement comprehensive evaluation strategies for LLM applications using automated metrics, human feedback, and benchmarking. Use when testing LLM performance, measuring AI application quality, or establishing evaluation frameworks.