vision-sft
자동 수집 항목입니다. 설치 설정은 저장소 README에서 그대로 가져왔지만, 한국어 설명과 부서 분류는 아직 확인하지 않았습니다. 설치 전에 저장소를 한 번 확인하세요.
이미지+텍스트 데이터에 대한 지도학습으로 비전-언어 모델(VLM)을 파인튜닝합니다. VLM을 시각 도메인이나 작업에 적응시킬 때, 비전 타워를 고정한 LoRA를 구성할 때, 또는 학습은 되지만 학습 효과가 없는 VLM 파인튜닝을 디버깅할 때 사용합니다.
설치하기
Claude Code에서 위 두 줄을 차례로 실행합니다. `llm-finetuning` 묶음에 이 스킬이 들어 있습니다. 설치한 뒤에는 이름을 언급하면 발동합니다 — 예: "vision-sft 스킬로 정리해줘". 원본: https://github.com/wshobson/agents/tree/main/plugins/llm-finetuning/skills/vision-sft
/plugin marketplace add wshobson/agents /plugin install llm-finetuning@claude-code-workflows
설치와 실행은 사용자 환경에서 이뤄집니다. team-ai는 이 도구를 호스팅하거나 대신 실행하지 않습니다. 제공처와 저장소를 확인한 뒤 설치하세요.
설명
원문: Fine-tune vision-language models (VLMs) with supervised learning on image+text data. Use when adapting a VLM to a visual domain or task, configuring frozen-vision-tower LoRA, or debugging a VLM fine-tune that trains without learning.