회사에서 고객 응대 챗봇 만들 일이 있어서 LoRA로 미세조정 해봤음.
1. 베이스 모델: Llama 3.1 8B (한국어 지원 좋음)
2. 데이터셋: 자사 CS 로그 5만 건 정제해서 instruction format으로 변환
3. 학습: QLoRA로 16GB VRAM에서 돌림 (4bit 양자화)
4. 결과: 정확도 68% -> 89%로 상승, 환각(hallucination)도 줄어듦
가장 효과 좋았던 건 '잘못된 질문에 대한 대응' 데이터를 추가한 거.
혹시 FT 경험 있는 분들, 데이터 전처리 팁 있으면 공유 부탁.