네이버 하이퍼클로바X(HyperCLOVAX-SEED-Think-32B)를 한국 법률 QA 데이터셋 KICJ/legal_qa_ko(한국형사법무정책연구원) 으로 QLoRA 파인튜닝하는 프로젝트입니다.
SFTTrainerpip install -r requirements.txt
# 기본 설정 (32B, 4bit, epochs=3)
python train_lora.py
# 커스텀 설정
python train_lora.py --batch_size 4 --epochs 2 --save_dir my_adapter
주요 인자 (python train_lora.py --help):
| 인자 | 기본값 | 설명 |
|---|---|---|
--model_name | naver-hyperclovax/HyperCLOVAX-SEED-Think-32B | base 모델 |
--output_dir | outputs_legal_qa | 체크포인트 출력 |
--save_dir | legal_qa_lora | 최종 LoRA 어댑터 저장 위치 |
--batch_size | 2 | GPU당 배치 크기 |
--epochs | 3 | 학습 에폭 수 |
--eval_ratio | 0.05 | 검증 데이터 비율 |
legal_qa_lora/에 LoRA 어댑터 저장.# 학습된 어댑터로 법률 QA
python inference.py
# 질문 지정
python inference.py --question "형법 제329조 절도죄의 법정형은?"
# 커스텀 어댑터
python inference.py --adapter_dir my_adapter
추론은 학습과 동일한 프롬프트 형식(시스템 프롬프트 + [법률 문맥]/[질문])을 사용하며,
어댑터(legal_qa_lora/)가 없으면 명확한 에러를 출력합니다.
├── train_lora.py # QLoRA 학습 스크립트
├── inference.py # 추론 스크립트 (LoRA 어댑터 로드)
├── prompts.py # 공유 프롬프트 모듈 (학습/추론 공용)
├── notebooks/ # 실험 노트북
├── requirements.txt
└── README.md
outputs_legal_qa/, legal_qa_lora/)과 .freebuff/는 .gitignore에 포함되어 커밋되지 않습니다.train_lora.py 하단의 주석 처리된 코드로 활성화할 수 있습니다.1 commits
Jupyter Notebook
53.9%
Python
46.1%
네이버 하이퍼클로바X(HyperCLOVAX-SEED-Think-32B)를 한국 법률 QA 데이터셋 KICJ/legal_qa_ko(한국형사법무정책연구원) 으로 QLoRA 파인튜닝하는 프로젝트입니다.
SFTTrainerpip install -r requirements.txt
# 기본 설정 (32B, 4bit, epochs=3)
python train_lora.py
# 커스텀 설정
python train_lora.py --batch_size 4 --epochs 2 --save_dir my_adapter
주요 인자 (python train_lora.py --help):
| 인자 | 기본값 | 설명 |
|---|---|---|
--model_name | naver-hyperclovax/HyperCLOVAX-SEED-Think-32B | base 모델 |
--output_dir | outputs_legal_qa | 체크포인트 출력 |
--save_dir | legal_qa_lora | 최종 LoRA 어댑터 저장 위치 |
--batch_size | 2 | GPU당 배치 크기 |
--epochs | 3 | 학습 에폭 수 |
--eval_ratio | 0.05 | 검증 데이터 비율 |
legal_qa_lora/에 LoRA 어댑터 저장.# 학습된 어댑터로 법률 QA
python inference.py
# 질문 지정
python inference.py --question "형법 제329조 절도죄의 법정형은?"
# 커스텀 어댑터
python inference.py --adapter_dir my_adapter
추론은 학습과 동일한 프롬프트 형식(시스템 프롬프트 + [법률 문맥]/[질문])을 사용하며,
어댑터(legal_qa_lora/)가 없으면 명확한 에러를 출력합니다.
├── train_lora.py # QLoRA 학습 스크립트
├── inference.py # 추론 스크립트 (LoRA 어댑터 로드)
├── prompts.py # 공유 프롬프트 모듈 (학습/추론 공용)
├── notebooks/ # 실험 노트북
├── requirements.txt
└── README.md
outputs_legal_qa/, legal_qa_lora/)과 .freebuff/는 .gitignore에 포함되어 커밋되지 않습니다.train_lora.py 하단의 주석 처리된 코드로 활성화할 수 있습니다.1 commits
Jupyter Notebook
53.9%
Python
46.1%