193팀 중 22위
비전 AI 파인튜닝 챌린지
2026.04.01 — 2026.04.30 · 5인 팀 · 환경 구축·EDA·학습·프롬프트 튜닝
실험 비교 화면이 이 자리에 들어갑니다
- 정확도
- 0.91683 → 0.93299
- 동일 조건 실험
- 30회 비교
프로젝트 소개
팀원마다 실험 조건이 달라 결과를 비교할 수 없었습니다. 시드와 하이퍼파라미터를 고정하고 데이터 로드부터 추론까지 하나의 파이프라인으로 묶은 뒤, 같은 조건에서 30회 실험을 비교했습니다.
사용 기술
Python
PyTorch
Hugging Face
- Qwen
문제 해결
팀원마다 난수 시드와 하이퍼파라미터가 달라, 점수가 올라도 무엇 때문인지 알 수 없었습니다. 성능을 올리기 전에 조건을 고정해 비교 기준을 먼저 만들었습니다.
데이터 로드부터 추론까지 하나의 파이프라인으로 묶어, 실험 간 차이가 바꾼 변수 하나에서만 나오게 했습니다.
정답이 특정 보기에 치우쳐 검증 점수가 실제 성능을 반영하지 못했습니다. 계층화 분할로 학습·검증 세트의 정답 비율을 맞췄습니다.
모델이 보기 외에 설명을 덧붙이면 채점에서 오답이 됩니다. 프롬프트로 응답을 a/b/c/d 한 글자로 제한했습니다.
같은 조건 30회 비교로 정확도를 0.91683에서 0.93299까지 올렸고, 193팀 중 22위로 마쳤습니다.