| name | exam-crop |
| description | PDF 시험지에서 각 문제를 Gemini Vision으로 감지하고 개별 이미지로 크롭한다. 'PDF 크롭', '자동 크롭', '문제 이미지 추출' 키워드에 사용. |
| allowed-tools | Read, Bash |
| argument-hint | [PDF 경로] [출력 디렉토리] |
PDF 자동 크롭 스킬
PDF 시험지에서 각 문제를 Gemini Vision으로 감지하고 개별 이미지로 크롭한다.
사용법
프롬프트에서 PDF 경로와 출력 디렉토리를 받는다.
작업 절차
1. 경로 확인
프롬프트에서 다음을 추출한다:
- PDF 경로: 크롭할 시험지 PDF
- 출력 디렉토리: 크롭된 이미지 저장 위치
2. gemini_crop.py 실행
Bash 도구로 다음을 실행한다:
python3 workspaces/crop/gemini_crop.py "<PDF_경로>" "<출력_디렉토리>"
스크립트가 하는 일:
- PDF → 페이지별 이미지 (PyMuPDF, 200dpi)
- Gemini 2.5 Flash에 모든 페이지 전송 → 문제별 bounding box 반환
- bbox 기반으로 각 문제 크롭 →
q01.png, q02.png, ... 저장
crop_results.json 생성
3. 결과 확인
스크립트 출력을 확인하고 결과를 보고한다.
주의사항
GEMINI_API_KEY 환경변수가 필요하다
- 학생 필기가 있는 스캔본도 처리 가능 (Gemini가 인쇄 텍스트 기준으로 감지)
- 크롭 정확도가 완벽하지 않을 수 있음 — 사람이 프론트엔드에서 검수
- 해설/정답 페이지는 자동으로 건너뜀