PDF·사진 → 텍스트 · 표 · 서버 내에서 처리
텍스트 레이어가 있는 PDF 는 직접 추출(빠르고 정확)하고, 스캔본 페이지만 OCR 로 처리합니다 — OCR 한도는 따로 셉니다.
PDF / PNG / JPG / TIF / BMP / WEBP · 최대 MB
아직 작업이 없습니다.
추출은 서버 내 PyMuPDF · tesseract(Apache-2.0)로 처리되며 문서가 외부 API 로 전송되지 않습니다. 원본 파일은 처리 완료 후 삭제되고 추출 결과만 보관됩니다. OCR 결과는 원본 상태·글꼴·해상도에 따라 오차가 있을 수 있으며, 중요한 문서는 원본과 대조하십시오.