PDF OCR 인식
무료 로컬 처리무료 온라인 PDF OCR 문자 인식 도구. PDF 각 페이지를 이미지로 렌더링한 후 tesseract.js로 문자를 인식합니다. 간체/번체 중국어, 영어, 일본어, 한국어, 프랑스어, 독일어, 스페인어 등 10+ 언어를 지원하며, 페이지 번호 범위 지정 가능. 파일은 서버에 업로드되지 않고 모두 브라우저에서 처리하여 개인정보를 보호합니다.
파일을 여기로 끌어오거나
각 파일 최대 100.0 MB
옵션
사용 방법
- 1 하나의 PDF 파일을 선택합니다
- 2 인식 언어를 선택합니다(간체/번체 중국어, 영어, 일한불독서러 아랍어 등 10+ 언어 지원)
- 3 선택: 페이지 범위 입력(예: 1-3), 빈 칸이면 전체 페이지 인식
- 4 "PDF OCR 인식" 버튼을 클릭하고, 인식 완료 후 문자 확인/복사
FAQ
Q: 왜 이렇게 느리나요?
OCR은 각 페이지를 고해상도 이미지로 렌더링한 후 페이지별로 문자를 인식해야 하여 계산량이 많습니다. 페이지 수가 많을수록, 해상도가 높을수록 느립니다. "페이지 범위"로 필요한 페이지만 인식하거나, 메모리를 많이 사용하는 다른 탭을 닫기를 권장합니다.
Q: 인식 정확도가 높지 않으면 어떡하죠?
정확도는 PDF의 선명도에 따라 다릅니다. 스캔 파일이 선명하고 글꼴이 규격일 때 인식이 좋으며, 흐림, 기울어짐 또는 손글씨는 효과가 떨어집니다. 더 맞는 언어를 선택할 수 있습니다(순수 영어는 "영어만"이 더 정확할 수 있음).
Q: 파일이 서버에 업로드되나요?
아니요. 모든 렌더링과 인식은 브라우저에서 완료되며, 파일은 기기를 떠나지 않아 개인정보를 완벽히 보호합니다.