FileKeeps

스캔 PDF OCR

텍스트 레이어가 없는 스캔·이미지 PDF에서 글자를 인식해 뽑아냅니다 · 100% 브라우저 처리

On-Device

1. PDF 선택

2. 언어

인식 언어

언어 데이터는 첫 사용 때 한 번 내려받아 브라우저에 캐시됩니다. 파일은 서버로 전송되지 않습니다.

3. 실행

텍스트 레이어가 없는 스캔·이미지 PDF에서 글자를 인식해 뽑아냅니다. 각 페이지를 이미지로 만든 뒤 tesseract.js로 인식하며, 파일은 서버로 전송되지 않습니다.

이런 걸 할 수 있어요

  • 스캔·사진 PDF에서 텍스트 추출
  • 한국어+영어·영어·일본어·중국어 인식
  • 인식 결과를 화면에서 보고 복사·TXT 저장
  • 여러 페이지 일괄 처리(앞 30장)
  • 100% 브라우저 내 처리 — 업로드 없음

이렇게 쓰세요

  1. 1스캔 PDF를 올립니다
  2. 2인식 언어를 고르고 '텍스트 인식'을 누릅니다
  3. 3결과를 복사하거나 TXT로 내려받습니다

지원 형식 · PDF(입력) → 텍스트/TXT