PDF 텍스트 추출
PDF에서 글자를 뽑아내 복사하거나 .txt 파일로 저장합니다. 페이지마다 줄을 되살리고 원하면 페이지 구분선을 넣습니다. 브라우저 안에서만 처리됩니다.
파일을 끌어다 놓거나 눌러서 고르세요
파일은 서버로 전송되지 않고 브라우저에서만 처리됩니다.
사용 방법
PDF를 올리면 몇 초 안에 모든 페이지의 텍스트가 아래 상자에 나타납니다. 버튼 한 번으로 복사하거나 원본 문서 이름을 딴 .txt 파일로 내려받을 수 있습니다. 페이지 구분선 옵션을 켜면 페이지마다 앞에 "--- N페이지 ---" 줄이 들어가서 어디서 페이지가 바뀌는지 알 수 있습니다.
이 도구는 PDF에 이미 들어 있는 텍스트 레이어를 읽고, 각 조각이 페이지 위 어디에 놓였는지를 보고 줄을 되살립니다. Word, 구글 문서, LaTeX, 웹 브라우저에서 내보낸 문서는 잘 됩니다. 다만 다단 편집, 표, 이미지 위에 얹은 글자는 읽는 순서와 다르게 나올 수 있으니 결과를 확인한 뒤 쓰세요.
스캔한 PDF는 글자가 아니라 사진을 쌓아 놓은 것이라서 이 도구로는 아무것도 나오지 않습니다. OCR 단계가 없기 때문입니다. 스캐너나 휴대폰 카메라로 만든 파일이라면 먼저 OCR 도구로 글자를 인식시켜야 합니다. 비밀번호가 걸린 PDF도 열 수 없으니 비밀번호를 해제한 뒤 다시 시도하세요.
파일은 컴퓨터 밖으로 나가지 않습니다. 추출은 전부 브라우저 안에서 이루어지고 어디에도 업로드되지 않으므로 계약서, 거래 명세서, 사내 보고서도 안심하고 다룰 수 있습니다.
이런 도구도 함께 씁니다
PDF를 이미지로 변환 (PNG / JPG)
PDF의 각 페이지를 72·150·300dpi의 PNG나 JPG 이미지로 바꿉니다. 필요한 페이지만 골라 하나씩 또는 한 번에 내려받을 수 있습니다.
글자수 세기
공백 포함과 제외 글자수, 단어, 줄, 문단, 바이트를 한 번에 셉니다. 자기소개서 분량을 맞출 때 씁니다.
텍스트 비교
두 텍스트의 다른 부분을 색으로 표시합니다. 줄 단위와 단어 단위 중에 골라서 볼 수 있습니다.
마크다운 → 워드 변환
마크다운을 제목 스타일·목록·표·코드 블록이 살아 있는 진짜 .docx 파일로 바꿉니다. 브라우저에서만 처리되고 업로드는 없습니다.