본문으로 건너뛰기
PPDF123

PDF를 텍스트로 변환하기

PDF를 텍스트로는 PDF에 이미 있는 글을 뽑아 순수 .txt 파일 또는 RTF로 돌려줍니다. OCR은 하지 않으므로 이미지뿐인 스캔은 비어서 나옵니다.

여기에 파일을 끌어다 놓거나, 클릭해 고릅니다

PDF 지원 · 파일당 최대 500.0 MB · 한 번에 최대 20개 파일

Ctrl/Cmd+V 또는 클립보드 메뉴로 파일을 붙여넣을 수도 있습니다.

PDF를 텍스트로는 이미 글 객체로 존재하는 단어를 뽑습니다. 기본 `txt` 경로는 다른 pdf-core 연산과 같은 로컬 추출기(`pdfio::extract_text`)를 쓰며 `text/plain`을 반환합니다. OCR을 돌리지 않고 LibreOffice도 호출하지 않습니다.

`rtf`를 고르면 파일이 LibreOffice `writer_pdf_import`로 갑니다. 그 경로는 서버의 `soffice`가 필요하며 거친 서식 있는 텍스트를 다시 만듭니다. 글꼴 대체와 표 어긋남은 흔합니다. RTF는 초안으로 보세요.

이미지만 있는 스캔은 비거나 거의 빈 `.txt`가 됩니다. 이 사이트 OCR은 Markdown을 반환하며, 여기로 다시 넣을 수 있는 검색 가능 PDF가 아닙니다.

이 페이지에 페이지 범위 필드는 없습니다. 모든 페이지를 읽습니다. 비밀번호로 보호된 파일은 이 페이지에서 비밀번호를 입력하면 자동으로 해제됩니다. API 호출자는 먼저 비밀번호 해제를 실행하세요.

제목과 목록이 필요하면 PDF를 Markdown으로를, 표 행이 필요하면 PDF를 CSV로 또는 PDF를 Excel로를 쓰세요.

업로드는 일시적입니다. 텍스트 보관함을 남기지 않습니다.

기능

  • 기본 TXT는 로컬 글 추출. pdftotext도 OCR도 아님
  • 선택 RTF는 LibreOffice `writer_pdf_import`
  • 모든 페이지를 읽음. 페이지 범위 매개변수 없음
  • 익명 API: /api/v1/convert/pdf/text

이런 경우에

  • 텍스트 층이 있는 보고서를 grep이나 스크립트에 넣음
  • 전자 메모에서 거친 RTF 초안을 얻음
  • PDF에 텍스트 층이 있는지 확인

PDF에서 글을 추출하려면?

  1. 선택 가능한 글이 있는 PDF를 업로드합니다.
  2. TXT를 유지하거나 LibreOffice 서식 초안이 필요하면 RTF를 고릅니다.
  3. 처리를 누르고 `.txt` 또는 `.rtf`를 내려받습니다.
  4. 몇 단락을 점검합니다. 텍스트 층이 없는 스캔은 비어 보입니다.

제한과 경계

  • OCR 아님. 스캔은 거의 글이 안 뽑힘
  • 페이지 범위 조작 없음
  • TXT는 다단 시각 읽기 순서를 재구성하지 않음
  • 이 사이트의 업로드 한도는 파일당 500MB이며, 약 95MB를 넘으면 나누어 전송합니다. API 직접 요청 한 건의 본문은 100MB까지입니다.

예시

  • 선택 가능한 연차 보고서는 대개 긴 .txt가 됨
  • 화이트보드 사진 PDF는 대개 비거나 아주 작은 파일

이 도구의 개인정보 안내

파일은 HTTPS로 업로드되며, 서버 메모리 또는 수명이 짧은 임시 디렉터리에서 처리되고, 결과가 준비되면 삭제됩니다. 이후 열람·학습·광고 프로필용 사본은 보관하지 않습니다. 보관 기간과 AdSense 쿠키 고지는 개인정보 처리방침을 참고하세요.

자주 묻는 질문

텍스트 파일이 비어 있는 이유는요?
PDF에 추출기가 읽을 글 객체가 없습니다. 스캔은 OCR → Markdown이 필요합니다. 그 Markdown을 이 도구에 다시 넣을 수 없습니다.
TXT가 뷰어에서 복사한 것과 같나요?
가깝지만 같지 않습니다. 순서는 페이지 내용 스트림에 글이 저장된 방식을 따릅니다. 다단 판면은 시각 읽기 순서와 다를 수 있습니다.
언제 RTF를 고르나요?
LibreOffice가 문서를 다시 만들게 하고 싶을 때만입니다. TXT는 직접 추출이며 soffice가 필요 없습니다.
글꼴과 판면이 유지되나요?
TXT는 순수 텍스트입니다. RTF는 가능한 범위의 재구성이며 픽셀 단위 일치는 아닙니다.

최종 업데이트:

코드에서 호출하기

이 사이트의 도구는 모두 일반 REST 엔드포인트입니다. 익명 사용에는 계정이나 API 키가 필요 없습니다. 브라우저뿐 아니라 개발자와 AI 에이전트도 그대로 쓸 수 있습니다.

curl -X POST "https://pdf123.xyz/api/v1/convert/pdf/text" \
  -F "[email protected]" \
  -F "outputFormat=txt" \
  -o output.pdf

Model Context Protocol을 쓰는 에이전트 클라이언트용 MCP 도구로도 제공합니다(JSON-RPC 2.0, POST /mcp). 전체 API 문서

AI 에이전트에서 사용하기

스킬

이 스킬을 설치하면 Claude Code, Codex, Cursor 등 AI 에이전트가 'PDF를 텍스트로' 작업을 대신 실행합니다: /skills/pdf123-pdf-to-text.md

전체 에이전트 스킬

파일은 이번 처리에만 쓰이며, 끝나면 자동으로 삭제됩니다.