PDF에서 텍스트를 복사하려면 브라우저나 PDF 리더에서 파일을 열고 원하는 텍스트를 마우스 커서로 드래그한 다음 Windows에서는 Ctrl+C, Mac에서는 Cmd+C를 누르면 됩니다. 일반적인 PDF라면 이 설명이 이 글의 전부일 것입니다.
하지만 다른 종류의 PDF도 있습니다. 커서를 끌어당기면 페이지에 파란색 상자만 그려지고 허공만 잡히는 스캔 문서도 있고, 작성자가 복사 기능을 꺼두어 Ctrl+C를 눌러도 정중하게 거부당하는 파일도 있습니다. 아래에서 6가지 방법을 소개하고, 단순 복사 방식이 더 이상 의미가 없어지는 시점에 대해서도 알아봅니다.
PDF에서 텍스트를 복사하여 붙여넣는 방법
상황에 맞게 시도할 수 있는 6가지 방법입니다. 일반적인 PDF라면 방법 1부터 시작하세요. 스캔본이라면 방법 3으로 건너뛰고, 복사가 차단된 파일이라면 방법 6을 참고하세요.
방법 1: Adobe Acrobat Reader
Adobe Reader는 PDF를 읽고 마크업하기 위한 Adobe의 데스크톱 앱으로, 간단한 텍스트 복사를 훌륭하게 처리합니다.
- 마우스를 클릭한 채 드래그하여 복사할 텍스트를 선택하세요.
- 마우스 오른쪽 버튼을 클릭하고 "복사"를 선택하거나 CTRL + C (Windows), Command + C (Mac)를 사용하세요.
- 붙여넣고 싶은 곳에서 마우스 오른쪽 버튼을 클릭하여 "붙여넣기"를 선택하거나, Ctrl+V (Windows) / Cmd+V (Mac)를 눌러 텍스트를 붙여넣으세요.

설치가 번거롭다면 생략해도 좋습니다. PDF를 Chrome, Edge 또는 Safari 탭으로 드래그 앤 드롭한 다음 텍스트를 선택하고 동일한 단축키를 사용해도 됩니다.
단락 한두 개를 가져올 때 가장 좋습니다. 레이아웃이 복잡할 경우 서식이 엉클어진 채 클립보드에 복사되며, 스캔한 PDF에서는 아무것도 복사할 수 없습니다.
방법 2: Microsoft Word
Word는 텍스트를 단순 복사하는 것이 아니라 문서를 재구성합니다. 이것이 바로 클립보드 복사 시 평탄화되는 서식을 유지하는 이유입니다. PDF에서 Word로 텍스트를 복사하고 싶을 때 적합한 방법입니다.
- Word를 열고 "파일"에서 "열기"를 클릭한 다음 PDF를 선택하세요.
- "열기"를 클릭합니다. Word에서 파일을 변환한다는 경고 메시지가 나타나면 허용해 주세요.
- 변환된 문서에서 필요한 텍스트를 복사합니다.

단순한 문서는 대부분 서식이 그대로 유지된 채 변환됩니다.

다단 페이지나 디자인 요소가 많은 보고서의 경우 변환 결과가 달라질 수 있습니다. 중요한 문서라면 내용을 신뢰하기 전에 꼭 확인하세요.
방법 3: Google Docs
Google Docs는 문서를 가져올 때 OCR을 실행하므로 스캔한 PDF 내부의 텍스트를 가져오는 가장 빠른 방법입니다. 먼저 Google Drive에 파일을 업로드하세요.

- 문서를 마우스 오른쪽 버튼으로 클릭하고 "연결 앱"을 선택한 다음 "Google 문서"를 선택하세요.
- 필요한 텍스트를 선택하여 원하는 위치에 붙여넣습니다.

문서가 페이지를 읽어 편집 가능한 문서로 돌려줍니다. 텍스트 데이터는 유지되지만, 아래 스크린샷에서 뼈저리게 알 수 있듯이 디자인은 유지되지 않습니다.

방법 4: 온라인 PDF 텍스트 변환기
변환기는 레이아웃이 중요하지 않을 때 한 번에 문서 전체를 일반 텍스트로 바꾸는 도구입니다. PDF to Text와 PDF2Go 모두 이 기능을 제공합니다. PDF2Go의 경우:
- 드래그 앤 드롭을 이용하거나 Google Drive, Dropbox에서 파일을 업로드하세요.

- 설정을 선택하고 "시작"을 클릭한 후 변환을 기다립니다.
- 텍스트 파일을 다운로드한 다음, 필요한 내용을 복사해서 붙여넣으세요.
업로드하기 전에 고려해야 할 두 가지가 있습니다. 이러한 도구는 문자가 무엇을 의미하는지 이해하지 못한 채 문자만 읽어내는 기존 OCR(광학 문자 인식) 방식을 실행하므로, 사용 가능한 데이터가 아닌 단순 텍스트만 얻게 됩니다. 또한 연봉 정보, 진단서 또는 계약서와 같이 민감한 내용을 낯선 서버에 넘겨주는 것이므로 한 번쯤 고민해 볼 필요가 있습니다.
방법 5: Python 라이브러리
코딩이 익숙하다면 pypdf 또는 Adobe PDF Services API를 사용하여 프로그래밍 방식으로 처리할 수 있습니다. pypdf는 PDF 페이지를 읽고, 나누고, 병합하고, 변환하기 위한 오픈소스 Python 라이브러리이며 PyPDF2의 유지보수 후속 버전입니다. Adobe의 API 역시 유료 서비스로서 비슷한 기능을 제공합니다.
한 가지 주의할 점이 있습니다. pypdf는 텍스트 레이어를 읽기 때문에 스캔 문서는 빈 문자열로 반환되어 당혹감을 줄 수 있습니다. 스캔 문서의 경우 OCR 단계를 추가하여 결합하세요.
방법 6: 화면 텍스트 캡처
이제 모든 주요 운영 체제에서 화면에서 바로 텍스트를 추출할 수 있습니다. 이는 PDF 복사가 불가능할 때 사용할 수 있는 탈출구입니다.
Windows 11의 경우 캡처 도구를 열고 페이지 영역을 캡처한 다음 '텍스트 작업(Text Actions)'을 사용하여 텍스트를 추출할 수 있습니다. Mac의 경우 미리보기(Preview) 앱에서 스크린샷을 찍은 후 '라이브 텍스트(Live Text)'로 동일한 작업을 수행합니다. iPhone 및 Android에서는 스크린샷 내의 텍스트를 길게 누르면 됩니다.
이 방법은 복사가 차단된 파일이나 스캔본에서도 작동하므로 대부분의 다른 방법보다 활용도가 높습니다. 하지만 한 번에 한 화면에 들어가는 텍스트만 추출할 수 있어 구출용 도구일 뿐 워크플로우로 쓰기에는 한계가 있습니다.
이 PDF에서 텍스트를 복사할 수 없는 이유는 무엇인가요?
PDF에서 텍스트를 전혀 선택할 수 없다면 원인은 단 두 가지뿐이며, 1초 만에 구별할 수 있습니다.
커서가 페이지 전체에 상자를 그리는 경우: PDF가 스캔본이거나 이미지입니다. 텍스트 레이어는 없고 텍스트 그림만 있기 때문에 아무리 클릭해도 단어가 선택되지 않습니다. 이를 검색 가능한 PDF로 변환해 주는 OCR이 필요합니다. 앞서 설명한 방법 3의 Google Docs가 가장 빠른 일회성 해결책입니다.
커서가 단어를 강조 표시하지만 Ctrl+C를 눌러도 복사되지 않는 경우: 파일의 권한 설정에서 복사가 비활성화되어 있습니다. Acrobat Reader에서 페이지를 마우스 오른쪽 버튼으로 클릭하고 '문서 속성'을 선택한 다음 '보안' 탭을 확인하여 작성자가 정확히 무엇을 허용했는지 확인하세요. 콘텐츠 복사가 비활성화되어 있다면 발송자에게 제한 없는 버전이나 비밀번호를 요청하는 것이 올바른 방법입니다. 본인의 문서인 경우 같은 속성 패널에서 제한을 제거할 수 있습니다.
복사 및 붙여넣기의 한계
이 6가지 방법 모두 하나의 한계를 가지고 있으며, 생각보다 일찍 그 한계에 부딪히게 됩니다.
- 서식이 클립보드에서 그대로 유지되는 경우는 거의 없습니다. 글꼴, 크기 및 단이 엉망으로 나타납니다.
- 클립보드는 행과 열의 개념이 없기 때문에 표가 뒤죽박죽이 됩니다.
- 기존 OCR은 스캔본이 비뚤어지거나 흐리거나 텍스트가 너무 빽빽해지는 순간 정확도가 떨어집니다.
- 온라인 변환기는 내 문서를 다른 사람의 서버로 전송하여 처리합니다.
- 인보이스 총액에서 숫자 하나만 잘못 복사해도 아예 데이터가 없는 것보다 더 나쁜 결과를 초래합니다.
- 무엇을 복사하든 실제로 필요한 시스템에 직접 입력하거나 가져오는 과정을 거쳐야 합니다.
문서가 단 하나라면 이런 문제는 중요하지 않습니다. 하지만 이번 달에 50번째 문서를 처리해야 한다면 이야기가 달라집니다.
클립보드가 할 수 없는 것을 AI는 어떻게 읽어낼까
AI 기반 텍스트 추출은 사람과 마찬가지로 잉크가 어디에 있는지 묻는 대신 레이아웃이 의미하는 바를 파악하여 문서를 읽어냅니다. 단순 텍스트 복구와 실제로 사용할 수 있는 데이터를 얻는 것의 차이가 바로 여기에 있습니다.
기존 OCR은 문자만 가득한 페이지를 던져주고 사용자가 직접 인보이스 번호를 찾도록 둡니다. 반면 AI 엔진은 인보이스 번호 자체를 반환합니다.
AI 파서가 이 작업을 더 잘 처리하는 이유
Parseur는 레이아웃이 얼마나 복잡하든 PDF 문서에서 특정 텍스트를 추출할 수 있습니다.
- 공급업체마다 서류 형식이 다릅니다. 원하는 필드만 한 번 나열해 두면, 발송자마다 템플릿을 만들 필요가 없습니다.
- 표 구조가 그대로 유지됩니다. Parseur는 단순 텍스트가 아닌 행과 열 형식으로 PDF에서 표를 추출할 수 있습니다.
- 스캔본은 입력되는 즉시 레이아웃이 고정된 경우에는 영역 OCR이, 고정되지 않은 경우에는 동적 OCR이 읽어냅니다.
- 고객의 문서는 안전하게 보호됩니다. Parseur는 GDPR을 준수하며 SOC 2 Type II 인증을 진행 중입니다.
그런 다음 Parseur는 결과를 이미 사용 중인 도구로 직접 전달하므로 누구도 두 번 복사-붙여넣기를 할 필요가 없습니다. 이것이 단순한 복사가 아닌 PDF 파싱이며, 완전히 다른 개념의 작업입니다.
Parseur를 사용하여 스캔한 PDF에서 텍스트를 복사하는 방법
설정에는 몇 분밖에 걸리지 않으며 신용카드도 필요하지 않습니다.
- 메일박스를 만들고 AI 엔진을 선택하세요. Vision AI 엔진은 PDF, 스캔본, 이미지를 읽어냅니다. Text AI 엔진은 이메일 및 텍스트 문서를 읽습니다.

- 필요한 필드를 나열하세요. AI가 템플릿 작성 없이 다양한 레이아웃에서 해당 필드를 찾아냅니다.

- 스캔한 PDF를 이메일, 업로드 또는 API로 전송하세요.
- 반환된 결과를 확인하세요.
한 가지 문서 유형으로 작업하시나요? 용도에 맞는 메일박스부터 시작하면 필드 이름이 이미 지정되어 돌아옵니다. 인보이스라면 "Invoices" 메일박스로 시작하면 됩니다.

추출된 데이터 활용하기
- 텍스트를 CSV 또는 JSON으로 다운로드하세요.
- 데이터를 Google 스프레드시트로 전송하세요.
- Zapier, Make 또는 Power Automate를 사용하여 모든 애플리케이션으로 내보내세요.
PDF 하나에서 텍스트를 복사하는 데는 2초면 충분합니다. 하지만 그다음 500개의 PDF에서 일일이 텍스트를 복사하는 것은 그 누구에게도 주어져서는 안 될 일입니다. 지금까지 미뤄왔던 문서 더미를 Parseur로 직접 처리해 보세요.

마지막 업데이트






