AI 문서 추출

모든 문서에 맞는 파싱 엔진을 갖춘 AI 문서 추출

Parseur는 PDF, 스캔, 이메일, 첨부파일에서 구조화된 데이터를 추출합니다. Vision AI는 시각적 레이아웃, Text AI는 일반 텍스트, 템플릿은 고정 양식을 처리합니다. 세 엔진이 하나의 메일함에서 함께 작동합니다.

문서에서 데이터를 추출하는 데 필요한 모든 기능

Vision AI 추출

비전 모델은 페이지를 텍스트가 아닌 이미지로 읽습니다. AI는 전체 레이아웃과 시각적 맥락을 포함하여 사람이 읽는 방식 그대로 문서를 인식합니다.

  • 복잡한 구조의 PDF, 스캔, 양식에 최적
  • 필기, 체크박스, 도장 및 레이아웃 신호 캡처
  • 영어 지시문만으로 설정, 템플릿 불필요

Text AI 추출

문서가 먼저 일반 텍스트로 변환되며, 원본에 기본 텍스트 레이어가 없으면 OCR이 사용됩니다. 이후 AI는 레이아웃과 이미지를 무시하고 추출된 텍스트만 파싱합니다.

  • 이메일, 일반 PDF, 기타 텍스트 중심 문서에 최적
  • 시각적 레이아웃이 추가적인 정보를 제공하지 않을 때 유용
  • 영어 지시문만으로 설정, 템플릿 불필요

템플릿 기반 추출

메일함마다 필요한 만큼 템플릿을 추가하세요. Parseur가 문서에 가장 잘 맞는 템플릿을 자동 선택해 매번 동일한 결과를 생성하며, AI는 관여하지 않습니다.

  • 규격화된 양식 및 시스템 발송 이메일에 최적
  • 레이아웃이 변하지 않을 때 가장 신뢰할 수 있는 추출 방법
  • 시각적 템플릿 에디터로 설정, 문서 레이아웃당 하나씩 적용

표 및 라인 아이템 추출

표의 각 행이 단일 병합 필드가 아닌 개별 데이터 레코드가 됩니다. 세 가지 파싱 엔진 모두에서 작동합니다. 기본 스프레드시트의 경우 표 파싱이 자동으로 이루어집니다.

  • 문서마다 행 수가 달라도 자동 대응
  • 여러 페이지에 걸친 표 지원
  • AI 엔진은 복잡한 다중 행을 개별 필드로 파싱하는 것을 지원합니다

스캔과 이미지를 위한 OCR

광학 문자 인식(OCR)이 스캔본, 휴대폰 사진, 이미지 전용 PDF에서 텍스트를 읽습니다. 기본 텍스트 레이어가 없을 때 Text AI와 템플릿 엔진에 데이터를 제공합니다.

  • 스캔본, 휴대폰 사진, 이미지 전용 PDF 지원
  • 필기를 포함한 200개 이상 언어의 다국어 OCR
  • 템플릿 엔진은 고정 또는 변동 레이아웃에 영역 OCR과 동적 OCR 사용

문서 전처리

정확한 추출은 들어오는 문서를 정리하고 복구하는 것에서 시작됩니다. Parseur의 전처리는 1억 개 이상의 문서와 10년에 걸친 실제 엣지 케이스를 통해 개선되었습니다.

  • 기울어진 스캔을 교정하고 깨진 텍스트에 OCR 재실행
  • 손상된 PDF, 깨진 이메일 인코딩, 잘못된 HTML 복구
  • 국가별 날짜 및 숫자 형식을 자동으로 감지

AI 문서 추출 작동 방식

방금 일어난 일

자동화된 문서 수집

문서가 이메일, API, 업로드 또는 연결된 저장소를 통해 자동으로 수집되었습니다.

자세히 알아보기
1

전처리

모든 문서는 먼저 정리 과정을 거칩니다. Parseur가 필요에 따라 페이지 방향을 수정하고, 기울어진 스캔을 교정하며, 깨지거나 순서가 잘못된 콘텐츠를 복구합니다.

9° 기울임
준비 완료
2

OCR

스캔본, 휴대폰 사진, 이미지 전용 PDF의 경우 Parseur가 OCR을 실행하여 텍스트를 추출합니다. 이미 기본 텍스트 레이어가 있는 문서는 이 단계를 건너뜁니다.

청구서 #Q2-8821
아크미㈜
April 15, 2026
마감 May 15
발신자
아크미㈜
acme.co.kr
수신처
글로벡스㈜
서울 강남
OCR 스캔 중
3

엔진 선택

Parseur는 각 문서에 맞는 엔진을 자동으로 선택합니다. 일치하는 템플릿이 있으면 템플릿 기반 파싱이 우선 적용되며, 그렇지 않은 경우 Vision AI가 이미지 중심 페이지를 처리하고 Text AI가 일반 텍스트 콘텐츠를 처리합니다.

템플릿
AI 비전
AI 텍스트
4

추출

선택된 파싱 엔진은 메일함에 정의한 스키마에 매핑된 구조화된 필드를 문서에서 추출합니다. 여기서부터 모든 필드는 포맷팅 및 검증을 위해 정규화 단계로 전달됩니다.

청구서 #Q2-8821 청구서 번호
아크미㈜
고객
7월 28, 2026
날짜
마감 May 15
발신자
아크미㈜
acme.co.kr
수신처
글로벡스㈜
서울 강남
항목 품목 수량 단가 컨설팅 2 ₩50,000 장비 1 ₩30,000 초기 설정비 3 ₩40,000
소계 ₩250,000
부가세 ₩25,000
합계 ₩275,000 합계
추출 중

다음 단계

데이터 정규화 및 검증

추출된 필드는 검증과 포맷팅을 거쳐 후속 워크플로우에 맞게 구조화됩니다.

자세히 알아보기
시작하기

문서 파싱, 이제 자동으로.

샘플을 업로드하고 필요한 필드만 정의하면, Vision AI, Text AI 또는 템플릿이 알아서 데이터를 추출합니다.

무료 플랜 포함, 신용카드 불필요
2분 이내 첫 문서 처리
약정 없이 언제든 해지 가능

자주 묻는 질문

Vision AI, OCR, 템플릿, 표 추출, 다국어 지원 등 Parseur 파싱 엔진에 관한 주요 질문을 확인하세요.

AI 문서 추출은 인공지능을 사용하여 PDF, 스캔, 이메일, 이미지와 같은 문서에서 데이터를 찾아 추출하고 이를 구조화된 레코드로 변환하는 것을 말합니다. 수동 문서 데이터 추출이나 엄격한 규칙 기반 도구와 달리, Parseur와 같은 AI 문서 추출 소프트웨어는 레이아웃 변경에 자동으로 적응하며 모델 학습이 필요하지 않습니다. 필요한 필드를 정의하기만 하면 AI가 들어오는 모든 문서에서 해당 필드를 추출합니다.

문서 파싱은 PDF, 스캔, 이메일 등 비정형 문서에서 구조화된 필드를 추출해, 스프레드시트, 데이터베이스, 연동 도구에서 수작업 없이 바로 활용할 수 있도록 만드는 과정입니다. Parseur는 Vision AI, Text AI, 템플릿 세 가지 엔진을 구동하며 각 문서에 가장 적합한 방식을 자동으로 선택합니다.

Vision AI는 페이지를 이미지로 인식해 전체 레이아웃(필기, 체크박스, 도장, 시각적 신호 포함)을 분석합니다. 복잡한 구조의 PDF, 스캔, 양식에 적합합니다. Text AI는 문서의 일반 텍스트만 분석하고 레이아웃을 무시하며, 이메일이나 일반 PDF 등 텍스트 중심 문서에 적합합니다.

네. 문서 레이아웃별로 원하는 만큼 템플릿을 추가할 수 있습니다. 새 문서가 도착하면 Parseur가 가장 잘 맞는 템플릿을 자동으로 적용해, 하나의 메일함에서 다양한 고정 레이아웃을 한 번에 처리합니다. 일치하는 템플릿이 없으면 Vision AI나 Text AI가 자동으로 이어 받아 파싱합니다.

네. 스캔본, 휴대폰 사진, 이미지 전용 PDF는 내장 OCR로 처리되며, Vision AI는 텍스트 중심 도구가 놓치는 필기, 체크박스, 도장 같은 시각 요소도 인식합니다.

네. 표의 각 행이 하나로 합쳐진 텍스트 블록이 아닌 개별 데이터 레코드로 추출됩니다. 표 추출은 세 가지 파싱 엔진 모두에서 동작하며, 행 수가 달라도 자동 대응하고 여러 페이지에 걸친 표도 지원합니다. 기본 스프레드시트 파일은 자동으로 표로 파싱됩니다.

정확도는 엔진과 문서에 따라 달라집니다. 템플릿은 고정 레이아웃에서 매번 동일한 결과를 보장합니다. Vision AI는 복잡한 시각 구조, Text AI는 일반 텍스트를 다룹니다. 추출 전 전처리 단계에서 기울어진 스캔, 깨진 텍스트, 인코딩 오류, 손상된 PDF 등을 복구하며, 결과 데이터는 Parseur에서 내보내기 전에 다운스트림 검증을 통해 문제를 잡아냅니다.

Parseur는 AI로 문서를 파싱하며 레이아웃별 템플릿이나 이후의 수동 정리 작업이 필요하지 않습니다. Vision AI 및 텍스트 기반 AI 엔진은 다양한 레이아웃에 자동으로 적응하고 바로 사용할 수 있는 구조화된 데이터를 앱으로 직접 출력하므로 규칙을 만들거나 후처리하는 단계가 없습니다.

샘플 문서를 업로드하면 Parseur가 추출할 만한 필드를 자동으로 제안합니다. 이후 원하는 필드를 다듬고, 각 필드별로 영어로 간단한 지시문을 입력하면 됩니다. AI가 이 지시문을 참고해, 새로 들어오는 다양한 레이아웃의 문서에서도 올바른 값을 추출합니다. 직접 모델을 학습시키거나 코드를 작성할 필요가 없습니다.

아닙니다. Vision AI와 Text AI 모두 영어 지시문으로 작동하며 템플릿이 필요하지 않습니다. 시스템 발송 양식처럼 매번 완전히 동일한 결과를 보장해야 하는 고정 레이아웃의 경우에만 템플릿을 선택적으로 사용할 수 있습니다.

네. 스캔본, 휴대폰 사진, 이미지 전용 PDF에는 OCR을 자동 실행해 파싱 엔진에 텍스트 레이어를 제공합니다. 이미 기본 텍스트 레이어가 있는 문서는 OCR 단계를 건너뜁니다.

OCR은 필기를 포함해 200개 이상의 언어를 지원합니다. AI 엔진은 모든 주요 언어로 된 문서를 이해하며, 국가별 날짜 및 숫자 포맷도 문서 맥락에서 자동으로 인식합니다.

네. Vision AI와 Text AI는 공급사별 템플릿 없이도 레이아웃 변화에 자동으로 적응합니다. 하나의 메일함에서 다양한 발신자의 각기 다른 형식의 청구서나 영수증을 문제없이 처리할 수 있습니다.

가입 후 메일함을 만들고 샘플 PDF를 업로드하세요. 처음 업로드하면 Parseur가 추출할 필드를 자동으로 식별합니다. 이후 언제든 필드와 영어 지시문을 수정할 수 있습니다. 각 문서에 맞는 파싱 엔진이 자동 선택되며, 파싱된 데이터는 Google Sheets, CRM, 데이터베이스 또는 커스텀 엔드포인트 등으로 코드 작성 없이 보낼 수 있습니다.