영수증과 스캔 서류를 손입력 없이 데이터로 바꾸는 AI OCR 프로그램
Parseur는 스캔한 영수증·세금계산서·PDF를 구조화된 데이터로 변환하는 AI OCR 프로그램입니다. 템플릿도, 수기 입력도 필요 없습니다.
텍스트만이 아니라 데이터를 추출하는 OCR 프로그램
OCR 프로그램은 광학 문자 인식을 사용해 스캔한 문서·PDF·이미지를 편집 가능한 텍스트로 변환합니다. 하지만 기존 OCR은 글자만 뽑아낼 뿐이라, 숫자를 일일이 다시 입력하는 일은 그대로 남습니다. Parseur는 Vision AI와 Text AI로 문서를 읽어, 세금계산서 번호·날짜·금액·명세 같은 항목별 데이터를 스프레드시트·데이터베이스·API로 바로 추출하는 AI OCR 프로그램입니다. 2016년 이후 금융·보험·물류·이커머스 팀을 위해 1억 페이지 이상을 처리해 왔습니다.
모든 문서에 대응하는 OCR
Parseur는 팀에 도착하는 모든 문서의 텍스트를 읽습니다.
-
텍스트 레이어가 있는 PDF
- Parseur는 검색 가능한 PDF의 텍스트 레이어를 직접 읽으므로, 추출이 빠르고 정보 손실이 없습니다.
-
스캔 PDF와 이미지
- 텍스트 레이어가 없는 스캔 PDF·사진·이미지는 Vision AI 엔진이 읽어 텍스트를 인식하고 항목을 추출하며, 내보내기 전에 각 값을 검증합니다.
-
이메일과 텍스트 문서
- Parseur의 Text AI 엔진은 이메일(이미지와 링크가 포함된 HTML 이메일 포함)과 기타 텍스트 문서를, 오류의 원인이 될 수 있는 OCR 단계 없이 직접 읽습니다.
-
스프레드시트와 그 외 형식
- Parseur는 스프레드시트(Excel, CSV), Word 문서, 웹페이지 등 25가지 이상의 형식도 읽습니다. 지원 파일 형식 전체 목록을 확인해 보세요.
200개 이상의 언어 지원
Parseur의 AI OCR은 언어별 데이터셋으로 학습되어, 라틴 문자뿐 아니라 아랍어부터 일본어까지 모든 문자에서 높은 정확도를 유지합니다.
-
200개 이상의 언어 지원
- Parseur는 한국어·영어·스페인어·프랑스어·독일어·네덜란드어·러시아어·일본어·중국어·히브리어·아랍어·힌디어 등 200개 이상의 언어 텍스트를 인식합니다. 날짜와 숫자 형식은 각 문서의 문맥에서 판별됩니다.
-
손글씨 인식
- Parseur는 라틴 문자·일본어·한국어 손글씨를 인식하며, 중국어·그리스 문자·키릴 문자·베트남어 문자도 실험적으로 지원합니다.
텍스트에서 구조화된 데이터로
일반 OCR은 이미지를 텍스트로 변환합니다. Parseur의 AI 엔진은 그 텍스트를 구조화된 데이터로 변환합니다. 항목에는 라벨이 붙고, 표는 행으로 나뉘며, 모든 값이 도구에 도달하기 전에 검증됩니다. 템플릿을 만들 필요도, 수기로 입력할 필요도 없습니다.