마스터 데이터는 고객, 제품, 공급업체, 직원, 위치, 계정 등 기업이 운영되는 기반 엔터티를 식별하는 핵심적이고 천천히 변하는 비즈니스 정보입니다. 이는 모든 거래가 가리키는 '누구'와 '무엇'이며, 한 번 정의된 후 이를 필요로 하는 모든 시스템에서 공유됩니다.
핵심 요약
- 마스터 데이터는 엔터티를 설명하고, 거래 데이터는 이벤트를 설명합니다. 주문은 나타났다가 사라지지만, 모든 주문은 변하지 않는 고객 기록을 가리킵니다.
- 잘못된 마스터 데이터는 단순한 리포팅 불편함이 아닙니다. 중복 결제, 폐쇄된 주소로의 배송, 감사 실패로 이어집니다.
- 거의 모든 데이터는 문서에서 시작됩니다. Parseur는 해당 문서에서 필드를 자동으로 추출하므로 공급업체 온보딩 양식을 수기로 ERP에 다시 입력할 필요가 없습니다.
검색창에 '마스터 데이터 의미'를 입력하면 위 단락과 비슷한 8가지 버전을 얻게 됩니다. 모든 마스터 데이터 정의는 같은 결론에 도달합니다. 하지만 거의 모든 곳에서 다루지 않는 것은 데이터가 마스터 데이터가 되기 전에 어디서 오는지에 대한 부분이며, 바로 그 부분이 누군가의 오후 시간을 잡아먹는 일입니다. 먼저 정의를 빠르게 살펴보겠습니다. 그 다음, 서명된 계약서와 스캔된 온보딩 양식이 ERP의 깔끔한 기록으로 변하는 번거로운 과정을 알아보겠습니다.
그렇다면, 마스터 데이터란 정확히 무엇인가요?
마스터 데이터는 다른 모든 기록이 가리키는 계층입니다. ERP는 Acme Components LLC를 1,000번 저장하지 않습니다. 한 번 저장하면, 1,000개의 인보이스가 그 하나의 기록을 가리킵니다. 모든 시스템이 해당 기록에 동의할 때 여러분은 **단일 진실의 원천(single source of truth)**을 갖게 되며, 각 엔터티에 대해 조립되고 가장 잘 알려진 버전을 마스터 데이터 관리에서는 **골든 레코드(golden record)**라고 부릅니다.
마스터 데이터를 구분하는 것은 중요성이 아니라 속도입니다. 고객의 법적 이름은 10년에 한 번 바뀔 수 있습니다. 그러나 그들의 주문 내역은 매주 바뀝니다. 그 차이가 핵심이며, 8곳이 아닌 단 한 곳에서 마스터 데이터를 정의할 가치가 있는 이유입니다.
Fortune Business Insights에 따르면, 글로벌 마스터 데이터 관리 시장은 2026년 217억 달러에서 2034년 727억 7천만 달러로 성장할 전망이며, 연평균 성장률(CAGR)은 16.30%에 달합니다.
주요 마스터 데이터 도메인
마스터 데이터는 도메인으로 그룹화되며, 각 도메인은 한 가지 유형의 엔터티를 설명하고 고유한 소유자, 속성, 규칙을 갖습니다. 도메인은 6개의 시스템에서 서로 다르게 대답하는 대신, "이 공급업체는 누구인가"라는 질문에 한 곳에서 답할 수 있게 해줍니다.

가장 일반적인 도메인, 주로 위치하는 시스템, 그리고 포함하는 필드입니다.
| 도메인 | 정의 | 주요 소스 시스템 | 주요 필드 |
|---|---|---|---|
| 고객(Customer) | 제품이나 서비스를 구매하거나 이용하는 개인 또는 조직에 대한 정보 | CRM, 청구, 지원 | 고객 ID, 회사명 |
| 제품(Product) | 판매되는 상품 또는 서비스를 설명하는 핵심 데이터 | ERP, PIM, 이커머스 | 제품명, SKU |
| 공급업체/벤더(Supplier) | 자재나 서비스를 제공하는 외부 공급자에 대한 데이터 | ERP, 조달, AP | 공급업체 ID, 결제 조건 |
| 직원(Employee) | 내부 직원 및 조직 내 역할에 대한 세부 정보 | HRIS, 급여, Active Directory | 직원 ID, 부서 |
| 위치(Location) | 비즈니스 운영에 사용되는 실제 또는 가상 사이트에 대한 정보 | ERP, 시설, GIS | 주소, 사이트 코드 |
| 계정(차변표)(Account) | 재무 거래를 체계화하는 데 사용되는 구조 | ERP, 회계, 재무 시스템 | 계정 코드, 비용 센터 |
| 자산(Asset) | 소유 또는 임대한 장비, 소프트웨어, 인프라의 기록 | 자산 관리, ERP | 자산 ID, 상태 |
| 계약(Contract) | 고객, 공급사 또는 파트너와의 관계를 정의하는 약정 | CLM, ERP, CRM | 계약 ID, 발효일 |
각 도메인에 단일 소유자와 규칙을 부여하면 중복이 발생하지 않고, 정확성이 유지되며, 분석가가 매 분기마다 처음부터 고객 목록을 다시 작성할 필요가 없습니다.
마스터 데이터 vs 거래 데이터 vs 참조 데이터
차이점은 인보이스 하나로 가장 쉽게 알 수 있습니다.
Acme Components에서 9월 30일 만기로 $18,750의 인보이스가 도착합니다. 이 인보이스는 한 번 일어난 일을 설명하는 **거래 데이터(transactional data)**입니다. 그 이면에 있는 공급업체인 Acme Components LLC와 세금 ID, 송금 주소, Net 45 결제 조건, 승인된 구매 범주는 **마스터 데이터(master data)**입니다. 이는 존재하는 무언가를 설명하며, 다음 200개의 인보이스는 모두 이를 가리키게 됩니다. 통화 필드에 있는 "USD"는 고정된 목록에서 표준화된 값으로 둘 모두를 분류하는 데 사용되는 **참조 데이터(reference data)**입니다.
마스터 데이터는 변하지 않고 유지됩니다. 거래 데이터는 그 주변에 쌓이며, 참조 데이터는 이 두 가지가 동일한 용어를 사용하도록 유지합니다.

3가지 데이터 유형 비교
| 데이터 유형 | 목적 | 예시 엔터티 | 예시 |
|---|---|---|---|
| 마스터 데이터 | 시스템 전반에서 사용되는 핵심 비즈니스 엔터티 정의 | 고객, 제품, 공급업체 | CRM의 고객 기록 |
| 거래 데이터 | 비즈니스 이벤트 및 활동 기록 | 주문, 인보이스, 배송 | 고객이 주문한 주문 #12345 |
| 참조 데이터 | 일관성을 위해 유효한 값 또는 범주 제공 | 국가 코드, 통화, 단위 | 통화 코드로 사용되는 "USD" |
이 세 가지를 명확히 유지하는 데 많은 돈이 걸려 있습니다. Grand View Research에 따르면, 글로벌 엔터프라이즈 데이터 관리 시장은 2026년 1,373억 달러에서 2033년 3,196억 달러로 성장할 전망이며 연평균 12.8%의 성장이 예상됩니다.
마스터 데이터가 되기 전, 마스터 데이터는 어디서 오는가
용어집에서 건너뛰는 부분은 이렇습니다. 마스터 데이터는 저절로 ERP에 나타나지 않습니다. 서류의 형태로 도착합니다.
새로운 공급업체는 데이터베이스 기록을 보내지 않습니다. 온보딩 양식, W-9, 은행 서신, 서명된 계약서, 보험 증명서, 그리고 운이 좋다면 삐딱하게 찍힌 무효화된 수표(voided check) 사진을 받게 됩니다. 필요한 모든 필드는 그 안에 있습니다. 하지만 그 어느 것도 구조화되어 있지 않기 때문에 누군가 가서 가져와야 합니다.
만약 팀원 두 명이 매일 아침 첫 한 시간 동안 그 문서 더미를 수작업으로 벤더 마스터로 옮기고 있다면, 여러분에게는 아직 마스터 데이터 전략 문제가 있는 것이 아닙니다. 타이핑 문제가 있는 것입니다.
공급업체 마스터 기록 이면의 문서들
| 문서 | 포함하는 마스터 데이터 필드 |
|---|---|
| 공급업체 온보딩 양식 | 법적 이름, 상호명, 주소, 담당자, 결제 방법 |
| W-9 또는 W-8 세금 양식 | 세금 분류, 납세자 식별 번호, 법인명 |
| 은행 서신 또는 무효화된 수표 | 은행명, 라우팅 번호, 계좌 번호 |
| 서명된 계약서 | 결제 조건, 발효일, 종료일, 가격 의무 사항 |
| 보험 증명서 | 보장 유형, 한도액, 만료일 |
| 인보이스 | 송금 주소, VAT 또는 GST 번호, 통화 |
문서는 마스터 데이터가 아닙니다. 마스터 데이터를 구축하는 근거 자료일 뿐입니다.
기록이 실제로 생성되는 방법
문서에서 승인된 마스터 기록에 이르는 경로는 6단계를 거칩니다. 여전히 사람이 직접 처리하는 단계를 유심히 살펴보세요.
- 수신(Intake). 문서는 수신함, 공급업체 포털, 공유 드라이브 또는 스캐너 트레이에 도착합니다.
- 추출(Extraction). 사람이 다시 입력하거나 소프트웨어가 읽는 방식을 통해 문서에서 필드를 추출합니다.
- 검증(Validation). 형식을 확인하고, 필수 필드를 확인하며, 비즈니스 규칙을 적용합니다. 세금 ID가 올바른 형식인지, 승인된 국가인지, 해당 결제 조건이 허용되는지 등을 확인합니다.
- 매칭 및 중복 제거(Matching and deduplication). 기록을 생성하기 전에 기존 기록과 비교합니다. Acme Components LLC, ACME Components, Acme Components, L.L.C.는 3개가 아닌 하나의 공급업체로 통합되어야 합니다.
- 승인(Approval). 조달, 세무, 자금 부서 및 데이터 관리자(data steward)가 각자 담당하는 부분에 승인 서명을 합니다.
- 생성(Creation). 승인된 기록은 기록 시스템에 기록되고 하위 시스템으로 전달됩니다.
3단계부터 6단계는 MDM 플랫폼이 구축된 목적입니다. 2단계는 가장 많은 시간이 소요되는 곳으로, 대부분의 마스터 데이터 프로그램은 여전히 한 화면에는 PDF를, 다른 화면에는 ERP 양식을 띄워놓고 작업하는 사람에게 이 단계를 맡깁니다.
Parseur가 적합한 곳과 그렇지 않은 곳
Parseur는 2단계만을 자동화합니다. MDM 플랫폼이 아니며 그런 척하지도 않습니다.
온보딩 양식, 계약서, 세금 양식, 인보이스를 Parseur 메일함으로 전달하세요. 텍스트 AI가 이메일과 디지털 문서를 읽습니다. 비전 AI는 PDF, 스캔본, 삐딱하게 찍힌 수표 사진을 읽습니다. 사전에 구축해야 할 템플릿도 없습니다.
필드는 구조화된 상태로 반환되며, 검증 규칙이 예상하는 형태로 통합(Integration)이나 API를 통해 ERP, CRM, 스프레드시트 또는 MDM 파이프라인에 안착합니다.
기록은 여전히 해당 업무를 담당하는 담당자와 시스템에 의해 검증, 매칭, 승인됩니다. 단지 맨 처음 단계에서 타이핑을 하지 않을 뿐입니다. 이전에 사용하던 도구가 처음 입력한 스캔 PDF에서 실패했다면, 가치 있는 유일한 테스트는 도입 첫날 가장 상태가 안 좋은 문서를 실행해보는 것뿐입니다. 외상매입금(AP) 부서에서의 실제 작동 예시는 팀이 인보이스 및 공급업체 문서 처리를 자동화하는 방법을 확인해 보세요.
데이터 팀 외부에서 마스터 데이터가 중요한 이유
깨끗한 마스터 데이터는 데이터 팀만의 선호 사항이 아닙니다. 비즈니스의 다른 부서들이 누구의 숫자가 맞는지 논쟁하는 것을 막아주는 요소입니다.
- 고객당 하나의 기록(One record per customer). 동일한 계정에 대해 4개의 버전이 존재한다는 것은 중복된 연락, 중복된 인보이스, 그리고 아무도 맡고 싶어 하지 않는 수정 대기열을 의미합니다. 또한 지원팀이 한 주에 세 번이나 같은 사람에게 누구인지 묻는 일이 사라진다는 뜻이기도 합니다.
- 사람들이 신뢰하는 리포팅(Reporting people believe). 재무, 영업, 운영 부서가 동일한 수치를 도출하므로 월간 회의가 더 이상 숫자 맞추기 시간이 되지 않습니다.
- 지루한 상태로 유지되는 감사(Audits that stay boring). 표준화된 엔터티 데이터는 세금이나 개인정보 보호 요청을 발굴 작업이 아닌 단순한 쿼리 조회로 바꿔줍니다. ISO 8000은 바로 여기서 "충분히 좋은" 상태가 무엇인지 정의하기 위해 존재합니다.
- 자신 있게 틀리지 않는 AI(AI that is not confidently wrong). 모델에 중복 데이터를 입력하면, 보기 좋은 글꼴로 아주 빠르게 똑같이 틀린 결과를 돌려줄 것입니다.
- 비용이 많이 드는 실수의 감소(Fewer expensive mistakes). 하나의 제품 마스터, 일관된 SKU를 통해 트럭에 올바른 물품을 실을 수 있습니다.
이 목표에 도달하는 것은 단순히 플랫폼을 구입하는 것보다, 그렇지 않았다면 결코 완료되지 않았을 품질 검사를 자동화하는 것과 더 관련이 있습니다.
시스템 전반에서의 마스터 데이터 활용 방식
모든 시스템은 각자의 이유로 동일한 기록에 의존합니다. CRM에서 고객 마스터는 연락처 기록이므로, 오래된 데이터를 방치하면 영업 담당자가 2023년에 퇴사한 사람에게 이메일을 보내게 됩니다. ERP에서는 구매, 재고 및 재무 마감이 제품, 공급업체, 계정 마스터에 따라 실행됩니다. 청구 시스템은 고객과 계약 데이터를 읽고 무엇을, 어떤 조건으로 청구할지, 언제 수익을 인식할 수 있을지 결정합니다. 대시보드는 동일한 엔터티를 세고 있을 때만 서로 일치합니다. 그리고 모델을 학습시키는 데이터의 품질이 곧 결과물의 품질이 됩니다.
가장 훌륭한 마스터 데이터를 보유한 팀은 타이핑을 멈췄습니다
마스터 데이터는 기술 스택의 다른 모든 항목이 가리키는 계층입니다. 고객, 제품, 공급업체를 한 번 정의하고 그 정의를 정직하게 유지하면, 리포팅, 규정 준수, 자동화가 모두 동시에 쉬워집니다.
마스터 데이터가 무엇인지 묻는다면 엔터티 목록을 얻게 될 것입니다. 그것이 어디서 왔는지 묻는다면 파일 캐비닛을 마주하게 될 것입니다. 가장 깨끗한 마스터 데이터를 가진 기업은 가장 비싼 MDM 플랫폼을 운영하는 기업이 아닙니다. 그 데이터가 담긴 문서를 다시 수기로 입력하는 일을 멈춘 기업들입니다.
마지막 업데이트



