Gegevensnormalisatie en validatie
Dezelfde structuur, schone data uit elk document
Van mailbox-schema's tot nabewerking, elke geëxtraheerde waarde landt schoon, gevalideerd en klaar voor downstream-systemen.
Wat je krijgt
Schema per mailbox
Een consistent schema is wat downstream-integraties en automatiseringen echt betrouwbaar maakt. Definieer je velden één keer en elk document dat de mailbox verwerkt, mapt naar exact dezelfde structuur.
- Standaardvelden voor losse waarden, tabelvelden voor herhalende data
- Vertel de AI in normaal Nederlands wat per veld nodig is
- Pas velden op elk moment aan via de UI of de API
Formaten per veld
Ingebouwde formaten normaliseren datums, getallen, adressen en meer. Het juiste format wordt afgeleid uit de context van het document, met de mailbox-standaard als fallback.
- Leest datums in elke volgorde, scheiding of taal
- Begrijpt elk decimaal- of duizendtalteken in regionale getalformaten
- Lokaliseert adressen en splitst ze automatisch in gestructureerde onderdelen
Gegevensvalidatie
Automatische gegevensvalidatie toetst elke geëxtraheerde waarde aan het mailbox-schema. Fouten verschijnen direct in de UI, sturen een e-mail en triggeren een webhook, zodat zowel ops-teams als tools direct op de hoogte zijn.
- Schema-check toetst of het AI-resultaat past bij het veldformaat
- Verplichte-veldcheck signaleert missende waarden bij de bron
- Keuzevelden markeren waarden buiten de toegestane lijst
Nabewerkingsregels
Heb je meer nodig dan standaard formats en validatie? Voeg een kort Python-script toe. Regels draaien na extractie om velden te herstructureren of je eigen bedrijfslogica toe te passen.
- Combineer, splits of bereken nieuwe velden uit de extractie
- Pas bedrijfslogica toe, raadpleeg lookups, of voer conditionele transformaties uit
- Beschikbaar vanaf het Pro-abonnement
Hoe gegevensnormalisatie werkt
Wat er net gebeurde
AI-documentextractie en parsing
Vision AI, Text AI, templates of OCR hebben gestructureerde velden uit elk document gehaald.
Mappen naar schema
Geëxtraheerde waarden landen in de vaste set velden die je voor de mailbox hebt gedefinieerd. Elk document, ongeacht de lay-out, komt er met dezelfde kolomstructuur uit.
Formatteren
Elk veld loopt door het ingestelde format. Datums en getallen worden genormaliseerd over regionale verschillen heen, op basis van de context van het document. Namen worden gesplitst in voornaam, tussenvoegsel en achternaam. Adressen worden uitgesplitst in gestructureerde onderdelen.
Valideren
Elk resultaat gaat door een validatiecheck voordat het doorstroomt. Documenten die slagen gaan door naar nabewerking, de rest wordt gemarkeerd, zodat er nooit iets onopgemerkt Parseur verlaat.
Nabewerken
Optionele Python-regels draaien als laatste stap, zodat je bedrijfslogica kunt toevoegen die met veldformaten alleen niet lukt. Combineer velden, raadpleeg referentiedata, of pas de output aan op het exacte contract van jouw downstream-systeem.
Wat er daarna gebeurt
Realtime export en integraties
Genormaliseerde data wordt direct geleverd aan je CRM, boekhoudsysteem of database.