Normalizzazione e Validazione dei Dati

Stessa struttura, dati puliti per ogni documento

Dallo schema della casella di posta fino al post-processing, ogni valore estratto arriva pulito, validato e pronto per i sistemi a valle.

Cosa è incluso

Schemi a livello di casella di posta

Uno schema coerente è ciò che rende le integrazioni e le automazioni a valle davvero affidabili. Definisci i tuoi campi una volta sola e ogni documento elaborato dalla casella viene mappato sulla stessa struttura.

  • Campi standard per valori singoli, campi tabella per dati ripetuti
  • Istruzioni in linguaggio naturale dicono all'AI cosa catturare per ogni campo
  • Modifica i campi quando vuoi tramite interfaccia o via programmazione tramite API

Formattazione a livello di campo

I formati integrati normalizzano date, numeri, indirizzi e altro ancora. Il formato corretto viene dedotto dal contesto del documento, con fallback sui valori predefiniti a livello di casella.

  • Le date vengono estratte da qualsiasi ordine, separatore o nome di mese in diverse lingue
  • I numeri vengono letti con qualsiasi separatore decimale/delle migliaia nei vari formati regionali
  • I campi indirizzo geolocalizzano e suddividono gli indirizzi in parti strutturate

Validazione dei dati

La validazione automatizzata dei dati verifica ogni risultato estratto rispetto allo schema della casella di posta. Le anomalie sono evidenziate nell'interfaccia utente, attivano una notifica email e avviano un webhook, in modo che sia i team operativi che gli strumenti ne vengano a conoscenza.

  • Il controllo dello schema conferma che il risultato dell'AI corrisponde alla struttura del campo
  • Il controllo dei campi obbligatori intercetta i valori mancanti alla fonte
  • Il controllo dei campi a scelta segnala i valori al di fuori dell'elenco consentito

Regole di post-processing

Quando la formattazione standard e la validazione non bastano, inserisci un piccolo script Python. Le regole vengono eseguite dopo l'estrazione per rimodellare i valori o eseguire una validazione personalizzata in base alla tua logica aziendale.

  • Combina, suddividi o calcola nuovi campi dai valori estratti
  • Applica logiche aziendali, lookup o trasformazioni condizionali
  • Disponibile nei piani Pro e superiori

Come funziona la normalizzazione dei dati

Cosa è appena successo

Estrazione e Parsing AI dei Documenti

Vision AI, Text AI, template o OCR hanno estratto campi strutturati da ogni documento.

Scopri di più
1

Mappatura allo schema

I valori estratti vengono mappati sull'insieme fisso di campi definiti per la casella di posta. Ogni documento, indipendentemente dal layout di origine, produce un output con la stessa struttura a colonne.

Campi della casella
Testo Fornitore Acme Corp
Testo Fattura n. INV-0142
Data Emessa il 2026-05-07
Numero Totale 2840
Tabella Voci 3 colonne, 2 righe
Voce Q.tà Prezzo Consulting 12 $200 Equipment 2 $220
2

Formattazione

Ogni campo viene elaborato in base al formato configurato. Date e numeri si normalizzano superando le variazioni regionali grazie al contesto del documento, i nomi vengono suddivisi in nome, eventuale secondo nome e cognome, e gli indirizzi vengono analizzati in parti strutturate.

Data May 7, 2026 2026-05-07
Numero $1,234.56 1234.56
Indirizzo 742 Evergreen Ter, Springfield 62704
742 Evergreen Terrace Springfield IL 62704 USA
3

Validazione

Ogni risultato passa attraverso i controlli di validazione prima di procedere. I documenti che li superano passano al post-processing, i restanti vengono segnalati affinché nulla esca da Parseur inosservato.

Validazione
Fornitore Acme Corp
Emessa il 2026-04-15
Totale Obbligatorio mancante
Stato rifiutato
Consentiti: aperto pagato chiuso
4

Post-processing

Le regole Python opzionali vengono eseguite per ultime, applicando logiche aziendali che la formattazione standard non può gestire. Combina campi, cerca dati di riferimento o modella l'output per adattarlo perfettamente ai requisiti del sistema a valle.

post_process.py
def post_process(data):
if data["Totale"] > 1000:
data["Spedizione"] = "express"
else:
data["Spedizione"] = "standard"
return data
Numero Totale 2840
Testo Spedizione express

Cosa succede dopo

Esportazioni e Integrazioni in tempo reale

I dati normalizzati vengono inviati in tempo reale al tuo CRM, sistema contabile o database.

Scopri di più
Inizia ora

Dati puliti, pronti per i tuoi sistemi.

Definisci i campi che ti servono, scegli i formati adatti e osserva ogni estrazione arrivare nella forma corretta.

Piano gratuito incluso, nessuna carta di credito richiesta
Elabora il tuo primo documento in meno di 2 minuti
Disdici quando vuoi, senza vincoli

Domande frequenti

Domande comuni sulla normalizzazione e validazione di Parseur, dal formato di date e numeri alle regole di validazione e al post-processing in Python.

La normalizzazione dei dati è il passaggio che trasforma i valori grezzi estratti in dati puliti e con una struttura coerente. Le date provenienti da documenti diversi arrivano nello stesso formato, i numeri vengono letti correttamente superando le convenzioni regionali, gli indirizzi vengono suddivisi in parti strutturate e ogni campo viene mappato su uno schema fisso, in modo che i sistemi a valle ricevano sempre dati strutturati in modo uniforme.

Senza normalizzazione, ogni documento produrrebbe un output leggermente diverso: date in ordini differenti, numeri con separatori incoerenti, nomi e indirizzi concentrati in un'unica stringa. Gli strumenti a valle finirebbero per scartare le righe o archiviare dati incoerenti. La normalizzazione risolve il problema alla fonte, in modo che le integrazioni rimangano davvero affidabili.

Il campo Numero riconosce qualsiasi separatore decimale e delle migliaia nei vari formati regionali, incluse le convenzioni europee (1.234,56) e americane (1,234.56), i raggruppamenti indiani lakh e crore come 1,00,00,000, e la notazione contabile in cui le parentesi indicano valori negativi come ($123,456,789.12). Il formato corretto viene dedotto dal contesto del documento, con i valori predefiniti a livello di casella come fallback.

Parseur supporta i formati di campo Testo, Data, Ora, Data e Ora, Numero, Nome completo, Indirizzo e Scelta. Ogni formato applica le proprie regole di parsing e validazione; i campi standard raccolgono valori singoli, mentre i campi tabella catturano dati ripetuti riga per riga.

Lo stato del documento viene impostato su Elaborazione fallita anziché essere esportato silenziosamente, e viene inviata una notifica email. Se è configurato un webhook per i processi falliti, viene attivato anche quello. Puoi rivedere e correggere il documento manualmente, oppure collegare le segnalazioni di errore al tuo sistema di monitoraggio.

Ogni casella di posta ha il proprio schema e ogni documento elaborato da quella casella viene mappato sullo stesso insieme fisso di campi. Così una singola casella può acquisire fatture da molti fornitori diversi, con layout molto differenti, restituendo comunque la stessa struttura a colonne per ogni riga.

Definisci i campi che il tuo sistema a valle si aspetta una volta sola, nello schema della casella di posta Parseur, e ogni documento verrà mappato su quella struttura. I formati dei campi standardizzano date, numeri, nomi e indirizzi superando le variazioni regionali, la validazione automatizzata dei dati intercetta i valori mancanti o non validi prima dell'esportazione, e il post-processing opzionale in Python gestisce qualsiasi logica aziendale che i formati standard non riescono a coprire. I dati arrivano ai tuoi sistemi già coerenti, senza bisogno di script di pulizia intermedi.

Il campo Data di Parseur riconosce qualsiasi combinazione di ordine, separatore o nome di mese in diverse lingue, e utilizza il contesto del documento per risolvere valori ambigui come 03/04/2026. L'output viene normalizzato in un formato coerente, in modo che il tuo sistema a valle riceva sempre dati con la stessa struttura.

Sì. Il formato Nome completo separa i nomi in nome, eventuale secondo nome e cognome. Il formato Indirizzo geolocalizza e suddivide gli indirizzi in componenti strutturati. Entrambi vengono eseguiti automaticamente una volta impostato il formato del campo.

Sì. Ogni risultato viene verificato rispetto allo schema della casella di posta: i controlli dei campi obbligatori intercettano i valori mancanti, mentre i controlli dei campi a scelta segnalano i valori al di fuori dell'elenco consentito. Le anomalie vengono mostrate nell'interfaccia utente, inviano una notifica email e attivano un webhook, in modo che sia i team operativi che i tuoi strumenti ne siano informati.

Sì. Le regole di post-processing ti permettono di inserire un piccolo script Python che viene eseguito dopo l'estrazione e la validazione standard. Usalo per combinare, suddividere o calcolare nuovi campi dai valori estratti, applicare logiche aziendali, eseguire lookup o modellare l'output in base alle esatte specifiche del sistema a valle. Disponibile nei piani Pro e superiori.