Normalizacja i walidacja danych
Spójna struktura i czyste dane z każdego dokumentu
Od schematów skrzynek po post-processing — każda wyodrębniona wartość trafia do systemów docelowych czysta, zwalidowana i gotowa do użycia.
Co jest w zestawie
Schematy na poziomie skrzynki
Spójny schemat to coś, co sprawia, że integracje i automatyzacje są naprawdę niezawodne. Zdefiniuj swoje pola raz, a każdy dokument przetwarzany przez skrzynkę dopasuje się do tej samej struktury.
- Standardowe pola dla pojedynczych wartości, pola tabeli dla powtarzających się danych
- Instrukcje w języku naturalnym mówią AI, co wyodrębnić dla każdego pola
- Edytuj pola w dowolnym momencie przez interfejs (UI) lub programowo przez API
Formatowanie na poziomie pola
Wbudowane formaty normalizują daty, liczby, adresy i wiele innych. Właściwy format jest wnioskowany z kontekstu dokumentu, a ustawienia domyślne skrzynki działają jako zabezpieczenie.
- Daty są rozpoznawane niezależnie od kolejności, separatora lub nazwy miesiąca w różnych językach
- Liczby rozpoznają dowolny separator dziesiętny/tysięczny w różnych formatach regionalnych
- Pola adresowe geolokalizują i dzielą adresy na ustrukturyzowane części
Walidacja danych
Automatyczna walidacja danych sprawdza każdy wyodrębniony wynik ze schematem skrzynki. Błędy pojawiają się w interfejsie użytkownika, wyzwalają powiadomienie e-mail i uruchamiają webhook, dzięki czemu dowiadują się o nich zarówno zespoły operacyjne, jak i narzędzia.
- Kontrola schematu potwierdza, że wynik AI pasuje do kształtu pola
- Kontrola pól wymaganych wychwytuje brakujące wartości u źródła
- Kontrola pól wyboru oznacza wartości spoza dozwolonej listy
Reguły post-processingu
Gdy standardowe formatowanie i walidacja nie wystarczą, dopisz krótki skrypt w Pythonie. Reguły uruchamiają się po ekstrakcji, aby przekształcić wartości lub przeprowadzić niestandardową walidację względem Twojej logiki biznesowej.
- Łącz, dziel lub wyliczaj nowe pola z wyodrębnionych wartości
- Stosuj logikę biznesową, wyszukiwania lub przekształcenia warunkowe
- Dostępne w planie Pro i wyższych
Jak działa normalizacja danych
Co właśnie się wydarzyło
Ekstrakcja i parsowanie dokumentów przez AI
Vision AI, Text AI, szablony lub OCR wyodrębniły ustrukturyzowane pola z każdego dokumentu.
Mapowanie do schematu
Wyekstrahowane wartości zostają przyporządkowane do stałego zestawu pól zdefiniowanego dla skrzynki. Każdy dokument, bez względu na układ źródłowy, kończy z takim samym układem kolumn na wyjściu.
Formatowanie
Każde pole przechodzi przez skonfigurowany format. Daty i liczby normalizują się w oparciu o regionalne różnice wykorzystując kontekst dokumentu, imiona dzielą się na imię/drugie imię/nazwisko, a adresy są parsowane na ustrukturyzowane części.
Walidacja
Każdy wynik przechodzi kontrole walidacji przed przejściem dalej. Dokumenty, które je przejdą, trafiają do post-processingu, a reszta jest oznaczana, dzięki czemu nic nie umknie uwadze w Parseur.
Post-processing
Opcjonalne reguły w Pythonie uruchamiane są na końcu, stosując logikę biznesową, której nie da się wyrazić poprzez formatowanie na poziomie pola. Łącz pola, wyszukuj dane referencyjne lub kształtuj wynik tak, aby dokładnie pasował do docelowego schematu.
Co dzieje się dalej
Eksporty i integracje w czasie rzeczywistym
Znormalizowane dane dostarczane są do Twojego CRM, systemu księgowego lub bazy danych w czasie rzeczywistym.