Najważniejsze wnioski
- OCR rachunków za media to automatyczne przechwytywanie ustrukturyzowanych danych z rachunków za prąd, gaz, wodę i telekomunikację za pomocą optycznego rozpoznawania znaków w połączeniu ze sztuczną inteligencją, co zwraca nazwane pola zamiast surowego tekstu.
- Pola, które mają znaczenie, to nie te z klasycznej faktury. Numer licznika, odczyty licznika, zużycie wraz z jednostką, zapotrzebowanie w kW, taryfa i podział między opłatami za dostawę a opłatami za przesył, to coś co odróżnia OCR rachunków za media od standardowego OCR faktur.
- Każde z mediów zachowuje się inaczej. Elektryczność uwzględnia zapotrzebowanie i czas użytkowania, gaz zawiera termy lub CCF i wartość opałową, woda zawiera odczyty liczników i opłaty za kanalizację, telekomunikacja to najczęściej powtarzająca się tabela poszczególnych linii/numerów.
- Ręczne wprowadzanie danych zajmuje od 8 do 12 minut i kosztuje od 1 do 3 USD za rachunek, przy wskaźniku błędu na poziomie 1 do 5%. Przy kilku tysiącach rachunków miesięcznie daje to pełen etat, którego nikt nie chciał.
- Ekstrakcja danych AI bez użycia szablonów bez problemu radzi sobie z nowymi dostawcami i przeprojektowanymi układami bez jakiejkolwiek konfiguracji, co jest głównym problemem w skali całego portfela.
Czym jest OCR rachunków za media?
OCR rachunków za media to automatyczne przechwytywanie ustrukturyzowanych danych z rachunku za prąd, gaz, wodę lub usługi telekomunikacyjne za pomocą optycznego rozpoznawania znaków w połączeniu ze sztuczną inteligencją w celu zwrócenia nazwanych pól zamiast strony z luźnym tekstem. Zwykły OCR czyta stronę i zwraca tekst. OCR ze sztuczną inteligencją czyta stronę i zwraca zdefiniowane pola, co ma kluczowe znaczenie, ponieważ żaden system księgowy nigdy nie potrzebował jedynie „ściany” tekstu.
Rachunki przychodzą jako pliki PDF, skany i załączniki do e-maili, a żadnych dwóch dostawców nie zgadza się co do tego, gdzie powinno znajdować się dane pole. Jeden drukuje stan licznika na pasku bocznym. Następny ukrywa to w tabeli na trzeciej stronie. Trzeci dzieli koszty dostawy i przesyłu na dwie strony i uważa to za uprzejmość. Człowiek przyswaja to wszystko w około sekundę. Szablon w takich sytuacjach po prostu nie daje rady.
Przy jednym rachunku miesięcznie, żadna z tych rzeczy nie ma znaczenia. Ale przy czterystu lokalizacjach, jest to już rurociąg danych z człowiekiem uwięzionym w samym jego środku.
Jakie pola można wyodrębnić z rachunku za media?
Wszystkie. Lepszym pytaniem jest to, o które z nich prosić, ponieważ pola, które czynią rachunek za media właśnie rachunkiem za media, nigdy nie pojawiają się na zwykłej fakturze.
| Group | Fields |
|---|---|
| Konto i usługa | Numer konta, nazwa klienta lub posiadacza konta, adres świadczenia usługi, adres rozliczeniowy, dostawca mediów, numer licznika lub identyfikator urządzenia |
| Okres rozliczeniowy | Data wystawienia rachunku, termin płatności, okres świadczenia usługi od i do, numer faktury lub zestawienia, poprzednie saldo, bieżące opłaty |
| Zużycie i opłaty | Bieżące i poprzednie wskazanie licznika, data odczytu, zużycie wraz z jednostką (kWh, termy, CCF, galony, MMBtu), zapotrzebowanie w kW, stawka jednostkowa, taryfa lub plan taryfowy, koszty dostawy kontra koszty przesyłu, opisy poszczególnych pozycji, podatki, opłaty i dopłaty, kredyty i wyrównania |
| Płatność | Całkowita kwota do zapłaty, metody płatności, opłaty za opóźnienia, numery referencyjne |
W wierszu trzecim kryją się pieniądze. Numer konta i łączna kwota mówią działowi zobowiązań, ile zapłacić. Odczyt licznika, zużycie, zapotrzebowanie i taryfa informują dział operacyjny o tym, czy rachunek był poprawny w pierwszej kolejności, która z lokalizacji odchyla się od normy i o czym za chwilę poinformuje raport ESG. Typowe narzędzie do faktur czyta dwa pierwsze wiersze i na tym kończy. Parser rachunków za media działa dalej.

Energia elektryczna, gaz, woda i telekomunikacja to cztery różne problemy
Traktowanie wszystkich czterech w ten sam sposób to najczęstszy powód, dla którego projekt parsowania rachunków za media kończy się jako tylko w połowie użyteczny. Wspólne pola są po prostu wspólne. Te interesujące już nie.
Prąd. Zużycie w kWh, plus wartość szczytowego zapotrzebowania w kW, która często kosztuje więcej niż sama energia. Taryfy uwzględniające czas użytkowania dzielą zużycie na szczytowe, pozaszczytowe i pośrednie. Na uwolnionych rynkach opłata za dostawę i opłata za przesył pochodzą od dwóch różnych firm na jednym kawałku papieru i tylko jedna z nich podlega negocjacjom.
Gaz. Objętość w termach, CCF lub MMBtu w zależności od regionu, zwykle ze współczynnikiem konwersji wydrukowanym gdzieś na rachunku, którego potrzebujesz, jeśli raportujesz w jednostkach energii. Wahania sezonowe są na tyle duże, że porównanie rok do roku jest jedynym, które daje jakikolwiek miarodajny obraz.
Woda. Odczyty liczników wykonują tu większość pracy. Opłaty za kanalizację są często obliczane na podstawie zużycia wody, a nie rzeczywistych pomiarów, a woda na potrzeby nawadniania jest czasami opomiarowana osobno. Nagły skok zużycia oznacza wyciek, a znalezienie go w danych jest o wiele łatwiejsze niż znalezienie go w ziemi.
Telekomunikacja. W rzeczywistości to nie jest jeden rachunek. To tabela z liniami, numerami lub obwodami, z których każdy ma przypisaną opłatę za plan, zużycie, przekroczenie limitów i podatki. Jeśli spłaszczysz to do jednej całkowitej kwoty, pozbędziesz się jedynych danych, które mogłyby ci wskazać dwanaście telefonów, których nikt nie używa od 2024 roku.
Ile w rzeczywistości kosztuje wprowadzanie danych z rachunków za media
To nigdy nie pojawia się jako osobna pozycja w budżecie, i właśnie dlatego ten proces przetrwał. Oto, co mówią na ten temat badania:
- Czas na rachunek: od 8 do 12 minut ręcznego wpisywania danych, w zależności od złożoności, według Resolve. Szerszy obieg faktur, w którym się to odbywa, trwa znacznie dłużej.
- Koszt na rachunek: Od 1 do 3 USD w bezpośrednich kosztach pracy przy prostym wprowadzaniu danych, jak podaje ERP Software Blog. Po dodaniu zatwierdzeń, weryfikacji dopasowania i wyjątków, koszt ten tylko rośnie.
- Wskaźniki błędów: zazwyczaj od 1 do 5% w ustrukturyzowanych wpisach, i jeszcze wyższe na skomplikowanych, wielopolowych dokumentach, według Fluxygen. Kilka procent twoich danych bilingowych jest cichutko błędnych, a żaden ręczny proces nie został zaprojektowany po to, aby te błędy wychwycić.
- Co zmienia automatyzacja: Do blisko 80% oszczędności czasu w porównaniu z metodami ręcznymi we wszystkich przepływach pracy dotyczących faktur i rachunków, jak donosi Ramp.
- Dokładność, jakiej możesz oczekiwać: Gartner informuje o 90 do 99% dokładności ekstrakcji w przypadku parsowania dokumentów, w zależności od jakości dokumentu i tego, czy zastosowano krok ręcznej weryfikacji.
Jeśli odniesiesz te liczby do 3000 rachunków miesięcznie, matematyka szybko staje się niewygodna. Od 400 do 600 godzin ręcznego wpisywania danych, co oznacza zatrudnienie dwóch osób, które mogłyby robić w tym czasie coś zupełnie innego. Oraz od 30 do 150 rachunków miesięcznie z błędem, który wypływa dopiero na koniec kwartału, o ile w ogóle wypłynie.
Dlaczego rachunki za media są trudniejsze niż faktury

Cztery rzeczy odróżniają rachunek za media od faktury od dostawcy. Każdy dostawca projektuje swój własny rachunek, a potem go przeprojektowuje, więc cztery rodzaje mediów od dziesiątek dostawców to cel, który porusza się w nieskoordynowany sposób. Duża część tych rachunków dociera do nas jako zdjęcie zrobione telefonem, pod złym kątem i przy słabym oświetleniu, co sprawia, że są to dane niestrukturalne w najmniej sprzyjającej formie – i dokładnie w tym miejscu parsowanie oparte na szablonach poddaje się i załamuje ręce.
Do tego dochodzi to, do czego te liczby są wykorzystywane. Rachunek za media służy również jako potwierdzenie adresu i dokument używany w raportach podatkowych i ESG, co oznacza, że błędne liczby idą w świat. A przy kilku tysiącach rachunków miesięcznie, 2% wskaźnik błędów to nie jest jakaś mała różnica przy zaokrągleniach. To powtarzający się co miesiąc incydent.
Jak wyodrębnić dane z rachunków za media bez ani jednego szablonu
Parseur to nieszablonowy parser AI zbudowany z myślą o ekstrakcji danych z dokumentów na dużą skalę. Rachunki trafiają do dedykowanej skrzynki pocztowej, przez API, lub z obserwowanego folderu. Silnik Vision AI odczytuje pliki PDF, skany i zdjęcia. Silnik Text AI czyta rachunki e-mailowe i tekstowe. Oba są wstępnie przeszkolone, więc dostawca, którego nigdy wcześniej nie przetwarzałeś, nie wymaga od Ciebie absolutnie żadnej konfiguracji.
Wyświetlasz żądane pola tylko raz. Następnie każdy rachunek jest do nich mapowany, bez względu na to, w jakim układzie się pojawi.
- Brak szablonów. Przeprojektowany układ rachunku niczego nie psuje, ponieważ po prostu nie było żadnego układu, który mógłby się zepsuć.
- Dowolny rodzaj mediów. Elektryczność, gaz, woda, telekomunikacja i cokolwiek innego, co tylko znalazło się w firmowym portfolio po drodze.
- Tabele pozostają tabelami. Opłaty telekomunikacyjne za poszczególne pozycje wyciągane są w postaci wierszy, które można łatwo przypisywać do odpowiednich kont kosztowych, a nie jako jedna, spłaszczona suma.
Działa z tysiącami rachunków dziennie, analizowanymi od razu po przybyciu. Jest zgodny z wymogami RODO, co nie jest wcale małym szczegółem, gdy weźmie się pod uwagę, że każdy przesyłany dokument zawiera czyjeś nazwisko, adres domowy i numer konta.
To wszystko nie jest jednak prawdziwym testem. Testem jest Twoja własna poczta. Weź najgorszy z rachunków ze swojego folderu – pomięty skan od dostawcy, który zmienił swój układ w marcu, i przepuść go w pierwszej kolejności. Każde z narzędzi na Twojej liście świetnie prezentuje się na wersji demo z czystym PDF-em.
Czy muszę trenować model AI?
Nie. Żadnych zestawów treningowych, żadnych folderów z oznaczonymi przykładowymi rachunkami, żadnych weekendów spędzonych na uczeniu oprogramowania, jak wygląda odczyt licznika.
Parseur to silnik do wyodrębniania danych przez AI, który jest od samego początku odpowiednio wytrenowany, a dodanie setnego dostawcy wymaga dokładnie tyle samo pracy co dodanie pierwszego, czyli zerowej.
Utwórz skrzynkę pocztową, skieruj do niej rachunki, a silnik AI automatycznie przekonwertuje nieuporządkowany dokument w dane ustrukturyzowane od razu po jego odebraniu.
Gdzie trafiają wyodrębnione pola
Wszędzie tam, gdzie ich potrzebujesz. Do programu Excel i Arkuszy Google w celu analizy, do systemów księgowych i ERP w celu zapłaty, do platform energetycznych i raportowania ESG, a także do wszystkich innych, używając Zapier, Make, n8n lub zwykłego webhooka. Każdy z rachunków dostarczany jest natychmiast po tym jak zostanie sparsowany, dzięki czemu nic nie musi czekać na comiesięczny eksport bazy.
Aby zapoznać się z pełnym przepływem pracy, zobacz artykuł o wyodrębnianiu danych z rachunków za media z użyciem sztucznej inteligencji lub też zapoznaj się ze stroną dotyczącą rozwiązania do wyodrębniania danych z rachunków za media, aby dowiedzieć się, jak wygląda to w skali całego portfela.
Twój miesięczny wolumen rachunków i tak już dużo Cię kosztuje. Jedyne pytanie brzmi: czy ten wydatek przynosi gdziekolwiek jakieś wymierne rezultaty?
Przeanalizuj swój miesięczny wolumen w naszym symulatorze kosztów
Ostatnia aktualizacja




