Automatyzacja w praktyce
OCR, AI czy KSeF? Jak dziś odczytywać dokumenty w firmie
Automatyczny odczyt dokumentów to dziś jedno z najczęstszych pytań, jakie dostaję. Odpowiedź zależy od tego, skąd dokument przychodzi. Czasem AI nie jest potrzebne wcale.
W skrócie: zanim zaczniesz odczytywać dokumenty, sprawdź, czy dane nie są już dostępne u źródła, np. w KSeF albo w eksporcie z banku. Do dokumentów w stałym układzie wystarczy OCR z szablonem, a do różnych, takich jak faktury zagraniczne czy maile, potrzebny jest model językowy. W każdym przypadku odczyt musi przejść przez reguły sprawdzające, a niepewne dokumenty trafiają do człowieka.
Trzy rodzaje dokumentów
| Dokument | Przykłady | Czym odczytywać |
|---|---|---|
| Ustrukturyzowany | faktury z KSeF, wyciągi bankowe, pliki XML i CSV z systemów | Nie trzeba go „odczytywać”: dane są już w polach |
| Powtarzalny skan lub PDF | formularze, dokumenty z jednego źródła w stałym układzie | OCR z szablonem pól |
| Nieustrukturyzowany | maile, faktury zagraniczne, umowy, dokumenty w różnych układach | OCR i model językowy (AI) z walidacją |
Najpierw sprawdź, czy dane nie są już dostępne
Od 2026 r. faktury od polskich firm przychodzą przez KSeF w ustrukturyzowanym formacie. Wyciągi bankowe można pobierać w formatach, które programy księgowe czytają bez OCR. Zanim zaczniesz odczytywać PDF, sprawdź, czy te same dane nie są dostępne u źródła. To najtańszy i najpewniejszy odczyt.
OCR: gdy układ jest przewidywalny
Klasyczny OCR zamienia obraz na tekst, a szablon mówi, gdzie szukać numeru, daty czy kwoty. Działa dobrze, gdy dokumenty z jednego źródła wyglądają tak samo. Słabiej, gdy układ się zmienia, bo każdy nowy wzór trzeba dopisać.
AI: gdy dokumenty są różne
Model językowy rozumie treść, a nie tylko położenie pól. Poradzi sobie z fakturą zagraniczną, której układu wcześniej nie widział, albo z mailem, w którym klient opisuje zamówienie własnymi słowami. Ale AI potrafi się pomylić, i to w sposób, który wygląda wiarygodnie.
Najważniejsza jest kontrola jakości
Niezależnie od metody odczyt musi przejść przez reguły, zanim trafi do systemu:
- Czy suma pozycji zgadza się z kwotą do zapłaty i czy VAT jest policzony poprawnie.
- Czy NIP ma poprawną sumę kontrolną i czy kontrahent jest w bazie.
- Czy data i numer dokumentu nie powtarzają się z wcześniej zapisanym dokumentem.
- Czy model jest wystarczająco pewny odczytu. Jeśli nie, dokument trafia do człowieka.
Dobrze zaprojektowany proces nie zakłada, że odczyt jest bezbłędny. Zakłada, że błędy zostaną wyłapane, zanim ktoś na nich oprze decyzję.
W jednym z moich projektów odczyt dokumentów wykonuje zewnętrzny dostawca OCR. Zbudowałem dla niego API: kolejkę plików do pobrania i zapis odczytanych danych z powrotem do sprawy, gdzie przechodzą dalszą weryfikację. Więcej w realizacjach.
Koszty i dane
OCR i modele AI zwykle rozlicza się za stronę albo za ilość przetworzonego tekstu. Przy tysiącach dokumentów miesięcznie ten koszt trzeba policzyć przed wdrożeniem, obok czasu, który rozwiązanie oszczędza. Trzeba też ustalić, gdzie dokumenty są przetwarzane: dane osobowe i dane klientów wymagają dostawcy, który daje odpowiednie gwarancje, a często przetwarzania na terenie UE.
Jak wybrać
- Podziel dokumenty według źródła i układu.
- Tam, gdzie dane są dostępne u źródła (KSeF, systemy, banki), pobieraj je bezpośrednio.
- Dla stałych układów użyj OCR z szablonem, dla różnych: AI.
- Dla wszystkich zaprojektuj walidację i ścieżkę do człowieka.
Ile czasu zajmuje dziś ręczne przepisywanie dokumentów w Twojej firmie? Sprawdź to w kalkulatorze.
Czytaj też
- KSeF w biurze rachunkowym: co jeszcze warto zautomatyzować
- n8n, Make czy własne rozwiązanie? Jak wybrać narzędzie do automatyzacji
Zacznijmy od rozmowy
Pokaż mi dokumenty, które dziś przepisujecie.
7 krótkich pytań, około 2 minut. Odezwę się w ciągu 1 dnia roboczego.
