Folder zeskanowanych PDF-ów jest bezużyteczny, dopóki ktoś nie przepisze go do arkusza. To narzędzie przepuszcza całą partię przez OCR i strukturalną ekstrakcję do jednego pliku CSV.
Folder zeskanowanych PDF-ów jest bezużyteczny, dopóki ktoś nie przepisze go do arkusza. To narzędzie przepuszcza całą partię przez OCR i strukturalną ekstrakcję do jednego pliku CSV.
Czyta każdy plik, mapuje go na Twój szablon kolumn, sprawdza formaty i składa wyniki w jeden czysty plik CSV. Pliki, których nie udało się przetworzyć, trafiają na osobną listę, więc nic nie ginie.
Jak działa
Used at step 01 to kick off the pipeline.
Write
Used at step 01 to kick off the pipeline.
WebFetch
Used at step 01 to kick off the pipeline.
WebSearch
Used at step 01 to kick off the pipeline.
Zastosuj szablon pól, dzięki czemu każdy dokument będzie mapowany na ten sam zestaw kolumn.
pending
Sprawdź typy i formaty, takie jak daty czy waluty, przed zaakceptowaniem wiersza.
pending
Dołącz strukturyzowane wiersze do jednego pliku CSV i wypisz pliki, które nie przeszły ekstrakcji.
pending
Przykładowe wyjście
json
// Sample output
// (generated when the pipeline finishes)
Extract the template fields from each document into a consistent CSV row; output null where a field is absent.
Unlock the rest
The full agent definition, install snippet, and starter task are gated for community members.
Members get the full `.md` agent file, the npm / pnpm install one-liners, a starter prompt that we've tuned against real runs, and the open-source repo when this automation ships there. One email, magic link, done.