Un folder de PDF-uri scanate e inutil până când cineva le transcrie într-un tabel. Automatizarea asta procesează tot lotul prin OCR și extragere structurată într-un singur CSV.
Un folder de PDF-uri scanate e inutil până când cineva le transcrie într-un tabel. Automatizarea asta procesează tot lotul prin OCR și extragere structurată într-un singur CSV.
Citește fiecare fișier, îl mapează pe șablonul tău de coloane, validează formatele și grupează rezultatele într-un singur CSV curat. Fișierele eșuate sunt listate separat, ca să nu se piardă nimic.
Cum funcționează
Used at step 01 to kick off the pipeline.
Write
Used at step 01 to kick off the pipeline.
WebFetch
Used at step 01 to kick off the pipeline.
WebSearch
Used at step 01 to kick off the pipeline.
Aplică șablonul tău de câmpuri astfel încât fiecare document să fie mapat către același set de coloane.
pending
Validează tipurile și formatele, cum ar fi datele și moneda, înainte de a accepta un rând.
pending
Adaugă rândurile structurate într-un singur CSV și listează fișierele care au eșuat la extragere.
pending
Exemplu de output
json
// Sample output
// (generated when the pipeline finishes)
Extract the template fields from each document into a consistent CSV row; output null where a field is absent.
Unlock the rest
The full agent definition, install snippet, and starter task are gated for community members.
Members get the full `.md` agent file, the npm / pnpm install one-liners, a starter prompt that we've tuned against real runs, and the open-source repo when this automation ships there. One email, magic link, done.