En mappe med scannede PDF'er er ubrugelig, indtil nogen taster det hele ind i et regneark. Denne kører hele bunken gennem OCR og struktureret ekstrahering til én samlet CSV.
En mappe med scannede PDF'er er ubrugelig, indtil nogen taster det hele ind i et regneark. Denne kører hele bunken gennem OCR og struktureret ekstrahering til én samlet CSV.
Den læser hver fil, mapper den til din kolonneskabelon, validerer formaterne og samler resultaterne i én ren CSV. Filer, der fejler, listes separat, så intet går tabt.
Sådan kører den
Used at step 01 to kick off the pipeline.
Write
Used at step 01 to kick off the pipeline.
WebFetch
Used at step 01 to kick off the pipeline.
WebSearch
Used at step 01 to kick off the pipeline.
Anvend dit felt-skabelon, så hvert dokument kortlægges til de samme kolonner.
pending
Valider typer og formater, f.eks. datoer og valuta, før en række accepteres.
pending
Tilføj de strukturerede rækker til én CSV-fil og opstil en liste over filer, der fejlede under ekstraktionen.
pending
Eksempel på output
json
// Sample output
// (generated when the pipeline finishes)
Extract the template fields from each document into a consistent CSV row; output null where a field is absent.
Unlock the rest
The full agent definition, install snippet, and starter task are gated for community members.
Members get the full `.md` agent file, the npm / pnpm install one-liners, a starter prompt that we've tuned against real runs, and the open-source repo when this automation ships there. One email, magic link, done.