Ένας φάκελος με σαρωμένα PDF είναι άχρηστος μέχρι κάποιος να τα πληκτρολογήσει σε ένα υπολογιστικό φύλλο. Αυτό περνάει ολόκληρη την παρτίδα από OCR και δομημένη εξαγωγή σε ένα ενιαίο CSV.
Ένας φάκελος με σαρωμένα PDF είναι άχρηστος μέχρι κάποιος να τα πληκτρολογήσει σε ένα υπολογιστικό φύλλο. Αυτό περνάει ολόκληρη την παρτίδα από OCR και δομημένη εξαγωγή σε ένα ενιαίο CSV.
Διαβάζει κάθε αρχείο, το αντιστοιχίζει στο πρότυπο στηλών σας, επικυρώνει τις μορφές και συσσωρεύει τα αποτελέσματα σε ένα καθαρό CSV. Τα αρχεία που απέτυχαν εμφανίζονται ξεχωριστά, ώστε να μην χαθεί τίποτα.
Πώς λειτουργεί
Used at step 01 to kick off the pipeline.
Write
Used at step 01 to kick off the pipeline.
WebFetch
Used at step 01 to kick off the pipeline.
WebSearch
Used at step 01 to kick off the pipeline.
Εφαρμόστε το πρότυπο πεδίων σας ώστε κάθε έγγραφο να αντιστοιχεί στο ίδιο σύνολο στηλών.
pending
Επαληθεύστε τους τύπους και τις μορφές, όπως ημερομηνίες και νομίσματα, πριν αποδεχτείτε μια γραμμή.
pending
Προσθέστε τις δομημένες γραμμές σε ένα ενιαίο CSV και παραθέστε τα αρχεία στα οποία απέτυχε η εξαγωγή.
pending
Δείγμα εξόδου
json
// Sample output
// (generated when the pipeline finishes)
Extract the template fields from each document into a consistent CSV row; output null where a field is absent.
Unlock the rest
The full agent definition, install snippet, and starter task are gated for community members.
Members get the full `.md` agent file, the npm / pnpm install one-liners, a starter prompt that we've tuned against real runs, and the open-source repo when this automation ships there. One email, magic link, done.