Папка зі сканованими PDF ні на що не придатна, доки хтось не перенесе її в таблицю. Ця автоматизація проганяє весь пакет через OCR і структуроване вилучення в єдиний CSV.
Папка зі сканованими PDF ні на що не придатна, доки хтось не перенесе її в таблицю. Ця автоматизація проганяє весь пакет через OCR і структуроване вилучення в єдиний CSV.
Вона читає кожен файл, зіставляє з вашим шаблоном стовпців, перевіряє формати й складає результати в один чистий CSV. Файли з помилками виводяться окремо, тож нічого не загубиться.
Як він працює
Used at step 01 to kick off the pipeline.
Write
Used at step 01 to kick off the pipeline.
WebFetch
Used at step 01 to kick off the pipeline.
WebSearch
Used at step 01 to kick off the pipeline.
Застосовуйте свій шаблон полів, щоб кожен документ відповідав одному й тому ж набору стовпців.
pending
Перевіряйте типи та формати даних, такі як дати та валюти, перед прийняттям рядка.
pending
Додавайте структуровані рядки до одного CSV-файлу та фіксуйте файли, у яких сталася помилка витягування.
pending
Приклад результату
json
// Sample output
// (generated when the pipeline finishes)
Extract the template fields from each document into a consistent CSV row; output null where a field is absent.
Unlock the rest
The full agent definition, install snippet, and starter task are gated for community members.
Members get the full `.md` agent file, the npm / pnpm install one-liners, a starter prompt that we've tuned against real runs, and the open-source repo when this automation ships there. One email, magic link, done.