community-automations/pdf-vertex-csv

Контент і документація

PublicСубагент Claude

PDF та зображення у CSV

Папка зі сканованими PDF ні на що не придатна, доки хтось не перенесе її в таблицю. Ця автоматизація проганяє весь пакет через OCR і структуроване вилучення в єдиний CSV.

sonnet4 дніVertex AIGoogle Cloud Vision OCRGoogle Sheetsn8n
ClaudeClaude
ROI for
README.md

Чому цей субагент

Папка зі сканованими PDF ні на що не придатна, доки хтось не перенесе її в таблицю. Ця автоматизація проганяє весь пакет через OCR і структуроване вилучення в єдиний CSV.

Вона читає кожен файл, зіставляє з вашим шаблоном стовпців, перевіряє формати й складає результати в один чистий CSV. Файли з помилками виводяться окремо, тож нічого не загубиться.

Як він працює

    • Read

      Used at step 01 to kick off the pipeline.

    • Write

      Used at step 01 to kick off the pipeline.

    • WebFetch

      Used at step 01 to kick off the pipeline.

    • WebSearch

      Used at step 01 to kick off the pipeline.

Приклад результату

json
// Sample output
// (generated when the pipeline finishes)

Extract the template fields from each document into a consistent CSV row; output null where a field is absent.

Unlock the rest

The full agent definition, install snippet, and starter task are gated for community members.

Members get the full `.md` agent file, the npm / pnpm install one-liners, a starter prompt that we've tuned against real runs, and the open-source repo when this automation ships there. One email, magic link, done.