Uma pasta de PDFs digitalizados não serve de nada até alguém os passar para uma folha de cálculo. Isto processa o lote inteiro com OCR e extração estruturada para um único CSV.
Uma pasta de PDFs digitalizados não serve de nada até alguém os passar para uma folha de cálculo. Isto processa o lote inteiro com OCR e extração estruturada para um único CSV.
Lê cada ficheiro, mapeia-o para o seu modelo de colunas, valida os formatos e empilha os resultados num único CSV limpo. Os ficheiros com erro são listados separadamente para que nada se perca.
Como funciona
Used at step 01 to kick off the pipeline.
Write
Used at step 01 to kick off the pipeline.
WebFetch
Used at step 01 to kick off the pipeline.
WebSearch
Used at step 01 to kick off the pipeline.
Aplica o teu modelo de campos para que todos os documentos mapeiem para o mesmo conjunto de colunas.
pending
Valida tipos e formatos, como datas e moeda, antes de aceitar uma linha.
pending
Apende as linhas estruturadas num único CSV e lista quaisquer ficheiros onde a extração falhou.
pending
Saída de exemplo
json
// Sample output
// (generated when the pipeline finishes)
Extract the template fields from each document into a consistent CSV row; output null where a field is absent.
Unlock the rest
The full agent definition, install snippet, and starter task are gated for community members.
Members get the full `.md` agent file, the npm / pnpm install one-liners, a starter prompt that we've tuned against real runs, and the open-source repo when this automation ships there. One email, magic link, done.