Una carpeta de PDF escaneados no sirve de nada hasta que alguien la teclea en una hoja de cálculo. Esto pasa todo el lote por OCR y extracción estructurada hasta un único CSV.
Una carpeta de PDF escaneados no sirve de nada hasta que alguien la teclea en una hoja de cálculo. Esto pasa todo el lote por OCR y extracción estructurada hasta un único CSV.
Lee cada archivo, lo mapea a tu plantilla de columnas, valida los formatos y apila los resultados en un único CSV limpio. Los archivos fallidos se listan aparte para que nada se pierda.
Cómo se ejecuta
Used at step 01 to kick off the pipeline.
Write
Used at step 01 to kick off the pipeline.
WebFetch
Used at step 01 to kick off the pipeline.
WebSearch
Used at step 01 to kick off the pipeline.
Aplica tu plantilla de campos para que cada documento mapee al mismo conjunto de columnas.
pending
Valida tipos y formatos, como fechas y moneda, antes de aceptar una fila.
pending
Añade las filas estructuradas a un único CSV y lista los archivos cuya extracción falló.
pending
Salida de ejemplo
json
// Sample output
// (generated when the pipeline finishes)
Extract the template fields from each document into a consistent CSV row; output null where a field is absent.
Unlock the rest
The full agent definition, install snippet, and starter task are gated for community members.
Members get the full `.md` agent file, the npm / pnpm install one-liners, a starter prompt that we've tuned against real runs, and the open-source repo when this automation ships there. One email, magic link, done.