Os jobs de ETL com muito texto falham em silêncio: algumas linhas malformadas, uma fonte instável, e só descobre dias depois quando um relatório parece errado. Este runner torna cada batch rastreável.
sonnet1 semanaPythonPostgresS3Slack
Claude
85ROI
91Scale
$3.3k93Saved
ROI for
README.md
Porquê este subagente
Os jobs de ETL com muito texto falham em silêncio: algumas linhas malformadas, uma fonte instável, e só descobre dias depois quando um relatório parece errado. Este runner torna cada batch rastreável.
Valida contra o schema, limpa e enriquece o texto, repete erros transitórios com backoff e coloca em quarentena os registos que continuam a falhar em vez de os descartar. Cada execução termina com um registo de auditoria que contabiliza o que entrou, o que foi rejeitado e o que ficou, para que possa confiar nos números.
Como funciona
Used at step 01 to kick off the pipeline.
Write
Used at step 01 to kick off the pipeline.
WebFetch
Used at step 01 to kick off the pipeline.
WebSearch
Used at step 01 to kick off the pipeline.
Transformar os campos de texto aplicando as regras de limpeza e enriquecimento definidas, ignorando linhas que falhem a validação.
pending
Retentar falhas transitórias com backoff e isolar registos que falhem repetidamente.
pending
Carregar as linhas limpas na base de destino e escrever um resumo da execução com contagens e linhas rejeitadas.
pending
Saída de exemplo
json
// Sample output
// (generated when the pipeline finishes)
Given a source batch, run extract-transform-load with retries and return a JSON audit log of rows read, transformed, retried, quarantined, and loaded.
Unlock the rest
The full agent definition, install snippet, and starter task are gated for community members.
Members get the full `.md` agent file, the npm / pnpm install one-liners, a starter prompt that we've tuned against real runs, and the open-source repo when this automation ships there. One email, magic link, done.