Att dra strukturerad data ur en webbsida betyder oftast att skriva en engångsskrapa som går sönder i samma stund sidan ändras. Den här extraktorn tar en URL och ett schema i stället.
sonnet4 dagarFirecrawlPlaywrightOpenAIPostgres
Claude
65ROI
72Scale
$2.2k93Saved
ROI for
README.md
Varför denna subagent
Att dra strukturerad data ur en webbsida betyder oftast att skriva en engångsskrapa som går sönder i samma stund sidan ändras. Den här extraktorn tar en URL och ett schema i stället.
Du beskriver de fält du vill ha, och den renderar sidan, mappar elementen och returnerar rena validerade poster. Byt sida genom att byta schema; ingen ny skrapa att skriva, och varje fält som sidan saknar flaggas i stället för att hittas på.
Så kör den
Used at step 01 to kick off the pipeline.
Write
Used at step 01 to kick off the pipeline.
WebFetch
Used at step 01 to kick off the pipeline.
WebSearch
Used at step 01 to kick off the pipeline.
Tar ditt definierade schema och mappar sidans element mot dess fält.
pending
Extraherar datan, tvingar typerna och validerar varje rad mot schemat.
pending
Returnerar rena strukturerade poster och flaggar fält som sidan inte gav.
pending
Exempel på output
json
// Sample output
// (generated when the pipeline finishes)
Given a URL and a target schema, extract matching records as JSON conforming to the schema; set missing fields null and never invent values.
Unlock the rest
The full agent definition, install snippet, and starter task are gated for community members.
Members get the full `.md` agent file, the npm / pnpm install one-liners, a starter prompt that we've tuned against real runs, and the open-source repo when this automation ships there. One email, magic link, done.