Naiv opdeling kløver en sætning midt over, og søgningen returnerer vrøvl. Denne pipeline opdeler Drive-dokumenter efter mening, så hver chunk forbliver forståelig i sig selv.
Naiv opdeling kløver en sætning midt over, og søgningen returnerer vrøvl. Denne pipeline opdeler Drive-dokumenter efter mening, så hver chunk forbliver forståelig i sig selv.
Den sætter sektionskontekst foran hver chunk, før den embeddes i Pinecone, og genindekserer efter en tidsplan. Gevinsten er søgning, der faktisk svarer – ikke fragmenter lappet sammen fra midt i et afsnit.
Sådan kører den
Used at step 01 to kick off the pipeline.
Write
Used at step 01 to kick off the pipeline.
WebFetch
Used at step 01 to kick off the pipeline.
WebSearch
Used at step 01 to kick off the pipeline.
Medbring en kort opsummering af overordnede afsnit i hvert stykke, så isoleret tekst bevarer sin betydning.
pending
Embed de berigede stykker og upsert dem i Pinecone med metadata om fil og sektion.
pending
Reindeks ændrede filer på et tidspunkt, så retrieval forbliver præcis, når dokumenterne udvikler sig.
pending
Eksempel på output
json
// Sample output
// (generated when the pipeline finishes)
Chunk the document by semantic section, prepend a one-line section summary to each chunk, then return embed-ready records.
Unlock the rest
The full agent definition, install snippet, and starter task are gated for community members.
Members get the full `.md` agent file, the npm / pnpm install one-liners, a starter prompt that we've tuned against real runs, and the open-source repo when this automation ships there. One email, magic link, done.