Naiwne dzielenie na fragmenty potrafi przeciąć zdanie w pół, a wyszukiwanie zwraca bezsens. Ten potok dzieli dokumenty z Drive według znaczenia, dzięki czemu każdy fragment pozostaje zrozumiały sam w sobie.
Naiwne dzielenie na fragmenty potrafi przeciąć zdanie w pół, a wyszukiwanie zwraca bezsens. Ten potok dzieli dokumenty z Drive według znaczenia, dzięki czemu każdy fragment pozostaje zrozumiały sam w sobie.
Przed osadzeniem w Pinecone do każdego fragmentu dodaje kontekst sekcji, a następnie cyklicznie przeindeksowuje. Efekt to wyszukiwanie, które naprawdę odpowiada, a nie sklejone ze środka akapitu strzępy.
Jak działa
Used at step 01 to kick off the pipeline.
Write
Used at step 01 to kick off the pipeline.
WebFetch
Used at step 01 to kick off the pipeline.
WebSearch
Used at step 01 to kick off the pipeline.
Dodawanie krótkiego streszczenia nadrzędnego rozdziału do każdego fragmentu, aby izolowany tekst zachował sens.
pending
Wektorowanie wzbogaconych fragmentów i ich zapis (upsert) w Pinecone wraz z metadanymi pliku i sekcji.
pending
Ponowne indeksowanie zmienionych plików w harmonogramie, aby wyszukiwanie pozostawało dokładne wraz z ewolucją dokumentów.
pending
Przykładowe wyjście
json
// Sample output
// (generated when the pipeline finishes)
Chunk the document by semantic section, prepend a one-line section summary to each chunk, then return embed-ready records.
Unlock the rest
The full agent definition, install snippet, and starter task are gated for community members.
Members get the full `.md` agent file, the npm / pnpm install one-liners, a starter prompt that we've tuned against real runs, and the open-source repo when this automation ships there. One email, magic link, done.