Обхід сайту вручну — це пропущені сторінки, перевантажений сервер і плутанина з тим, що вже завантажено. Цей кроулер бере на себе весь обхід.
sonnet4 дніPlaywrightPythonRedisPostgres
Claude
63ROI
73Scale
$1.4k90Saved
ROI for
README.md
Чому цей субагент
Обхід сайту вручну — це пропущені сторінки, перевантажений сервер і плутанина з тим, що вже завантажено. Цей кроулер бере на себе весь обхід.
Він починає з початкового URL, знаходить посилання, не виходить за межі домену й дозує запити, щоб сайт працював стабільно. Помилки повторюються з наростаючою затримкою, відвідані URL відстежуються, щоб уникнути циклів, а кожна сторінка зберігається з метаданими. Коли черга спорожніє, ви отримуєте звіт про покриття.
Як він працює
Used at step 01 to kick off the pipeline.
Write
Used at step 01 to kick off the pipeline.
WebFetch
Used at step 01 to kick off the pipeline.
WebSearch
Used at step 01 to kick off the pipeline.
Контролюйте частоту запитів затримками та дотримуйтесь правил robots.txt, щоб краулінг залишався коректним.
pending
Повторюйте запити до невдалих сторінок із експоненційною затримкою та відстежуйте, які URL вже опрацьовано, щоб уникнути повторного їх відвідування.
pending
Зберігайте вміст кожної отриманої сторінки та метадані, а коли черга спорожніє — звітайте про охоплення.
pending
Приклад результату
json
// Sample output
// (generated when the pipeline finishes)
Crawl a single domain from a seed URL with rate limiting, retries, and dedup, storing each page and reporting coverage.
Unlock the rest
The full agent definition, install snippet, and starter task are gated for community members.
Members get the full `.md` agent file, the npm / pnpm install one-liners, a starter prompt that we've tuned against real runs, and the open-source repo when this automation ships there. One email, magic link, done.