community-automations/visual-regression

Research & Intel

PublicClaude-Subagent

Visueller Regressions-Tester

Ein misslungener Deploy kann ein Hero-Bild aus dem sichtbaren Bereich schieben oder eine Preistabelle zerlegen, und niemand merkt es, bis ein Kunde es tut. Dieser Tester macht nach Zeitplan Screenshots Ihrer Seiten.

sonnet4 TageApifyPlaywrightGPT-4 VisionSlack
ClaudeClaude
ROI for
README.md

Warum dieser Subagent

Ein misslungener Deploy kann ein Hero-Bild aus dem sichtbaren Bereich schieben oder eine Preistabelle zerlegen, und niemand merkt es, bis ein Kunde es tut. Dieser Tester macht nach Zeitplan Screenshots Ihrer Seiten.

Er vergleicht jede Aufnahme mit einer freigegebenen Baseline und fragt dann ein Vision-Modell, ob eine Änderung ein echter Defekt oder erwarteter Inhalt ist. Sie bekommen einen Slack-Alarm mit dem Diff-Bild und einer Einschätzung, und ignorierbare Verschiebungen werden herausgefiltert, damit der Channel vertrauenswürdig bleibt.

So läuft er

    • Read

      Used at step 01 to kick off the pipeline.

    • Write

      Used at step 01 to kick off the pipeline.

    • WebFetch

      Used at step 01 to kick off the pipeline.

    • WebSearch

      Used at step 01 to kick off the pipeline.

Beispiel-Output

json
// Sample output
// (generated when the pipeline finishes)

Compare the new screenshot to baseline and return {changed: bool, severity, region, likely_cause}; ignore dynamic content zones marked in config.

Unlock the rest

The full agent definition, install snippet, and starter task are gated for community members.

Members get the full `.md` agent file, the npm / pnpm install one-liners, a starter prompt that we've tuned against real runs, and the open-source repo when this automation ships there. One email, magic link, done.