Τα μεγάλα chat groups γίνονται τοξικά γρήγορα, και οι άνθρωποι moderators δεν μπορούν να διαβάσουν κάθε μήνυμα στις 2 τα ξημερώματα. Αυτός ο ανιχνευτής βαθμολογεί κάθε ανάρτηση για παρενόχληση, μίσος και απειλές τη στιγμή που φτάνει, μετά επισημαίνει όσα ξεπερνούν το όριό σου.
Τα μεγάλα chat groups γίνονται τοξικά γρήγορα, και οι άνθρωποι moderators δεν μπορούν να διαβάσουν κάθε μήνυμα στις 2 τα ξημερώματα. Αυτός ο ανιχνευτής βαθμολογεί κάθε ανάρτηση για παρενόχληση, μίσος και απειλές τη στιγμή που φτάνει, μετά επισημαίνει όσα ξεπερνούν το όριό σου.
Οι moderators λαμβάνουν ειδοποίηση με το context του μηνύματος και μια προτεινόμενη ενέργεια αντί για έναν ακατέργαστο χείμαρρο. Οι κατά συρροή παραβάτες καταγράφονται, ώστε ένα μοτίβο οριακών μηνυμάτων να γίνεται ορατό αντί να περνάει ένα-ένα απαρατήρητο.
Πώς λειτουργεί
Used at step 01 to kick off the pipeline.
Write
Used at step 01 to kick off the pipeline.
WebFetch
Used at step 01 to kick off the pipeline.
WebSearch
Used at step 01 to kick off the pipeline.
Αξιολογεί κάθε μήνυμα για τοξικότητα, παρενόχληση και απειλές, συγκρίνοντάς το με τα καθορισμένα όρια.
pending
Επισημαίνει τα μηνύματα που ξεπερνούν το όριο και ειδοποιεί τους διαχειριστές με το πλαίσιο και μια προτεινόμενη ενέργεια.
pending
Καταγράφει τους υπαίτιους και τα επαναλαμβανόμενα μοτίβα, ώστε οι διαχειριστές να εντοπίζουν προβληματικούς λογαριασμούς.
pending
Δείγμα εξόδου
json
// Sample output
// (generated when the pipeline finishes)
Score this message for toxicity from 0 to 1 across harassment, hate, and threats; return JSON with reasons.
Unlock the rest
The full agent definition, install snippet, and starter task are gated for community members.
Members get the full `.md` agent file, the npm / pnpm install one-liners, a starter prompt that we've tuned against real runs, and the open-source repo when this automation ships there. One email, magic link, done.