Grote chatgroepen worden razendsnel toxisch, en menselijke moderators kunnen niet elk bericht om 2 uur 's nachts lezen. Deze detector scoort elke post op intimidatie, haat en bedreigingen op het moment dat hij landt, en markeert dan de berichten die over jouw grens gaan.
Grote chatgroepen worden razendsnel toxisch, en menselijke moderators kunnen niet elk bericht om 2 uur 's nachts lezen. Deze detector scoort elke post op intimidatie, haat en bedreigingen op het moment dat hij landt, en markeert dan de berichten die over jouw grens gaan.
Moderators krijgen een melding met de context van het bericht en een voorgestelde actie in plaats van een ruwe brandslang. Recidivisten worden gelogd, zodat een patroon van twijfelachtige berichten zichtbaar wordt in plaats van er een voor een doorheen te glippen.
Hoe hij werkt
Used at step 01 to kick off the pipeline.
Write
Used at step 01 to kick off the pipeline.
WebFetch
Used at step 01 to kick off the pipeline.
WebSearch
Used at step 01 to kick off the pipeline.
Scoor elk bericht op toxiciteit, intimidatie en bedreigingen tegen jouw drempels.
pending
Markeer berichten over de grens en seingeef moderators met de context en een voorgestelde actie.
pending
Log overtreders en terugkerende patronen, zodat moderators recidiverende probleemaccounts kunnen spotten.
pending
Voorbeelduitvoer
json
// Sample output
// (generated when the pipeline finishes)
Score this message for toxicity from 0 to 1 across harassment, hate, and threats; return JSON with reasons.
Unlock the rest
The full agent definition, install snippet, and starter task are gated for community members.
Members get the full `.md` agent file, the npm / pnpm install one-liners, a starter prompt that we've tuned against real runs, and the open-source repo when this automation ships there. One email, magic link, done.