Velké chatové skupiny se rychle stanou toxickými a lidští moderátoři nemůžou ve dvě ráno číst každou zprávu. Tento detektor vyhodnotí každý příspěvek z hlediska obtěžování, nenávisti a vyhrožování ve chvíli, kdy se objeví, a označí ty, které překračují vaši hranici.
Velké chatové skupiny se rychle stanou toxickými a lidští moderátoři nemůžou ve dvě ráno číst každou zprávu. Tento detektor vyhodnotí každý příspěvek z hlediska obtěžování, nenávisti a vyhrožování ve chvíli, kdy se objeví, a označí ty, které překračují vaši hranici.
Moderátoři dostanou upozornění s kontextem zprávy a navrhovaným opatřením, místo aby se prohrabovali nefiltrovaným proudem zpráv. Opakovaní narušitelé se zaznamenávají, takže vzorec hraničních zpráv se stane viditelným, místo aby jedna po druhé proklouzly.
Jak běží
Used at step 01 to kick off the pipeline.
Write
Used at step 01 to kick off the pipeline.
WebFetch
Used at step 01 to kick off the pipeline.
WebSearch
Used at step 01 to kick off the pipeline.
Hodnotí míru toxicity, obtěžování a hrozeb u každé zprávy vůči vámi nastaveným prahovým hodnotám.
pending
Označí zprávy překračující hranici a upozorní moderátory spolu s kontextem a navrženým postupem.
pending
Loguje pachatele a opakující se vzorce, aby moderátoři mohli snadno odhalit problémové účty.
pending
Ukázkový výstup
json
// Sample output
// (generated when the pipeline finishes)
Score this message for toxicity from 0 to 1 across harassment, hate, and threats; return JSON with reasons.
Unlock the rest
The full agent definition, install snippet, and starter task are gated for community members.
Members get the full `.md` agent file, the npm / pnpm install one-liners, a starter prompt that we've tuned against real runs, and the open-source repo when this automation ships there. One email, magic link, done.