I gruppi chat grandi diventano tossici in fretta, e i moderatori in carne e ossa non possono leggere ogni messaggio alle 2 di notte. Questo rilevatore assegna a ogni post un punteggio di molestia, odio e minaccia nel momento in cui arriva, poi segnala quelli che superano il tuo limite.
I gruppi chat grandi diventano tossici in fretta, e i moderatori in carne e ossa non possono leggere ogni messaggio alle 2 di notte. Questo rilevatore assegna a ogni post un punteggio di molestia, odio e minaccia nel momento in cui arriva, poi segnala quelli che superano il tuo limite.
I moderatori ricevono un avviso con il contesto del messaggio e un'azione suggerita invece di un fiume in piena. Gli autori recidivi vengono registrati, così un pattern di messaggi al limite diventa visibile invece di passare uno alla volta.
Come gira
Used at step 01 to kick off the pipeline.
Write
Used at step 01 to kick off the pipeline.
WebFetch
Used at step 01 to kick off the pipeline.
WebSearch
Used at step 01 to kick off the pipeline.
Assegna a ogni messaggio un punteggio di tossicità, molestia e minaccia rispetto alle tue soglie.
pending
Segnala i messaggi oltre il limite e avvisa i moderatori con il contesto e un'azione suggerita.
pending
Registra gli autori e i pattern ricorrenti, così i moderatori possono individuare gli account problematici.
pending
Esempio di output
json
// Sample output
// (generated when the pipeline finishes)
Score this message for toxicity from 0 to 1 across harassment, hate, and threats; return JSON with reasons.
Unlock the rest
The full agent definition, install snippet, and starter task are gated for community members.
Members get the full `.md` agent file, the npm / pnpm install one-liners, a starter prompt that we've tuned against real runs, and the open-source repo when this automation ships there. One email, magic link, done.