Os grupos de chat grandes tornam-se tóxicos depressa, e os moderadores humanos não conseguem ler todas as mensagens às 2 da manhã. Este detetor avalia cada mensagem quanto a assédio, ódio e ameaças no momento em que chega, e sinaliza as que ultrapassam o seu limite.
Os grupos de chat grandes tornam-se tóxicos depressa, e os moderadores humanos não conseguem ler todas as mensagens às 2 da manhã. Este detetor avalia cada mensagem quanto a assédio, ódio e ameaças no momento em que chega, e sinaliza as que ultrapassam o seu limite.
Os moderadores recebem um alerta com o contexto da mensagem e uma ação sugerida, em vez de uma torrente de dados em bruto. Os reincidentes ficam registados, para que um padrão de mensagens no limite se torne visível, em vez de passar despercebido mensagem a mensagem.
Como funciona
Used at step 01 to kick off the pipeline.
Write
Used at step 01 to kick off the pipeline.
WebFetch
Used at step 01 to kick off the pipeline.
WebSearch
Used at step 01 to kick off the pipeline.
Avaliar o nível de toxicidade, assédio e ameaças de cada mensagem face aos teus limiares.
pending
Assinalar as mensagens que ultrapassem o limite e notificar os moderadores com o contexto e uma ação sugerida.
pending
Registar os infratores e padrões repetitivos para que os moderadores possam identificar contas problemáticas recorrentes.
pending
Saída de exemplo
json
// Sample output
// (generated when the pipeline finishes)
Score this message for toxicity from 0 to 1 across harassment, hate, and threats; return JSON with reasons.
Unlock the rest
The full agent definition, install snippet, and starter task are gated for community members.
Members get the full `.md` agent file, the npm / pnpm install one-liners, a starter prompt that we've tuned against real runs, and the open-source repo when this automation ships there. One email, magic link, done.