Los grupos de chat grandes se vuelven tóxicos rápido, y los moderadores humanos no pueden leer cada mensaje a las 2 de la madrugada. Este detector puntúa cada publicación por acoso, odio y amenazas en cuanto llega, luego marca las que cruzan tu línea.
Los grupos de chat grandes se vuelven tóxicos rápido, y los moderadores humanos no pueden leer cada mensaje a las 2 de la madrugada. Este detector puntúa cada publicación por acoso, odio y amenazas en cuanto llega, luego marca las que cruzan tu línea.
Los moderadores reciben un aviso con el contexto del mensaje y una acción sugerida en lugar de una avalancha en bruto. Los infractores reincidentes quedan registrados, así que un patrón de mensajes al límite se hace visible en vez de colarse de uno en uno.
Cómo se ejecuta
Used at step 01 to kick off the pipeline.
Write
Used at step 01 to kick off the pipeline.
WebFetch
Used at step 01 to kick off the pipeline.
WebSearch
Used at step 01 to kick off the pipeline.
Puntúa cada mensaje por toxicidad, acoso y amenazas frente a tus umbrales.
pending
Marca los mensajes que cruzan la línea y avisa a los moderadores con el contexto y una acción sugerida.
pending
Registra a los infractores y los patrones repetidos para que los moderadores detecten cuentas problemáticas recurrentes.
pending
Salida de ejemplo
json
// Sample output
// (generated when the pipeline finishes)
Score this message for toxicity from 0 to 1 across harassment, hate, and threats; return JSON with reasons.
Unlock the rest
The full agent definition, install snippet, and starter task are gated for community members.
Members get the full `.md` agent file, the npm / pnpm install one-liners, a starter prompt that we've tuned against real runs, and the open-source repo when this automation ships there. One email, magic link, done.