Cómo moderar los comentarios de un periódico digital
Llama a la API antes de que el comentario aparezca debajo de la noticia y actúa según una de tres respuestas: publicarlo, retenerlo para que lo vea una persona o rechazarlo. Casi todos los comentarios son un lector diciendo algo normal sobre la noticia, y eso lo resuelven las comprobaciones gratuitas en torno a un milisegundo, así que moderar no añade una espera que el lector note. El modelo solo lee lo que ellas dejan abierto, y decides en cada llamada si puede hacerlo. Un comentario bloqueado vuelve con el motivo en una frase que tus moderadores pueden enseñarle al lector.
Amenazas a periodistas y a quien sale en la noticia
Una amenaza dirigida a quien lee ("sé dónde vives", "te voy a encontrar", "te voy a matar") se rechaza como violence en las comprobaciones gratuitas, en ocho idiomas, y la plantilla de comunidad la rechaza antes que el umbral por defecto. Las listas gratuitas recogen las formulaciones conocidas; una amenaza dicha de otra manera la lee el modelo, con effort: high. Un buen historial en tu web nunca rebaja el umbral de las amenazas, así que un comentarista habitual no se gana margen para soltar una.
Discurso de odio en los comentarios
Los ataques a colectivos van a hate, y eso es sobre todo trabajo del modelo. Las listas de palabras públicas no llevan insultos de odio a propósito, así que leer un ataque a un colectivo es trabajo del modelo. Si tus comentarios atraen ese tráfico, deja que el modelo lea los de las noticias que lo provocan, o carga tu propia lista desde fuera del código. La plantilla de comunidad rechaza hate a partir de 0,55, antes que el 0,70 por defecto.
Discusión acalorada que tiene que seguir publicada
La gente entra en los comentarios para discrepar, muchas veces a gritos. ToxicFilter separa lo que se dice de un cargo público, de una política o de la noticia de lo que va contra quien lee: "el alcalde es un desastre" pasa, "eres idiota" es acoso. Las palabrotas, solas, se informan como toxicity, que la plantilla de comunidad retiene para que alguien lo mire y nunca rechaza solo por eso, así que el lector enfadado que suelta un taco pasa por revisión en lugar de quedarse callado.
Spam, campañas de enlaces y comentarios repetidos
Un comentario que es casi todo enlaces, o que usa acortadores, se puntúa como spam y se retiene. Una campaña es otra señal, y no está en ningún comentario suelto: es el mismo comentario llegando una y otra vez. ToxicFilter lleva la cuenta dentro de tu propio tráfico, por proyecto y nunca mezclándolo con el de otros clientes, de los comentarios de más de unos cuarenta caracteres, reconoce la copia aunque la hayan reescrito y deja que ese recuento mueva el veredicto de la siguiente. Una repetición que se responde desde la caché cuesta solo la comprobación, un crédito, costara lo que costara la primera copia.
La cola de revisión y la declaración de motivos
Lo que llega como review espera en una cola, en tu panel o por la API, y el webhook moderation.resolved avisa a tu web cuando un moderador decide. Cada comentario bloqueado puede llevar la declaración de motivos que pide el artículo 17 del Reglamento de Servicios Digitales, en el idioma del lector, con el recurso detrás.