Todas las publicaciones
5 min de lectura

Cómo explicarle al bot con tus palabras qué debe borrar

Las reglas de IA se escriben en lenguaje corriente. Cómo formularlas, qué sabe el modelo de un mensaje y cómo probar una regla en el simulador.

Las reglas de frases exigen enumerar las palabras. La moderación con IA lo hace de otro modo: describes en texto corriente qué cuenta como infracción, y el modelo lo reconoce en cualquier redacción, incluidas las que no previste.

Suena a que puedes escribir cualquier cosa. En la práctica unas formulaciones funcionan y otras callan, y la diferencia es previsible.

Dónde se configura#

Sección Moderación → tarjeta Moderación con IA → pestaña «Reglas». Tus reglas trabajan por encima de los temas integrados: los temas capturan estafas, phishing y publicidad de apuestas; las reglas, lo que está fuera de lugar precisamente en tu chat.

La tarjeta de moderación con IA con la pestaña Reglas

Una regla describe qué capturar#

Lo primero que conviene entender: una regla es la descripción de una infracción, no una orden al bot. Qué se hace con lo encontrado lo decide la cadena de sanciones, como en el resto de bloques.

Así que no «borra los mensajes con publicidad», sino simplemente «publicidad de canales ajenos e invitaciones a otras comunidades».

Las buenas formulaciones se ven así:

  • mensajes con palabrotas o insultos;
  • ofertas de trabajo y de ingresos, incluido «escríbeme por privado» y enlaces a canales de empleo;
  • anuncios de venta de cualquier cosa salvo aparejos de pesca y cebo;
  • colectas de dinero, datos de tarjetas y peticiones de transferencia;
  • discusiones de política, elecciones y noticias de guerra;
  • ataques personales: hablar de los miembros en lugar de sus mensajes.

Las excepciones se escriben en el mismo sitio y con las mismas palabras: «contar cosas del propio trabajo no es una infracción».

Qué sabe el modelo de un mensaje#

Solo su texto. Ni el nombre del chat, ni la descripción de la comunidad, ni el autor, ni la hora del día, ni lo que se escribió antes.

De ahí el error clásico del principiante: formulaciones como «fuera de tema», «no encaja con el tema del chat», «flood en el hilo equivocado». Para el modelo son palabras vacías: no tiene con qué comparar. Enumera en concreto qué se considera de más en tu chat.

Por la misma razón carecen de sentido las reglas sobre personas y horarios: «mensajes de miembros nuevos», «publicidad en fin de semana». Lo primero lo resuelve el nivel de confianza; lo segundo no se resuelve de ninguna manera.

Cada regla dispone de 500 caracteres: alcanza para una descripción con un par de excepciones.

Sensibilidad#

Cada regla ofrece dos modos:

  • Preciso: reaccionar solo cuando el modelo está seguro;
  • Sensible: reaccionar también con confianza media.

La lógica es simple: cuanto más cara sea una falsa alarma, más estricto el modo. Las palabrotas se reconocen sin ambigüedad, así que ahí encaja el sensible. Los «ataques personales» son subjetivos: mejor el preciso, o el bot empezará a limpiar discusiones normales.

El orden de las reglas#

Las reglas se comprueban de arriba abajo, y el orden se cambia con flechas. La regla más importante y más concreta conviene subirla: se activa la primera que encaja, y es su nombre el que acaba en el registro.

Otro detalle: tus reglas se ejecutan en una comprobación aparte y solo si el mensaje no cayó en ninguno de los temas de estafa integrados. La estafa evidente no llega a tus reglas.

Comprueba en el simulador#

Junto a las reglas hay un simulador: pegas un mensaje de ejemplo y ves qué regla se habría activado y con qué confianza. No se aplican sanciones.

Dos advertencias: la comprobación se descuenta del saldo como un mensaje normal, y en el simulador participan solo tus reglas; los temas integrados no se comprueban ahí.

Un orden que funciona: escribes la regla, pasas por el simulador cinco o seis mensajes reales de tu chat —infracciones y otros parecidos pero inofensivos—, ajustas la formulación y solo entonces asignas sanciones.

Cuántas reglas conviene crear#

Menos de las que uno querría. Cada regla participa en la comprobación de cada mensaje y encarece el procesamiento; el panel lo advierte abiertamente, y el tope son veinte reglas por chat.

Suelen bastar tres o cinco: cubren lo que de verdad estorba, y el resto lo recogen los temas integrados.

Tus reglas son el piso de arriba de la protección. Qué debe haber debajo: Cómo proteger un grupo de Telegram del spam.

¿Cómo escribo una regla para la moderación con IA?

Describe en texto corriente qué cuenta como infracción, por ejemplo «publicidad de canales ajenos». No escribas órdenes como «borra» o «banea»: qué se hace con lo encontrado lo decide la cadena de sanciones.

¿Funcionará una regla del tipo «borrar lo que esté fuera de tema»?

No. El modelo solo ve el texto del mensaje y no sabe de qué va tu chat, así que no tiene con qué compararlo. Enumera en concreto qué se considera de más.

¿En qué se diferencia «Preciso» de «Sensible»?

El preciso reacciona solo con alta confianza del modelo; el sensible, también con confianza media. Para cosas inequívocas como las palabrotas usa el sensible; para las subjetivas, el preciso.

¿Cuántas reglas puedo crear?

Hasta veinte por chat. Pero cada regla encarece el procesamiento de cada mensaje, así que suelen bastar tres o cinco.

¿Cuesta dinero una comprobación en el simulador?

Sí, se descuenta del saldo como un mensaje normal. No se aplican sanciones.

Sigue leyendo