Todas as publicações
5 min de leitura

Como explicar ao bot com suas palavras o que ele deve apagar

As regras de IA se escrevem em linguagem comum. Como formulá-las, o que o modelo sabe de uma mensagem e como testar uma regra no simulador.

As regras de frases exigem enumerar as palavras. A moderação com IA faz diferente: você descreve em texto comum o que conta como infração, e o modelo reconhece isso em qualquer formulação, inclusive nas que você não previu.

Parece que dá para escrever qualquer coisa. Na prática, umas formulações funcionam e outras ficam mudas, e a diferença é previsível.

Onde se configura#

Seção Moderação → cartão Moderação com IA → aba «Regras». Suas regras funcionam por cima dos temas embutidos: os temas capturam golpes, phishing e publicidade de apostas; as regras, o que está fora de lugar justamente no seu chat.

O cartão da moderação com IA com a aba Regras

Uma regra descreve o que capturar#

O principal a entender de saída: uma regra é a descrição de uma infração, não uma ordem ao bot. O que se faz com o achado quem decide é a cadeia de punições, como nos demais blocos.

Portanto não «apague as mensagens com publicidade», e sim simplesmente «publicidade de canais de fora e convites para outras comunidades».

Boas formulações se parecem com isto:

  • mensagens com palavrões ou ofensas;
  • ofertas de trabalho e de renda, inclusive «me chama no privado» e links para canais de vagas;
  • anúncios de venda de qualquer coisa, exceto material de pesca e isca;
  • vaquinhas, dados de cartão e pedidos de transferência;
  • discussões sobre política, eleições e notícias de guerra;
  • ataques pessoais: falar dos membros em vez de falar das mensagens deles.

As exceções se escrevem no mesmo lugar e com as mesmas palavras: «contar sobre o próprio trabalho não é infração».

O que o modelo sabe de uma mensagem#

Só o texto dela. Nem o nome do chat, nem a descrição da comunidade, nem o autor, nem a hora do dia, nem o que foi escrito antes.

Daí o erro clássico do iniciante: formulações como «fora do tema», «não combina com o assunto do chat», «flood no tópico errado». Para o modelo são palavras vazias: não há com o que comparar. Enumere concretamente o que se considera demais no seu chat.

Pela mesma razão, regras sobre pessoas e horários não fazem sentido: «mensagens de membros novos», «publicidade no fim de semana». A primeira se resolve pelo nível de confiança; a segunda não se resolve de jeito nenhum.

Cada regra dispõe de 500 caracteres — dá para uma descrição com duas ou três exceções.

Sensibilidade#

Cada regra oferece dois modos:

  • Preciso — reagir só quando o modelo está seguro;
  • Sensível — reagir também com confiança média.

A lógica é simples: quanto mais caro sai um falso positivo, mais rígido o modo. Palavrões são reconhecidos sem ambiguidade, então o sensível cabe. «Ataques pessoais» são subjetivos: melhor o preciso, senão o bot começa a limpar discussões normais.

A ordem das regras#

As regras são verificadas de cima para baixo, e a ordem se muda com setas. A regra mais importante e mais específica merece subir: dispara a primeira que serve, e é o nome dela que vai para o registro.

Mais um detalhe: suas regras rodam numa verificação à parte e só se a mensagem não caiu em nenhum dos temas de golpe embutidos. Golpe evidente não chega às suas regras.

Confira no simulador#

Ao lado das regras há um simulador: você cola uma mensagem de exemplo e vê qual regra teria disparado e com que confiança. Nenhuma punição é aplicada.

Duas ressalvas: a verificação é debitada do saldo como uma mensagem comum, e no simulador participam só as suas regras — os temas embutidos não são testados ali.

Uma rotina que funciona: você escreve a regra, passa pelo simulador cinco ou seis mensagens reais do seu chat — infrações e outras parecidas, mas inofensivas —, ajusta a formulação e só então atribui punições.

Quantas regras criar#

Menos do que se quer. Cada regra participa da verificação de cada mensagem e encarece o processamento; o painel avisa isso abertamente, e o teto é de vinte regras por chat.

Costumam bastar três a cinco: cobrem o que de fato atrapalha, e o resto os temas embutidos recolhem.

Suas regras são o andar de cima da proteção. O que deve estar embaixo: Como proteger um grupo do Telegram contra spam.

Como escrever uma regra para a moderação com IA?

Descreva em texto comum o que conta como infração, por exemplo «publicidade de canais de fora». Não escreva ordens do tipo «apague» ou «bana»: o que se faz com o achado quem decide é a cadeia de punições.

Uma regra do tipo «apagar o que está fora do tema» vai funcionar?

Não. O modelo só vê o texto da mensagem e não sabe do que trata o seu chat, então não tem com o que comparar. Enumere concretamente o que se considera demais.

Qual a diferença entre «Preciso» e «Sensível»?

O preciso reage só com alta confiança do modelo; o sensível, também com confiança média. Para coisas sem ambiguidade, como palavrões, use o sensível; para as subjetivas, o preciso.

Quantas regras posso criar?

Até vinte por chat. Mas cada regra encarece o processamento de cada mensagem, então costumam bastar três a cinco.

Uma verificação no simulador custa dinheiro?

Sim, é debitada do saldo como uma mensagem comum. Nenhuma punição é aplicada.

Leia a seguir