Alle Beiträge
4 Min. Lesezeit

Dem Bot in eigenen Worten sagen, was gelöscht werden soll

KI-Regeln werden als normaler Text geschrieben. Wie man formuliert, was das Modell von einer Nachricht weiß und wie man eine Regel im Simulator testet.

Phrasenregeln verlangen, die Wörter aufzuzählen. Die KI-Moderation kann es anders: Sie beschreiben in normalem Text, was als Verstoß gilt — und das Modell erkennt das in jeder Formulierung, auch in solchen, die Sie nicht vorhergesehen haben.

Das klingt, als könne man alles Mögliche schreiben. In der Praxis funktionieren manche Formulierungen und andere schweigen, und der Unterschied ist vorhersehbar.

Wo es eingerichtet wird#

Bereich Moderation → Karte KI-Moderation → Tab „Regeln". Ihre Regeln arbeiten über den eingebauten Themen: Die Themen fangen Betrug, Phishing und Glücksspielwerbung, die Regeln das, was gerade bei Ihnen fehl am Platz ist.

Die Karte der KI-Moderation mit dem Tab Regeln

Eine Regel beschreibt, was zu fangen ist#

Das Wichtigste gleich vorweg: Eine Regel ist die Beschreibung eines Verstoßes, kein Befehl an den Bot. Was mit einem Treffer geschieht, entscheidet die Strafkette, wie in allen anderen Blöcken.

Also nicht „lösche Nachrichten mit Werbung", sondern einfach „Werbung für fremde Kanäle und Einladungen in andere Communities".

Gute Formulierungen sehen so aus:

  • Nachrichten mit Schimpfwörtern oder Beleidigungen;
  • Job- und Verdienstangebote, auch „schreib mir privat" und Links zu Jobkanälen;
  • Verkaufsanzeigen für alles außer Angelzubehör und Köder;
  • Geldsammlungen, Kartendaten und Bitten um Überweisungen;
  • Diskussionen über Politik, Wahlen und Kriegsnachrichten;
  • persönliche Angriffe, also über Mitglieder statt über ihre Nachrichten reden.

Ausnahmen stehen an derselben Stelle und in denselben Worten: „vom eigenen Job erzählen ist kein Verstoß".

Was das Modell von einer Nachricht weiß#

Nur ihren Text. Nicht den Namen des Chats, nicht die Beschreibung der Community, nicht den Autor, nicht die Tageszeit, nicht das, was vorher geschrieben wurde.

Daher der klassische Anfängerfehler: Formulierungen wie „Offtopic", „passt nicht zum Chatthema", „Geflute im falschen Strang". Für das Modell sind das leere Worte — es hat nichts zum Vergleichen. Zählen Sie konkret auf, was in Ihrem Chat als überflüssig gilt.

Aus demselben Grund sind Regeln über Personen und Zeit sinnlos: „Nachrichten von neuen Mitgliedern", „Werbung am Wochenende". Das Erste löst die Vertrauensstufe, das Zweite lässt sich gar nicht lösen.

Pro Regel stehen 500 Zeichen zur Verfügung — das reicht für eine Beschreibung mit ein paar Ausnahmen.

Empfindlichkeit#

Jede Regel hat zwei Modi zur Wahl:

  • Genau — nur reagieren, wenn das Modell sicher ist;
  • Empfindlich — auch bei mittlerer Sicherheit reagieren.

Die Logik ist einfach: Je teurer ein Fehlalarm, desto strenger der Modus. Schimpfwörter werden eindeutig erkannt — da passt „Empfindlich". „Persönliche Angriffe" sind subjektiv, hier ist „Genau" besser, sonst räumt der Bot normale Debatten aus.

Reihenfolge der Regeln#

Regeln werden von oben nach unten geprüft, und die Reihenfolge ändern Pfeile. Die wichtigere und engere Regel gehört nach oben: Die erste passende greift, und genau ihr Name landet im Protokoll.

Noch ein Detail: Ihre Regeln laufen als eigene Prüfung und nur, wenn die Nachricht in keinem der eingebauten Betrugsthemen gelandet ist. Offensichtlicher Betrug erreicht Ihre Regeln gar nicht.

Prüfen Sie im Simulator#

Neben den Regeln gibt es einen Simulator: Sie fügen eine Beispielnachricht ein und sehen, welche Regel mit welcher Sicherheit gegriffen hätte. Strafen werden dabei nicht verhängt.

Zwei Einschränkungen: Die Prüfung wird wie eine normale Nachricht vom Guthaben abgebucht, und im Simulator nehmen nur Ihre eigenen Regeln teil — eingebaute Themen werden dort nicht geprüft.

Ein bewährter Ablauf: Regel schreiben, fünf bis sechs echte Nachrichten aus Ihrem Chat durch den Simulator schicken — Verstöße und ähnliche harmlose —, die Formulierung nachschärfen und erst dann Strafen zuweisen.

Wie viele Regeln man anlegen sollte#

Weniger, als man möchte. Jede Regel nimmt an der Prüfung jeder Nachricht teil und macht die Verarbeitung teurer; das Dashboard warnt ausdrücklich davor, und die Obergrenze liegt bei zwanzig Regeln pro Chat.

Meist reichen drei bis fünf: Sie decken ab, was wirklich stört, den Rest übernehmen die eingebauten Themen.

Eigene Regeln sind das oberste Stockwerk des Schutzes. Was darunter stehen sollte: Eine Telegram-Gruppe vor Spam schützen.

Wie schreibe ich eine Regel für die KI-Moderation?

Beschreiben Sie in normalem Text, was als Verstoß gilt — etwa „Werbung für fremde Kanäle". Schreiben Sie keine Befehle wie „lösche" oder „sperre": Was mit einem Treffer geschieht, entscheidet die Strafkette.

Funktioniert eine Regel „Offtopic löschen"?

Nein. Das Modell sieht nur den Nachrichtentext und weiß nicht, worum es in Ihrem Chat geht, es kann die Nachricht also mit nichts vergleichen. Zählen Sie konkret auf, was als überflüssig gilt.

Was unterscheidet „Genau" von „Empfindlich"?

„Genau" reagiert nur bei hoher Sicherheit des Modells, „Empfindlich" auch bei mittlerer. Für Eindeutiges wie Schimpfwörter nehmen Sie „Empfindlich", für Subjektives „Genau".

Wie viele Regeln kann ich anlegen?

Bis zu zwanzig pro Chat. Aber jede Regel verteuert die Verarbeitung jeder Nachricht, deshalb reichen meist drei bis fünf.

Kostet eine Prüfung im Simulator Geld?

Ja, sie wird wie eine normale Nachricht vom Guthaben abgebucht. Strafen werden dabei nicht verhängt.

Weiterlesen