Skip to main content
Nur Black-Stufe. Auf jeder niedrigeren Stufe wird die Seite durch die Tarifansicht ersetzt. Custom Bot (+) gewährt keinen KI-Zugriff — er hängt ausschließlich an der Stufe.
Standard-Auto-Moderation gleicht Muster ab. KI-Auto-Moderation liest die Nachricht so, wie es ein Moderator tun würde: Sie versteht Sarkasmus, verschlüsselte Sprache, absichtliche Tippfehler, um Filter zu umgehen, und Inhalte in jeder Sprache, in der deine Mitglieder schreiben. Sie liest auch Bilder.
Zwei Schalter müssen beide an sein: KI-Auto-Mod in der Server-Einrichtung und die Einstellungen auf dieser Seite. Bei ausgeschaltetem Modul scannt nichts, und hier erscheint über ein gelbes Banner hinaus keine Warnung.

Starte im Monitor-Modus

Die Einstellung Betriebsmodus ist das wichtigste Bedienelement auf der Seite.

Monitor

Verstöße werden protokolliert. Es wird nicht eingegriffen. Das ist der Standard.

Enforce

Konfigurierte Aktionen werden automatisch angewendet.
Der Monitor-Modus kostet trotzdem Tokens — jede Nachricht wird gescannt, nur die Aktion wird zurückgehalten. Wenn du Monitor ohne gesetzten Log-Kanal aktiv lässt, bezahlst du für Scans, deren Ergebnisse niemand sieht.
Lass Monitor ein paar Tage mit einem Log-Kanal laufen, lies, was er markiert hat, justiere deine Empfindlichkeit und wechsel dann zu Enforce. Diesen Schritt zu überspringen ist die häufigste Ursache für Beschwerden über False Positives.

Empfindlichkeit

Ein Schieberegler, in Prozent. Ein ausgewogener Startpunkt ist 25–40 %.
Jede Kategorie hat ihren eigenen Empfindlichkeitsregler. Ist der Regler einer Kategorie gesetzt, gilt nur dieser — der globale Wert ist ein Rückfall für Kategorien, die du nicht angepasst hast, nicht eine zusätzliche Untergrenze.

Kategorien

Zehn Kategorien, jede mit eigenem Schalter, eigenem Aktionsset und eigener Empfindlichkeit.
Nur Sexuelle Inhalte mit Minderjährigen ist ab Werk aktiviert. Jede andere Kategorie ist aus, bis du sie einschaltest — eine frisch aktivierte KI-Auto-Mod tut fast nichts, bis du sie konfigurierst.
Die Kategorie „Sexuelle Inhalte mit Minderjährigen“ ist technisch bearbeitbar, aber sie zu deaktivieren kann gegen die Discord-Nutzungsbedingungen verstoßen. Lass sie an.

Altersbeschränkte Kanäle

In einem altersbeschränkten Discord-Kanal wird die Kategorie Sexuelle Inhalte unterdrückt. Jede andere Kategorie — einschließlich sexueller Inhalte mit Minderjährigen — greift weiterhin normal.

Aktionen

Wähle je Kategorie eine beliebige Kombination: Nachricht löschen, Nutzer verwarnen, Timeout, Mute, Kick, Ban, Alert. Drei Kombinationen werden abgelehnt:
  • Kick und Ban gemeinsam
  • Alert mit Ban
  • Alert mit Kick
Alles andere ist kombinierbar. Löschen kombiniert sich mit allem.
Mute ist nur ein Text-Mute. Es schaltet das Mitglied in Voice-Kanälen nicht stumm.

Eigene Regeln

Schreibe die Regeln deines Servers in einfacher Sprache. Die KI wendet sie zusätzlich zu den Standardkategorien an.
25 Regeln, nur Black-Stufe.
Jede Regel hat einen Namen, eine Beschreibung mit bis zu 1.000 Zeichen, eine einzelne Aktion und optional eine Empfindlichkeit, die den globalen Wert überschreibt.
Sei präzise darin, was erlaubt ist, und darin, was nicht. „Keine Werbung für andere Server, aber den Kunst- oder Stream-Link eines Freundes in #showcase zu teilen ist okay“ funktioniert weit besser als „keine Werbung“.
Regeltext, der wie ein Versuch aussieht, die Anweisungen der KI zu manipulieren, wird beim Speichern abgelehnt. Wenn eine Regel sich mit einem generischen Fehler nicht speichern lässt, formuliere sie als schlichte Beschreibung des Verhaltens statt als Befehl.
Eine passende eigene Regel wird gegen ihre eigene Empfindlichkeit geprüft und greift unabhängig davon, ob die entsprechende Kategorie aktiviert ist.

Eskalation

Standardmäßig aus. Wenn an, erhalten Wiederholungstäter zunehmend härtere Aktionen.
1

Stufen hinzufügen

Jede Stufe ist eine Verstoßzahl (1–99) plus Aktion, mit Dauer für Timeout, Mute und Ban. Bis zu 20 Stufen.
2

Verfallsfenster setzen

1 bis 30 Tage, Standard 7. Nach dieser Zeit zählt ein Verstoß nicht mehr.
Die aktuelle Nachricht zählt in die Summe hinein. Eine Stufe, die auf 1 Verstoß gesetzt ist, greift beim ersten Vergehen des Mitglieds, nicht beim zweiten.
Die Aktion einer Stufe ersetzt die Strafe der Kategorie, behält aber Löschen und Alert, wenn die Kategorie sie hatte. Eskalation eskaliert die Strafe; sie verhindert nicht, dass die Nachricht entfernt wird.
Eine Dauer ist auf ein Jahr begrenzt. Das Dashboard akzeptiert Werte wie 100.000 Stunden, die der Server dann mit einem generischen Speicherfehler ablehnt — halte Dauern innerhalb eines Jahres.

Ausnahmen

  • Ausgenommene Rollen — Mitglieder mit einer davon werden komplett übersprungen
  • Ausgenommene Kanäle — Nachrichten hier werden nie gescannt
  • Ausgenommene Nutzer — bis zu 500, nützlich für Bots
Mitglieder mit Administrator werden nie gescannt, egal ob du sie ausnimmst oder nicht. Diese Prüfung läuft, bevor ein Token ausgegeben wird.

Bestätigung vor Kick und Ban

Standardmäßig an. Kick- und Ban-Aktionen werden zur Freigabe durch einen Moderator gepostet, statt sofort angewendet zu werden.
Die Bestätigung hält die Löschung nicht zurück. Enthält das Aktionsset der Kategorie „Löschen“, wird die Nachricht in dem Moment entfernt, in dem der Verstoß erkannt wird. Nur Kick oder Ban warten auf Freigabe.
Bestätigungen laufen nach einer Stunde ab. Sie werden in deinem Alert-Kanal gepostet, mit Rückfall auf den Log-Kanal, mit Rückfall auf den Kanal, in dem die Nachricht war.

Trust Tiers

Eine Token-sparende Maßnahme. Mitglieder mit langer sauberer Historie werden seltener gescannt. Vier Absicherungen sorgen dafür, dass ein vertrautes Mitglied nie unsichtbar wird:
  1. Discord-Einladungen, @everyone/@here und 5+ Erwähnungen werden immer gescannt — keine Ausnahmen
  2. Ein Ausbruch von 3 Nachrichten in 6 Sekunden erzwingt einen Scan
  3. Sampling erreicht nie null — ein vertrautes Mitglied wird weiterhin regelmäßig gescannt
  4. Jeder Verstoß setzt das Vertrauen sofort auf null zurück
Auf einem stark frequentierten Server können Trust Tiers die Token-Kosten deutlich senken, weil die Mitglieder, die am meisten posten, meist genau die sind, die nie Regeln brechen.
Die Liste Vertrauenswürdige Mitglieder zeigt, wer aktuell qualifiziert ist. Reduzieren halbiert die Punktzahl einer Person; Entfernen löscht sie ganz. Beides wirkt sofort — die Speicherleiste ist nicht beteiligt.

Kanäle

  • Log-Kanal — jedes Moderations-Ereignis mit erkannter Kategorie und Konfidenz
  • Alert-Kanal — hochkritische Ereignisse und Bestätigungsanfragen
Sind beide nicht gesetzt, läuft KI-Moderation und agiert ohne irgendwo sichtbare Aufzeichnung.

Wenn das Token-Guthaben ausgeht

KI-Auto-Mod ist fail-closed: Wenn nicht bestätigt werden kann, dass Budget vorhanden ist, wird nicht gescannt. Hinweise gehen an deinen Alert-Kanal, mit Rückfall auf den Log-Kanal. Die Niedrig-Guthaben-Warnung feuert erneut, wenn sich das Guthaben erholt und ein zweites Mal abfällt.

KI-Nutzung

Verfolge Ausgaben, sieh, was gescannt wurde, und lade auf.

Was ein Scan kostet

Eine Nachricht erzeugt einen KI-Aufruf. Eine Nachricht mit Bildern erzeugt einen Aufruf für den Text plus einen pro Bild, bis zu vier.
Wenn Bildscannen für deinen Server nicht wichtig ist, ist das Ausschalten von Bilder scannen die größte einzelne Einsparung, die möglich ist.

Benutzernamen-Scan

Anzeigenamen und Benutzernamen werden beim Beitritt eines Mitglieds und bei Namensänderungen geprüft. Eine Löschen-Aktion ergibt für einen Namen keinen Sinn, daher wird sie zu einem Alert.

Fehlerbehebung

Arbeite Folgendes der Reihe nach ab:
  1. Ist KI-Auto-Mod in der Server-Einrichtung an?
  2. Hast du irgendwelche Kategorien aktiviert? Standardmäßig ist nur eine an.
  3. Bist du im Monitor-Modus? Er protokolliert, aber greift nie ein.
  4. Ist dein Token-Guthaben über 3.000?
  5. Sind die betroffenen Mitglieder Administratoren oder auf einer Ausnahmeliste?
Senke die Empfindlichkeit der konkreten Kategorie, die zu oft feuert, statt des globalen Reglers. Kehre zum Monitor-Modus zurück, während du justierst.
Schalte Bildscannen aus, aktiviere Trust Tiers, nimm stark frequentierte Kanäle aus, die keine Moderation brauchen, und deaktiviere Kategorien, die dich nicht interessieren.
Ein Server mit aktiviertem Modul, aber ohne je gespeicherter Konfiguration ist völlig still. Öffne diese Seite, setze deine Kategorien und einen Log-Kanal und speichere einmal.
Genau damit umgeht KI-Auto-Mod und Standard-Auto-Mod nicht. Stelle sicher, dass die passende Kategorie aktiviert ist und ihre Empfindlichkeit nicht zu niedrig eingestellt ist.

Auto-Moderation

Musterbasierte Filterung, in jeder Stufe kostenlos.

KI-Server-Steuerung

Den Server durch Sprechen mit dem Bot verwalten.