Referenta

KI-Detektor

Prüfen, wie stark ein Text auf KI-Erstellung hindeutet, mit Gesamtwert, sechs Prüfverfahren und einer Bewertung einzelner Abschnitte.

Der KI-Detektor schätzt ein, wie stark ein Text nach einem Sprachmodell klingt. Sie erhalten einen KI-Score von 0 bis 100, die Einzelwerte von sechs Prüfverfahren und bei längeren Texten eine Bewertung einzelner Abschnitte. Der Wert ist ein Indiz, kein Beweis: Er hilft Ihnen zu entscheiden, wo sich ein zweiter Blick lohnt.

Wofür es gut ist

  • Eingegangene Texte einordnen, etwa Stellungnahmen, Zuschriften oder Gastbeiträge, bei denen Sie wissen möchten, ob sie maschinell erstellt sein könnten.
  • Auffällige Passagen finden. Der Verlauf im Text zeigt, ob der ganze Text oder nur einzelne Abschnitte KI-typisch wirken.
  • Eigene Entwürfe gegenlesen, bevor sie hinausgehen, wenn ein Text nicht formelhaft wirken soll.

Ein typischer Ablauf

Szenario: Zu einer Anhörung gehen zahlreiche Stellungnahmen ein, und einige lesen sich auffällig gleichförmig.

  1. Öffnen Sie den KI-Detektor über Tools, Bereich Analyse.
  2. Fügen Sie den Text ein, laden Sie ein Dokument hoch oder geben Sie einen Link an. Text, Datei und Links werden zu einem Dokument zusammengeführt. Pro Prüfung ist eine Datei möglich.
  3. Starten Sie die Prüfung. Sechs Verfahren bewerten den Text, danach wird jeder Abschnitt einzeln bewertet. Lange Texte brauchen bis zu zwei Minuten.
  4. Ordnen Sie das Ergebnis ein. Lesen Sie KI-Score, Übereinstimmung und Hinweise zusammen (siehe unten) und sehen Sie sich die auffälligen Abschnitte selbst an.
  5. Sichern Sie das Ergebnis, wenn Sie es brauchen. Kopieren Sie den Prüfbericht, speichern Sie ihn auf dem Schreibtisch oder exportieren Sie ihn als PDF. Andernfalls ist das Ergebnis nach dem Neuladen der Seite nicht mehr da, denn es wird nicht gespeichert.

Das Ergebnis lesen

KI-Score und Einschätzung

Je höher der KI-Score, desto typischer wirkt der Text für ein Sprachmodell. Aus dem Wert ergibt sich die Einschätzung:

KI-ScoreEinschätzungWas es bedeutet
bis 35Kaum Hinweise auf KIDie Prüfverfahren finden wenig, was auf einen maschinell erzeugten Text hindeutet.
über 35 bis 65Uneindeutiges ErgebnisDie Signale liegen im Mittelfeld oder widersprechen sich. Teile des Textes können mit KI erstellt oder überarbeitet sein.
über 65Deutliche Hinweise auf KIDer gewichtete KI-Score liegt im KI-typischen Bereich. Insgesamt zeigt der Text Merkmale, die für Sprachmodelle typisch sind.

Übereinstimmung

Vier trainierte Klassifikatoren bewerten den Text unabhängig voneinander, ihr gewichtetes Mittel ergibt den KI-Score. Die Übereinstimmung (gering, mittel oder hoch) zeigt, wie nah ihre vier Werte beieinanderliegen: unter 20 Punkten Abstand hoch, unter 45 mittel, sonst gering. Fällt ein Klassifikator aus, ist sie gering. Liegen sie weit auseinander, lesen Sie den Score mit mehr Vorsicht, auch wenn er eindeutig aussieht.

Prüfverfahren im Einzelnen

Jedes Verfahren hat einen eigenen Wert von 0 bis 100: unter 40 unauffällig, unter 65 verdächtig, ab 65 KI-typisch.

  • KI-Klassifikatoren: vier trainierte Modelle (E5, Fakespot, TMR und BERT-RAID), die darauf trainiert sind, KI-Texte von menschlichen zu unterscheiden. Ihr gewichtetes Mittel ist der KI-Score.
  • Stilmerkmale: zwei regelbasierte Prüfungen auf KI-typische Wendungen und formelhafte Struktur, die den KI-Score nachjustieren. Sie kennen nur englische Formulierungen. Bei Texten in anderen Sprachen zeigt das Tool sie deshalb als „nicht anwendbar“, ohne Wert.

Verlauf im Text

Für den Verlauf wird der Text in Abschnitte geteilt, in der Regel seine Absätze, und jeder Abschnitt einzeln bewertet. Sehr kurze Absätze wie Überschriften zählen zum folgenden, und ein langer Text ohne Absätze wird in Gruppen von etwa drei Sätzen geteilt. Die Übersichtsleiste zeigt den ganzen Text auf einen Blick: Farbe und Höhe jedes Balkens stehen für die Einschätzung. Die Liste darunter zeigt jeden Abschnitt mit seinem Wert, mit dem Filter "Nur KI-typische" nur die Abschnitte über 65. So fallen Passagen auf, die sich vom Rest abheben, etwa eine eingefügte Zusammenfassung in einem sonst persönlich geschriebenen Text. Ergibt ein Text nur einen einzigen Abschnitt, entfällt diese Ansicht, weil sie den Gesamtwert nur wiederholen würde.

Tipp: Lesen Sie den Wert als Anlass, nicht als Urteil

KI-Detektoren irren sich in beide Richtungen. Sehr formelle, juristische oder übersetzte Texte wirken auf sie oft maschinell, obwohl ein Mensch sie geschrieben hat, und ein KI-Text, der von Hand überarbeitet wurde, fällt mitunter nicht auf. Stützen Sie ein Urteil über eine Person nie allein auf diesen Wert. Nutzen Sie ihn, um zu entscheiden, welche Texte und Abschnitte Sie sich genauer ansehen.

Grenzen

  • Mindestens 50 Zeichen. Unter 80 Wörtern ist die Aussagekraft gering, das Ergebnis weist dann darauf hin.
  • Bis zu 20.000 Zeichen pro Prüfung. Längere Texte werden an einer Absatz- oder Satzgrenze gekürzt, und das Ergebnis nennt, wie viel davon geprüft wurde. Für eine Einschätzung genügt eine Stichprobe. Möchten Sie einen späteren Teil prüfen, fügen Sie ihn einzeln ein.
  • Deutsche Texte werden weniger scharf getrennt. Die Prüfverfahren sind überwiegend auf englische Texte trainiert. Bei deutschen Texten liegen menschlich und maschinell geschriebene Texte näher beieinander, oft beide im unauffälligen oder uneindeutigen Bereich. Werten Sie das Ergebnis deshalb als Tendenz, das Tool zeigt dazu einen Hinweis. Für andere Sprachen ist es nur eine grobe Tendenz.
  • Eine Datei pro Prüfung. Ein gemeinsamer Wert über mehrere unabhängige Dokumente würde keines davon beschreiben. Prüfen Sie Dokumente daher einzeln.
  • Nur geschriebener Text. Bilder, Audio- und Videodateien sowie Scans ohne Texterkennung werden nicht geprüft. Auch Video-Links (etwa YouTube, TikTok, Instagram, X) sind ausgeschlossen: Ein Transkript gesprochener Sprache sagt nichts darüber, ob ein Text mit KI geschrieben wurde.

Datenschutz

Die Prüfung läuft auf einem von Referenta betriebenen Server. Ihr Text wird dafür an diesen Server übermittelt, dort bewertet und nicht gespeichert. Auch das Ergebnis wird nicht abgelegt, es existiert nur in Ihrem geöffneten Fenster. Links ruft Referenta selbst ab und übermittelt nur den gelesenen Text. Hochgeladene Dateien werden wie in den anderen Tools über die Dateiverarbeitung von Referenta ausgelesen und dabei, wie dort, in Ihrem Konto abgelegt.

Personenbezogene Angaben im Text werden für diese Prüfung nicht maskiert: Das Ersetzen von Namen und Zahlen würde genau die Merkmale verändern, die die Prüfverfahren messen.

On this page