Gesamtschau

Wo die KI-Erkennung an ihre Grenzen stößt

KI-Erkennung liefert Wahrscheinlichkeiten, keine Nachweise. Das ist keine Schwäche einzelner Anbieter, sondern liegt am Verfahren selbst: Gemessen wird die Form eines Textes, nicht seine Herkunft. Was daraus folgt, steht hier gebündelt.

Server in Deutschland Ergebnis in 15 Min. 70 Mrd. Quellen

 |  Zuletzt geprüft: 26.08.2026  |  6 Min. Lesezeit

Wo hört die KI-Erkennung auf?

An der Frage nach der Herkunft. Ein Detektor sieht nur den fertigen Text und misst, wie erwartbar er verläuft. Aus dieser Form lässt sich keine Autorschaft ableiten, weil dieselbe Form auf sehr verschiedenen Wegen entstehen kann.

Alles Weitere folgt daraus. Es ist kein Reifeproblem, das sich mit der nächsten Version erledigt.

Was ein Detektor tatsächlich misst

Zwei Größen stehen im Mittelpunkt: wie überraschend das nächste Wort ist und wie stark Satzlängen und Satzbau schwanken. Beide erklärt die Seite zu Perplexität und Burstiness.

Sprachmodelle wählen im Mittel das erwartbare Wort. Menschen tun das auch, sobald sie in einer normierten Textsorte schreiben: in einem Methodenteil, in einer Definition, in einem Antragsformular. Das Verfahren kann diese beiden Fälle nicht trennen, weil es nur die Oberfläche kennt.

Wer eine Prozentangabe im Bericht sieht, sieht das Ergebnis dieser Messung, nicht den Anteil generierter Wörter. Was die Zahl rechnerisch bedeutet, steht unter KI-Anteil in Prozent.

Sechs Grenzen, die bleiben

  • Kein Signal im Text. Maschinell erzeugte Sprache trägt kein Merkmal, das sie als solche ausweist. Es gibt nichts zu finden, nur etwas zu schätzen.
  • Bewegliches Ziel. Modelle ändern sich schneller, als Verfahren nachkalibriert werden. Ein Detektor kennt immer den Stand von gestern.
  • Mischtexte. Der Normalfall ist heute ein Text aus eigenen und fremden Anteilen. Warum das der schwerste Fall ist, steht unter gemischte Texte.
  • Sprache. Für Deutsch ist die Datenlage dünner als für Englisch, siehe Detektoren bei deutschen Texten. Für kleinere Sprachen wird es noch dünner.
  • Kürze. Wenige Sätze liefern zu wenige Messpunkte. Ein Abstract oder eine Antwort auf eine Prüfungsfrage ist statistisch kaum beurteilbar.
  • Rückkopplung. In den Textbeständen, aus denen Verfahren lernen, steht inzwischen selbst maschinell erzeugte Sprache. Die Referenz für „menschlich" verschiebt sich.

Warum wir keine Genauigkeitszahl nennen

Für belastbare Angaben bräuchte es eine öffentliche, unabhängig zusammengestellte Testgrundlage, die alle Anbieter benutzen. Die gibt es nicht. Jede Quote stammt aus eigenen Tests mit eigener Datenauswahl. Wir könnten eine Zahl nennen, sie wäre nur nichts wert.

Was ein Ergebnis aussagt und was nicht

Frage Was der Scan beantwortet Was offen bleibt
Wirkt der Text sprachlich vorhersehbar? Ja, abschnittsweise und nachvollziehbar Warum er so wirkt
Welche Passagen fallen auf? Ja, mit Markierung im Bericht Ob die Ursache KI oder Textsorte ist
Wie hoch ist der KI-Anteil? Nur als Messwert, nicht als Wortanteil Welche Sätze tatsächlich generiert sind
Wer hat den Text geschrieben? Gar nicht Alles daran
Ist die Arbeit sauber entstanden? Gar nicht Alles daran

Die letzten beiden Zeilen sind der Kern dieser Seite. Ein Verfahren, das die entscheidende Frage nicht beantworten kann, darf nicht so behandelt werden, als täte es das.

Wen die Grenzen am härtesten treffen

Menschen, die selbst geschrieben haben und trotzdem auffallen. Wer Deutsch als zweite Sprache schreibt, meidet Idiome, wählt geläufige Wörter und baut vorsichtige Sätze. Das Verfahren misst diese Vorsicht und nennt sie Vorhersagbarkeit.

Dieselbe Lage haben sehr strukturiert schreibende Personen: Wer nach Plan formuliert, jeden Absatz gleich aufbaut und Wiederholungen streicht, erzeugt genau die Gleichmäßigkeit, die als Signal gilt. Dazu kommen Fächer mit normierter Sprache, von der juristischen Gutachtentechnik bis zum medizinischen Befund. Die ausführliche Darstellung steht unter Falsch-Positive verstehen.

Diese Gruppen tragen die Kosten der Unschärfe. Deshalb ist die ehrliche Kommunikation über Grenzen kein Nebenthema, sondern eine Frage der Fairness.

Was du praktisch damit machst

  1. Den Bericht als Karte lesen. Er zeigt dir, wo dein Text gleichförmig wirkt. Das ist eine brauchbare Überarbeitungshilfe, auch wenn nie eine KI beteiligt war.
  2. Inhaltlich schärfen statt sprachlich verstellen. Eigene Daten, konkrete Beispiele, eine kritische Einordnung. Solche Absätze gibt es nirgendwo sonst.
  3. Entstehung dokumentieren. Zwischenstände, Notizen und Versionsverlauf sind bei einem Verdacht das stärkste Mittel, siehe KI-Vorwurf widerlegen.
  4. Nicht auf Wasserzeichen warten. Wie realistisch solche Verfahren sind, ordnet der Beitrag zu Wasserzeichen und C2PA ein.
  5. Prüfst du fremde Arbeiten, dann inhaltlich zuerst. Quellen nachschlagen schlägt jeden Messwert, weil es belegbar ist.

Wie eine seriöse Prüfung damit umgeht

Sie nennt die Grenzen, bevor sie ein Ergebnis nennt. Ein Bericht ist ein Anlass, genauer hinzusehen: markierte Stellen lesen, Textsorte einordnen, mit früheren Arbeiten derselben Person vergleichen, nach dem Arbeitsweg fragen. Am Ende steht ein Gespräch, kein Rechenergebnis.

Für unseren KI Scan gilt das genauso. Er liefert Markierungen und eine Einschätzung. Er liefert keinen Beweis, und wir behaupten das an keiner Stelle. Ein Anbieter, der dir Sicherheit verspricht, verspricht etwas, das dieses Verfahren nicht hergibt.

Was die Grenzen für dich praktisch bedeuten

Aus all dem folgt keine Entwarnung und keine Panik, sondern eine nüchterne Konsequenz: Ein Score ist eine Information, kein Urteil — und du solltest ihn behandeln wie eine Information.

Für dich als schreibende Person heißt das dreierlei. Erstens: Ein niedriger Wert ist kein Freibrief. Wenn du Passagen übernommen hast, bleibt das ein Problem, unabhängig davon, was ein Detektor meldet. Zweitens: Ein hoher Wert ist kein Schuldspruch, aber ein Grund, vorbereitet zu sein. Drittens: Die einzige Absicherung, die unabhängig von jedem Werkzeug funktioniert, ist ein dokumentierter Schreibprozess.

Für Lehrende heißt es etwas anderes. Ein Detektorergebnis kann ein Gespräch eröffnen. Es kann keine Bewertung begründen. Wer daraus unmittelbar eine Konsequenz ableitet, stützt eine Prüfungsentscheidung auf eine Wahrscheinlichkeitsangabe — und genau dagegen ist im Zweifel wenig zu sagen, wenn es überprüft wird.

  • Ein Wert allein trägt keinen Täuschungsvorwurf.
  • Die Verteilung über den Text sagt mehr als der Gesamtwert.
  • Kurze Texte liefern unzuverlässigere Werte als lange.
  • Deutsche Texte sind schwerer einzuschätzen als englische.
  • Überarbeitete Texte entziehen sich der Messung weitgehend.
  • Der Schreibprozess ist der einzige belastbare Nachweis, in beide Richtungen.

Preis, Ablauf und Datenschutz beim KI Scan

Der KI Scan kostet 0,29 € pro Normseite mit 1.800 Zeichen inklusive Leerzeichen. Zusammen mit dem Plagiat Scan zahlst du 0,39 € statt 0,58 € pro Normseite. Eine Masterarbeit mit 60 Normseiten kostet damit 17,40 € im KI Scan oder 23,40 € im Kombi-Scan.

Hochladen kannst du .docx, .doc, .pdf, .txt, .odt, .rtf und .pages, bis 50 MB und bis 999 Normseiten. Der Bericht liegt in der Regel nach 15 Minuten bereit, in seltenen Fällen dauert es bis zu 24 Stunden. Verarbeitet wird auf Servern in Deutschland nach DSGVO. Deine Datei wird nach 14 Tagen gelöscht und nicht in eine Vergleichsdatenbank aufgenommen. Ein Konto brauchst du nicht.

FAQ

Häufige Fragen

Nein, und kein seriöser Anbieter behauptet es. Ein Detektor vergleicht die Form eines Textes mit dem, was er als typisch gelernt hat. Daraus folgt eine Wahrscheinlichkeit. Zwischen Wahrscheinlichkeit und Nachweis liegt der ganze Unterschied.
Weil eine unabhängige, allgemein anerkannte Testgrundlage fehlt. Jeder Anbieter misst an eigenen Daten, deren Zusammensetzung niemand nachprüfen kann. Eine Quote aus solchen Tests gilt für diese Daten und nicht für deinen Text.
Sie werden angepasst, aber das Ziel bewegt sich mit. Jede neue Modellgeneration schreibt anders, und ein Verfahren, das auf ältere Ausgaben kalibriert ist, verliert an Trennschärfe. Ein dauerhafter Vorsprung einer Seite ist nicht in Sicht.
Ansätze dafür gibt es. Sie greifen aber nur, wenn der Anbieter des Modells sie einsetzt, wenn das prüfende System sie lesen kann und wenn der Text nicht überarbeitet wurde. Als allgemeine Lösung stehen sie heute nicht zur Verfügung.
Als strukturierter Hinweis. Er zeigt dir abschnittsweise, welche Passagen statistisch auffallen, und gibt dir damit einen Ausgangspunkt zum Überarbeiten oder Nachfragen. Als Entscheidungsgrundlage für einen Vorwurf taugt er nicht.
0,29 € pro Normseite mit 1.800 Zeichen inklusive Leerzeichen. Zusammen mit der Plagiatsprüfung zahlst du 0,39 € statt 0,58 € pro Normseite. Es gibt kein Abo und keine Grundgebühr, jeder Scan wird einzeln abgerechnet.

Ein Hinweis, kein Urteil: der KI Scan

Du erfährst vor deiner Hochschule, wie dein Text bewertet wird.

KI Scan 0,29 € / Normseite
Jetzt KI Scan starten