ProofreaderPro.ai
KI-Text-Optimierung

QuillBot-AI-Detektor vs paraphrasierter und humanisierter Text

Der KI-Detektor von QuillBot ist bei schlichtem sowie paraphrasiertem KI-Text nahezu fehlerfrei, doch eine Studie aus dem Jahr 2025 ergab, dass seine Trefferquote auf 58% sinkt, sobald der Text humanized wurde.

Dana|6. Okt. 2026|8 min Lesezeit
QuillBot-AI-Detektor vs paraphrasierter und humanisierter Text - ProofreaderPro Blog

Der KI-Detektor von QuillBot ist beim Erkennen von einfachem und paraphrasiertem KI-Text nahezu fehlerfrei. Seine Genauigkeit fällt jedoch auf 58%, sobald dieser Text über einen humanizer gelaufen ist, laut einer unabhängigen Studie aus dem Jahr 2025. QuillBot baut außerdem einen der beliebtesten KI-Paraphraser, daher muss sein eigener Detektor genau mit der Art umformulierten Textes umgehen, den seine anderen Tools erzeugen.

Dieser Beitrag erklärt, wie QuillBot einen Scan kennzeichnet, was die Studie aus dem Jahr 2025 zu paraphrasiertem und humanisiertem Text fand und was QuillBot zur eigenen Genauigkeit behauptet. Außerdem wird behandelt, welche Grenzen in der kostenlosen Version und in Premium gelten und wie der Detektor mit Turnitin zusammenhängt.

Wie QuillBots Detektor einen Text kennzeichnet

Ein QuillBot-Scan liefert eine Punktzahl von 0% bis 100%. Zusätzlich gibt er eines von drei Labels aus: KI-generiert, vom Menschen geschrieben oder KI-verfeinert. QuillBot verwendet das Label KI-verfeinert für Texte, mit denen eine Person begonnen hat, die dann von einem KI-Tool bearbeitet oder paraphrasiert wurden. Das ist etwas anderes als Text, den ein Modell von Grund auf selbst geschrieben hat. QuillBot wendet diese drei Labels unabhängig davon an, welches seiner eigenen Tools den Text zuerst verändert hat, sofern überhaupt eines seiner Tools zunächst beteiligt war.

Die Seite des QuillBot-AI-Detektors, die das Text-Einfügefeld und die Aufforderung zeigt, Text für den Scan hinzuzufügen

In der Praxis lassen sich die drei Labels auf drei typische Situationen zurückführen. Eine vollständig ausgearbeitete ChatGPT- oder DeepSeek-Antwort, die unverändert eingefügt wird, wird normalerweise als KI-generiert gekennzeichnet. Ein menschlicher Entwurf, bei dem nur die Grammatik korrigiert wurde, bleibt üblicherweise „vom Menschen geschrieben“, da diese Art von Bearbeitung die Satzstruktur nicht verändert. Ein menschlicher Entwurf, der von einem Paraphraser umformuliert wurde, oder der von einem humanizer neu geschrieben wurde, ist der Fall, für den QuillBot das Label „KI-verfeinert“ entwickelt hat.

Neben jedem markierten Satz erscheint eine Erklär-Karte mit einer kurzen Begründung, etwa „vorhersehbare Wortwahl“ oder ein ungewöhnlich gleichmäßiger Rhythmus. Diese beiden Signale, vorhersehbare Wortwahl und Satzrhythmus, decken sich mit Konzepten wie „Perplexity“ und „Burstiness“, also den Kennzahlen, die die meisten KI-Detektoren unter dem einen oder anderen Namen verwenden. Unser Erklärartikel zu Perplexity bei der KI-Erkennung erklärt, wie das im Detail funktioniert.

QuillBot empfiehlt mindestens 80 Wörter für eine verlässliche Punktzahl. Laut QuillBot ist die Genauigkeit bei 300 Wörtern oder mehr am besten. Ein kurzer Abschnitt, etwa ein Absatz, der aus dem Kontext herausgelöst wurde, bietet dem Modell deutlich weniger Angriffsfläche als ein vollständiges Dokument. QuillBot prüft einen Dokumenttext Satz für Satz, statt ihn als einen einzigen Block zu bewerten. Ein langes Dokument mit nur einem KI-verfeinerten Absatz wird daher nicht zwangsläufig insgesamt als KI-generiert eingestuft.

Keine dieser Kennzeichnungen ist dauerhaft. QuillBot kann denselben Text nach einer Überarbeitung erneut scannen, und das Label kann sich zwischen den Kategorien verschieben, sobald sich die Formulierungen ändern. Eine Punktzahl aus einem einzelnen Scan beschreibt genau diese eine Version des Dokuments. Sie zeigt nicht, wie das Dokument ursprünglich verfasst wurde.

Seitenbetreiber und Blogger können außerdem ein QuillBot-Zertifikat sowie ein Verifizierungs-Badge für eine veröffentlichte Seite anfordern. Damit lässt sich zeigen, dass die Seite vom Menschen geschrieben wurde. Diese Funktion ist unabhängig vom eigentlichen Scan-Eingabefeld und richtet sich an Verlage, die auf einer Live-Seite einen Nachweis für Urheberschaft bereitstellen möchten.

Eine Studie aus dem Jahr 2025: QuillBot bei DeepSeek, paraphrasiertem und humanisiertem Text

A 2025-Studie von Hulayyil Alshammari und Praveen Rao, veröffentlicht auf arXiv, testete sechs KI-Detektoren anhand von Texten aus DeepSeek-v3. Die sechs waren AI Text Classifier, Content Detector AI, Copyleaks, QuillBot, GPT-2 und GPTZero. Die Forschenden starteten mit 49 selbst verfassten Frage-und-Antwort-Paaren aus der Zeit vor der LLM-Ära und generierten anschließend 49 passende DeepSeek-v3-Antworten auf genau diese Fragen. Danach fügten sie 196 weitere Stichproben hinzu, indem sie die KI-Antworten umformulierten und menschlicher machten, und werteten anschließend alle sechs Detektoren anhand des gesamten Datensatzes aus.

DeepSeek-v3 ist ein neueres Modell als die, auf die die meisten öffentlich verfügbaren Detektoren abgestimmt sind. Das ist ein Grund, warum diese Studie aufschlussreich ist. Ein Detektor, der hauptsächlich auf Ausgaben im ChatGPT-Stil entwickelt und trainiert wurde, kann nicht automatisch genauso zuverlässig damit umgehen, wenn ein anderes Modell denselben Stil-Frame anders schreibt. Auch der Start mit realen menschlichen Antworten, die geschrieben wurden, bevor es große Sprachmodelle gab, schließt die Möglichkeit aus, dass die menschlichen Beispiele selbst bereits von KI beeinflusst waren.

Bedingung (DeepSeek-v3-Text)QuillBots Ergebnis in der Studie
Original, uneditiertFast perfekt
UmformuliertFast perfekt
Menschlicher gemacht58% Genauigkeit

QuillBot und Copyleaks schnitten im Original sowie in der umformulierten DeepSeek-Version jeweils nahezu perfekt ab, das heißt, sie verfehlten nur sehr wenige dieser Stichproben. Einige der anderen Tools in der Studie, darunter AI Text Classifier und GPT-2, lieferten dagegen bei denselben Stichproben uneinheitliche Ergebnisse. Das Humanisieren des Textes war die Veränderung, die die Genauigkeit über alle sechs Detektoren hinweg am stärksten beeinflusste. Dadurch sank Copyleaks auf 71%, QuillBot auf 58% und GPTZero auf 52%.

Der Textdatensatz der Studie ist im Vergleich zu gängigen Detector-Benchmarks eher überschaubar: 49 ursprüngliche menschliche Antworten, 49 unedierte DeepSeek-v3-Antworten und 196 weitere, die durch Umformulieren und Humanisieren dieser KI-Antworten erstellt wurden. Das reicht aus, um ein klares Muster über sechs Detektoren hinweg zu erkennen, aber ein größerer Datensatz würde genauere Prozentwerte liefern. In dem Paper wurde außerdem DeepSeek selbst als Detektor getestet, mit Few-Shot-Beispielen und Chain-of-Thought-Prompting statt eines dedizierten Detektormodells. Dieser Teil der Studie bezieht sich auf die eigene Klassifizierungsfähigkeit von DeepSeek und enthält kein QuillBot-Ergebnis.

Für Personen, die einen KI-Entwurf umformulieren und sich darauf allein verlassen, ist diese Studie eine nützliche Datenquelle. Durch das Umformulieren sank die Genauigkeit von QuillBot in diesem Test nicht. Das reine Umstellen von Wörtern und das Verändern der Satzstruktur reichte allein nicht aus, um das Ergebnis zu verändern. Das Humanisieren des Textes war die einzige Änderung, die die Genauigkeit von QuillBot gesenkt hat, und QuillBot erkannte weiterhin die meisten menschlich gemachten Stichproben.

Für Studierende ist der praktische Teil dieses Ergebnisses der Unterschied zwischen Umformulieren und Neuschreiben. Ein Umformulierer verändert Wörter und ein Stück weit die Reihenfolge der Sätze. Neuschreiben aus Ihrem eigenen Verständnis verändert dagegen die Argumentation, die Beispiele und die Struktur, und genau das macht einen Entwurf zu etwas Eigenem.

Was QuillBot über die Genauigkeit sagt

QuillBot nennt eine 99%-Erkennungsrate für RAID, einen unabhängigen Benchmark, der mehrere große Sprachmodelle abdeckt. Wir erklären, was RAID in unserem Beitrag zu Grammarlys KI-Detektor, der auf RAIDs Rangliste den ersten Platz belegt, testet.

In der FAQ von QuillBot werden zwei Bedingungen genannt, unter denen es eher zu Fehlern kommen soll. Formelhafte Texte, etwa wissenschaftliche Definitionen, rechtliche Formulierungen oder strukturierte Vorlagen, lösen eher einen False Positive aus. Stark umformulierte oder nur leicht von KI bearbeitete Texte sind für jeden Detektor schwieriger zu identifizieren. QuillBot sagt außerdem, dass kein KI-Detektor 100% Genauigkeit erreicht, und dass ein Ergebnis als ein Signal zu behandeln ist.

Die Studie von 2025 oben liefert einen unabhängigen Datenpunkt zu einem neueren Modell, DeepSeek-v3, für das viele Detektoren ursprünglich nicht abgestimmt waren.

Die Seite zum KI-Humanizer von QuillBot macht einen verwandten Punkt dazu, wie das Unternehmen sein gesamtes KI-Schreib-Toolkit einordnet. Sie sagt, der KI-Humanizer solle eine Überarbeitung verbessern, und sie fordert Nutzer dazu auf, die Verwendung von KI im Rahmen der Richtlinie ihrer Einrichtung oder ihres Arbeitgebers offenzulegen. Diese Einordnung gilt auch für den Detektor im selben Konto.

Struktur und Formulierungen neu schreiben

Unser akademischer KI-Humanizer verändert auch den Satzrhythmus und die Satzstruktur sowie die Wortwahl, und Ihre Zitationen, Fachbegriffe und Zahlen bleiben unverändert.

Probieren Sie ProofreaderPro.ai kostenlos

Kostenlos vs. Premium

FunktionKostenlosPremium
Wortlimit pro ScanBis zu 1.200 WörterKein Wortlimit
Tägliche ScansBis zu 6Unbegrenzt
Erklärkarten1 kostenlose KarteUnbegrenzt für den gesamten Text
PreisUS$0US$4,17 pro Monat, jährlich abgerechnet

Der kostenlose KI-Detektor von QuillBot begrenzt jeden Scan auf 1.200 Wörter und erlaubt sechs Scans pro Tag, jeweils mit einer Erklärkarte pro Scan. Premium entfernt beide Limits und bietet für jeden markierten Satz eine vollständige Erklärung statt nur einer. Die übrigen QuillBot-Tools sind im gleichen Preis enthalten: US$4,17 pro Monat bei jährlicher Abrechnung.

Wer nur eine einzelne kurze Aufgabenstellung prüft, wird die kostenlosen Limits vermutlich nie erreichen, da ein Scan etwa vier Seiten Text mit doppeltem Zeilenabstand abdeckt. Ein 6.000-Wörter-Exposé, geprüft in 1.200-Wörter-Abschnitten, braucht fünf Scans im Free-Tarif, innerhalb des Sechs-Splits pro Tag. Ein längeres Dissertationskapitel, mehrfach geprüft in derselben Sitzung, ist der Fall, in dem Sie am ehesten das tägliche Limit erreichen. Premium ermöglicht außerdem das Herunterladen einer Kopie des vollständigen Berichts. Das ist hilfreich, wenn ein Vorgesetzter oder ein Lektor die Detailerklärung sehen möchte, nicht nur den finalen Prozentsatz.

QuillBot-Dedektor und Turnitin

Der KI-Detektor von QuillBot und Turnitin sind zwei getrennte Tools, von zwei unterschiedlichen Unternehmen entwickelt, und ein Wert aus dem einen sagt nichts über einen Wert aus dem anderen aus. Turnitin lizenziert seine Erkennung für KI-Schreiben an Schulen, Universitäten und Verlage, sodass die meisten Studierenden ein Turnitin-Ergebnis nur über eine Lehrkraft sehen. Unser Leitfaden zu Turnitin-Werten erklärt, wie Turnitin seine eigenen KI- und Ähnlichkeitswerte anzeigt.

Im August 2025 hat Turnitin eine Funktion eingeführt, die es AI bypasser detection nennt. Dabei handelt es sich um eine Reihe von Modellen, die für Texte ausgerichtet sind, die durch einen KI-Humanizer oder einen starken Paraphraser gegangen sind. Die Funktion deckt derzeit nur Englisch ab. Unser Leitfaden zu einer Alternative für den QuillBot KI-Humanizer erläutert, was dieses Update speziell für den eigenen KI-Humanizer von QuillBot bedeutet.

Die praktische Lücke zwischen den beiden Tools ist vor allem für alle entscheidend, die über einen Turnitin-aktivierten Kurs einreichen. Ein QuillBot-Wert, selbst wenn er beruhigend ist, sagt nichts darüber aus, ob der eigene KI-Schreberbericht von Turnitin ebenfalls einen niedrigen Wert zeigen wird. Beide Systeme laufen mit unterschiedlichem Trainingsdatenmaterial und unterschiedlichen Schwellenwerten.

Die Studie von DeepSeek oben zeigt eine ähnliche Trennung. Nur Paraphrasieren senkte nicht die Genauigkeit von QuillBot oder Copyleaks, während Humanizing es tat. Das Update von Turnitin aus dem Jahr 2025 zielt auf genau diese Lücke: Text wird so umformuliert, dass er sich anders liest, trägt aber weiterhin die strukturellen Muster, die ein Detektor messen kann.

Wenn Ihr Kurs Turnitin nutzt, behandeln Sie einen QuillBot-Scan als eine Prüfung Ihres Entwurfs und bewahren Sie das Ergebnis zusammen mit Ihren Notizen auf. Wenn eine Lehrkraft später ein Turnitin-Ergebnis infrage stellt, sind Ihre Entwürfe und Notizen bessere Belege als jeder einzelne Wert, wie wir in Prozess ist der neue Beweis erklären.

Der kostenlose KI-Detektor von Scribbr basiert auf der eigenen Technologie von QuillBot. Die Seite des Scribbr-Detektors lädt den Scan von quillbot.scribbr.com, einem QuillBot-Subdomain, das für Scribbrs Website eingerichtet wurde, über ein Partner-Skript von QuillBot. Unser Blick auf den KI-Detektor von Scribbr erklärt, was das für die eigenen Ergebnisse von Scribbr bedeutet.

Wenn Sie eine KI-Vorlage umformuliert haben und sich allein darauf verlassen, ist die Studie oben einen zweiten Blick wert. Wenn Sie den Inhalt aus Ihren eigenen Notizen umschreiben, mit Ihren eigenen Beispielen und Ihrer eigenen Struktur, ändert das mehr an einem Text, als es ein Umformulierer tut. Wenn Sie zunächst lieber Tools direkt miteinander vergleichen möchten, decken unser QuillBot-Alternativtool für wissenschaftliches Schreiben und unser ProofreaderPro.ai vs QuillBot Vergleich ab, wo QuillBot bei akademischen Entwürfen passt. Welche Route Sie auch wählen, QuillBots eigene Hinweise gelten weiterhin: Legen Sie KI-Unterstützung gemäß der Richtlinie Ihres Kurses oder Arbeitgebers offen, unabhängig davon, was irgendein Detektorwert anzeigt. Unser KI-Humanizer für akademisches Schreiben ist darauf ausgelegt, bei KI-Prüfungen niedrige Werte zu erreichen, indem er sowohl die Satzstruktur als auch die Wortwahl verändert, während Zitationen, Fachbegriffe und Zahlen unangetastet bleiben.

Häufig gestellte Fragen

Q: Kann QuillBots KI-Detektor seinen eigenen Umformulierer erkennen?

Bei rein umformuliertem Text: ja. Eine Studie aus dem Jahr 2025 von Alshammari und Rao ergab, dass der Detektor von QuillBot bei DeepSeek-v3 Text, der durch einen Umformulierer gelaufen war, nahezu perfekt war. Das Humanisieren desselben Textes war eine größere Herausforderung und senkte die Genauigkeit von QuillBot in dieser Studie auf 58%.

Q: Funktioniert QuillBots KI-Detektor bei DeepSeek-Text?

Ja. Dieselbe Studie aus dem Jahr 2025 testete QuillBot speziell an DeepSeek-v3-Ausgaben und fand bei der Original- und bei der umformulierten Version nahezu perfekte Ergebnisse, die mit der Leistung von Copyleaks in diesem Test übereinstimmten.

Q: Was bedeutet „KI-überarbeitet“ in QuillBot?

Das ist QuillBots Bezeichnung für Texte, die ursprünglich aus dem eigenen Text einer Person entstanden sind und dann mit einem KI-Tool bearbeitet oder umformuliert wurden, statt von einem Modell von Grund auf neu geschrieben zu werden. QuillBot bewertet Satz für Satz, sodass ein KI-überarbeiteter Absatz das gesamte Dokument nicht zu einem KI-generierten Ergebnis macht.

Q: Wie viele Wörter kann ich kostenlos prüfen?

Bis zu 1.200 Wörter pro Scan, mit bis zu sechs Scans pro Tag im kostenlosen Plan von QuillBot. Premium entfernt beide Limits für US$4.17 pro Monat, jährlich abgerechnet.

Q: Lohnt sich QuillBot Premium nur wegen des Detektors?

Das hängt davon ab, wie oft Sie scannen und wie lange Ihre Dokumente sind. Premium entfernt das 1.200-Wort-Limit und die tägliche Begrenzung auf sechs Scans, und es ergänzt für jeden markierten Satz eine vollständige Erklärung statt nur einer. Die übrigen Tools von QuillBot sind im gleichen Preis enthalten.

Q: Kann Turnitin QuillBot-Umformulierungen erkennen?

Oft, ja. Turnitin führte im Juli 2024 eine eigene Erkennung für KI-Umformulierungen ein und im August 2025 eine KI-Bypass-Schicht, die auf Texte abzielt, die durch einen KI-Humanizer oder einen besonders starken Umformulierer gelaufen sind. Unser Leitfaden zu einer Alternative zu QuillBot Humanizer beschreibt das gesamte Bild.

Q: Funktioniert QuillBots Detektor auch in anderen Sprachen?

Ja. Laut QuillBot unterstützt der KI-Detektor mehr als 20 Sprachen, darunter Englisch, Spanisch, Französisch und Portugiesisch. Der KI-Humanizer deckt weniger Sprachen ab: Spanisch, Deutsch, Französisch, Portugiesisch sowie vier englische Dialekte.

Q: Ist QuillBots Detektor das Gleiche wie der von Scribbr?

Weitgehend, ja. Die Seite zum KI-Detektor von Scribbr lädt ihren Scan von quillbot.scribbr.com, einem QuillBot-Subdomain, über ein in die Seite eingebettetes QuillBot-Partner-Skript. Unser Blick auf Scribbrs KI-Detektor erklärt, wie Scribbr die eigenen Ergebnisse aus demselben Tool darstellt.

Akademischer KI-Humanizer

Schreiben Sie KI-gestützte akademische Entwürfe um, während Ihre Zitationen, Terminologie und Bedeutung unverändert bleiben.

Dana - Author at ProofreaderPro.ai
DanaContent Creator

Dana ist Content-Erstellerin bei ProofreaderPro, wo sie den täglichen Blog- und Schreibbetrieb leitet. Sie schreibt die Artikel über die Funktionsweise der Online-Bearbeitungsplattform und bearbeitet täglich Kundennachrichten, was ihr eine Zufriedenheitsbewertung von fünf Sternen einbringt.

Weiterlesen

Teste Text Humanizer kostenlos

Jetzt kostenlos starten
Proofreader Pro AI
Verfeinern Sie Ihre Forschung mit ProofreaderPro.ai, dem weltweit führenden KI-unterstützten Korrekturleser, der speziell für akademische Texte entwickelt wurde.
ProofreaderProAI, Greenleaf Ave, Staten Island, 10310 New York
© 2026 ProofreaderPro.ai. Ein führender akademischer Korrekturleser, Editor und Humanizer. Gemacht mit ❤️ und sprachlich korrekte Syntax 🌳s