AI Humanization

Wie Sie Ihren AI-Erkennungswert senken

Eine geordnete Darstellung dessen, was einen AI-Erkennungswert tatsächlich verändert, von der Änderung, die ihn kaum bewegt, bis zu der, die ihn am stärksten bewegt, und warum es das falsche Ziel ist, der Zahl selbst nachzujagen.

6 min
Ranked list showing how to lower ai score, from synonym swaps to sentence variety to original evidence

Der Student jagt einen Absatz durch einen Detektor, sieht einen Wert von 82 Prozent, ersetzt ein Dutzend Wörter durch Synonyme, ohne auch nur die Form eines einzigen Satzes anzutasten, und prüft erneut. Die Zahl bewegt sich kaum. Die ganze Geschichte: Manche Änderungen bewirken fast nichts, und eine verändert mehr als alle anderen zusammen, aus Gründen, die nichts damit zu tun haben, Software auszutricksen.

Dieser Beitrag erläutert, wie man den AI score in der Reihenfolge senkt, die tatsächlich zählt: welche Änderungen kaum ins Gewicht fallen, welche die Zahl deutlich verschieben, und welche sie am stärksten verschiebt, und warum. Er behandelt auch, was die Zahl tatsächlich misst, denn ein niedrigerer Wert ist aus einem echten Grund erstrebenswert, nämlich klareres, spezifischeres Schreiben, und als Ziel für sich genommen ein schlechtes Ziel.

Turnitin AI writing report showing 71% detected as AI, the combined share of likely AI-generated and AI-paraphrased text in a submission
Die Zahl, um die es in diesem Leitfaden geht: Turnitin's AI writing overview bewertet eine Einreichung mit 71% AI, mit dem eigenen Hinweis, dass der Wert vor jeder Entscheidung eine menschliche Prüfung erfordert.

Was ein AI Score tatsächlich misst

Ein Sprachmodell schreibt, indem es immer wieder das wahrscheinlich nächste Wort vorhersagt, wodurch ein spezifischer statistischer Fingerabdruck entsteht: Satzlängen, die sich häufen, Übergänge aus einer kleinen Menge sicherer Optionen, Wortwahl, die nahe am Zentrum dessen liegt, was in diesem Kontext erwartet wird. Ein AI-Erkennungswert ist eine Schätzung, wie stark ein Abschnitt diesem Fingerabdruck entspricht, erzeugt von einem Klassifikator, der darauf trainiert wurde, ihn zu erkennen, nicht eine Tatsache darüber, wer den Satz getippt hat.

Detektoren definieren die Zahl nicht alle auf dieselbe Weise. Turnitin erklärt ausdrücklich, dass sein Prozentsatz "den Anteil des qualifizierenden Textes innerhalb der Einreichung angibt, den das AI writing detection model von Turnitin als wahrscheinlich von AI generiert einstuft", und stellt klar, dass es sich dabei um den Anteil markierten Textes handelt, nicht um einen Wahrscheinlichkeits- oder Vertrauenswert. Andere Detektoren geben eher einen Vertrauenswert für den Satz selbst aus. In jedem Fall lohnt es sich, eine vollständige Erklärung der Mechanik hinter diesen Zahlen in how AI detectors work zu lesen. Entscheidend ist hier etwas Einfacheres: Die Zahl ist immer eine statistische Schätzung, und jede der folgenden Änderungen wirkt, indem sie die Statistik verändert, die sie erfassen soll, nicht indem sie die Tatsache verbirgt, dass ein Modell beteiligt war.

Synonymaustausch verschiebt einen AI-Score kaum

Ein Wort durch ein selteneres Synonym zu ersetzen, verändert fast nichts an dem Muster, das ein Klassifikator bewertet, weil dadurch die Länge des Satzes, die Satzgefügestruktur und der Rhythmus unverändert bleiben. Ein Modell, das darauf trainiert ist, eine gleichförmige Satzgestalt zu erkennen, ist es gleichgültig, ob ein Satz enables oder allows sagt. Entscheidend ist, dass drei Sätze hintereinander nahezu dieselbe Länge haben und auf dieselbe Weise beginnen.

Ein schlichter Satz lautet: "The platform enables users to efficiently accomplish routine tasks without additional training." Wort für Wort ersetzt, wird daraus: "The platform allows users to efficiently complete routine tasks without extra training." Gleiche Länge, gleiche Satzstellung, gleicher Rhythmus. Ein Leser könnte ein leicht anderes Wort bemerken. Ein Klassifikator, der Satzmuster auf Absatzebene bewertet, hat fast nichts Neues, womit er arbeiten könnte.

Dies ist kein Argument gegen die Korrektur des Wortschatzes. Wörter wie facilitate, robust und myriad sind es wert, gestrichen zu werden, weil eine sorgfältige Leserin oder ein sorgfältiger Leser sie bemerkt, und ein kostenloser AI word cleaner erfasst die meisten davon in Sekunden. Es ist ein Argument dagegen, zu erwarten, dass dieser Durchgang die Hauptarbeit leistet. Wenn sich ein Score nach einem Durchgang über den Wortschatz kaum verändert, ist das das erwartete Ergebnis, kein Zeichen dafür, dass der Durchgang fehlgeschlagen ist.

Ihre eigene Arbeit humanisieren

Verwandeln Sie Ihren KI-gestützten Text und lassen Sie ihn menschlich klingen, ohne wichtige Wörter oder Zitate anzutasten.

Kostenlos starten

Satzvielfalt bringt es weiter

Ein Modell sagt jeweils ein Token voraus und hat keinen eingebauten Grund, Satz drei kürzer zu machen als Satz zwei, also ordnet sich ein Absatz, wenn man ihn sich selbst überlässt, in einem engen Bereich von Länge und Form ein. Diese Regelmäßigkeit, nicht ein einzelnes Wort, ist das stärkere Signal, weil ein auf maschinelle Ausgabe trainierter Klassifikator dieses Muster tausende Male gesehen hat.

Drei flache Sätze lauten: "Die Ergebnisse waren signifikant. Die Befunde stützten die Hypothese. Die Daten wurden mit Standardmethoden analysiert." Für mehr Vielfalt umstrukturiert, lautet derselbe Inhalt: "Die Ergebnisse waren signifikant, und sie stützten die Hypothese, obwohl die Standardanalyse einen zweiten Durchgang benötigte, nachdem zwei der Ausreißerfälle entfernt worden waren." Ein Satz trägt nun die Behauptung und ihre Komplikation zusammen, mit echter Variation in Länge und Satzgefüge im gesamten Absatz. Das ist es, was ein burstiness checker misst, wenn er Unregelmäßigkeit bewertet, und deshalb bewegt diese Bearbeitung einen Score stärker als ein Durchgang über den Wortschatz.

Nichts davon ist schwer von Hand auf einer oder zwei Seiten zu tun. Lesen Sie den Absatz laut vor, markieren Sie jede Folge von zwei oder drei Sätzen, die gleich lang und gleich gebaut klingen, und teilen Sie einen davon auf oder verbinden Sie zwei zu einem, wobei ein Komma echte Arbeit leistet. Die Satzebenenbearbeitungen hinter diesem Abschnitt werden Schritt für Schritt, mit weiteren ausgearbeiteten Beispielen, in der vollständigen Anleitung, wie man AI text menschlicher macht, behandelt.

Eigene Belege bewegen einen AI Score am stärksten

Ein Sprachmodell hat keinen Zugriff auf das, was in Ihrem Projekt tatsächlich geschehen ist. Wenn es aufgefordert wird, über eine Studie zu schreiben, greift es auf die sicherste Formulierung zurück, die zu fast jeder Studie zum selben Thema passt, weil das das einzige Material ist, das es hat. Ein Satz, der eine spezifische Behauptung aus einer spezifischen Quelle enthält, ist kein Satz, den ein Modell allein aus dem Prompt hervorgebracht hätte, und genau diese Lücke ist es, die einen Score am stärksten verändert.

Ein allgemeiner Satz: "The intervention had a positive effect on outcomes for participants." Dies könnte Hunderte von Studien beschreiben. Umgeschrieben mit dem eigenen Material der Autorin oder des Autors: "Attendance records showed the effect held only for students who came to more than six sessions, a threshold the original design had not anticipated." Länger, spezifischer und nur auf diese Studie anwendbar. Ein Referenzmodell, das aufgefordert würde, denselben Prompt fortzusetzen, hätte das Detail zu den sechs Sitzungen nicht erraten, weil im Prompt nichts darauf hingewiesen hat, dass es existierte.

Dies ist auch die Überarbeitung, die das Schreiben am stärksten verbessert, unabhängig davon, was irgendein Detektor meldet, und genau das ist der Punkt, bei dem man verweilen sollte. Eine spezifische Zahl, eine benannte Einschränkung, eine direkt zitierte statt in eine vage Behauptung paraphrasierte Quelle, all das macht einen Absatz für eine lesende Person überzeugender, und die Tatsache, dass es auch einen Score verändert, ist eher eine Nebenwirkung als das Ziel.

ÜberarbeitungTypische Wirkung auf den ScoreWarum
Wörter durch Synonyme ersetzenGering bis keineSatzlänge, Struktur und Rhythmus bleiben gleich
Satzlänge und Satzstruktur variierenModerat bis starkUnterbricht das gleichförmige Muster, auf das ein Klassifikator trainiert ist, zu achten
Eigene Belege oder Behauptungen hinzufügenAm stärkstenFührt Inhalte ein, die ein Modell aus dem Prompt allein nicht hätte erzeugen können

Wie man den AI Score senkt, ohne das falsche Ziel zu verfolgen

Jede Zahl oben ist eine Schätzung, kein Urteil. Turnitin sagt dies auch in seiner eigenen Dokumentation und erklärt, dass seine KI-Schreiberkennung "may not always be accurate" und "should not be used as the sole basis for adverse actions against a student." Ein Wert kann sich aus Gründen verändern, die nichts mit der Urheberschaft zu tun haben, und er kann unverändert bleiben, obwohl es sich um einen Text handelt, den eine Person von Grund auf selbst geschrieben hat. Die Zahl als Tatsache darüber zu behandeln, wer einen Satz geschrieben hat, ist der Punkt, an dem der größte Teil der Verunsicherung zu diesem Thema entsteht, und genau das behauptet die Zahl nicht von sich.

Das ist auch der Grund, warum es ein schlechter eigenständiger Zweck ist, den Wert zu senken. Dem Zahlenwert hinterherzujagen kann eine schreibende Person zu den Änderungen drängen, die sich am leichtesten automatisieren lassen, eine Überarbeitung des Wortschatzes, einige umgestellte Teilsätze, während die wichtigste Änderung ausgelassen wird, nämlich das Hinzufügen des konkreten Materials, das nur die schreibende Person tatsächlich hat. Ein auf diese Weise erzielter niedrigerer Wert ist es wert, ihn zu haben.

Das Streben nach einem niedrigeren Wert kann einen Absatz auch stilistisch in die falsche Richtung lenken, indem jede Behauptung abgeschwächt, Qualifikatoren aufeinandergestapelt und Füllsätze hinzugefügt werden, die nur dazu dienen, den Rhythmus zu unterbrechen, statt etwas zu sagen. Nichts davon behebt das zugrunde liegende Muster, und alles davon verschlechtert die Lesbarkeit des Absatzes. Die Änderungen, die einen Wert tatsächlich beeinflussen, Satzvielfalt und spezifische Belege, sind auch die Änderungen, die das Schreiben für sich genommen besser machen, was eine nützliche Kontrolle ist, wenn eine Änderung eher wie Füllmaterial als wie eine Verbesserung wirkt.

TextPulse's AI humanizer wendet die oben genannten Änderungen auf Satzebene und auf struktureller Ebene auf ein gesamtes Dokument auf einmal an und gibt einen geschätzten Human Score aus, der aus denselben Signalen berechnet wird, nicht die Behauptung, dass ein namentlich genannter Detektor ihn bestehen werde. Gut eingesetzt ist er ein schneller erster Durchgang bei einem langen Dokument. Er kann jedoch immer noch nicht das eine hinzufügen, das einen Wert am stärksten verändert, da er nie im Raum war, als die eigentliche Arbeit geschah. Dieser Teil bleibt bei der schreibenden Person.

Zwei frühere Fragen sollten zuerst geklärt werden: ob AI humanizers überhaupt funktionieren, und ob ihre Verwendung bei Arbeiten, die Sie einreichen wollen, sicher ist.

Die obige Reihenfolge ist auch eine Prioritätenliste dafür, wo begrenzte Zeit vor einer Frist eingesetzt werden sollte. Überspringen Sie den Synonymdurchgang, wenn die Zeit knapp ist. Überspringen Sie nicht den Absatz, in dem Sie das Detail wieder einfügen, das niemand sonst hätte schreiben können, denn das ist die eine Überarbeitung, die keine noch so große Menge an Umschreibesoftware an Ihrer Stelle leisten kann.

XLinkedInFacebook

Häufig gestellte Fragen

Das Einfügen eigenen Materials, einer konkreten Zahl, einer benannten Einschränkung, einer an eine Quelle gebundenen Behauptung, die Sie tatsächlich gelesen haben, verändert einen Wert stärker als jede andere einzelne Änderung, weil ein Sprachmodell keine Möglichkeit hatte, dieses Detail allein aus dem Prompt zu erzeugen. Die Variation der Satzlänge folgt danach. Synonymtausch verändert am wenigsten, da dabei die Satzstruktur unverändert bleibt. Diese Reihenfolge ist der Kern davon, wie man ai score senken kann, ohne nur an der Zahl zu drehen.

Mark

Content strategist at TextPulse, here since the company started. Mark writes the product and technical coverage: how the humanizer works under the hood, what changes in each release, and what a specification actually means for your writing. His reviews of writing software come from using them on real documents rather than reading a feature list.

Bleiben Sie über AI-Humanisierung auf dem Laufenden

Erhalten Sie Tipps zu akademischem Schreiben, AI-Erkennung und Humanisierung direkt in Ihren Posteingang.

Kein Spam. Jederzeit abbestellbar.