AI Detection

Dokáže Turnitin odhalit parafrázovaný text?

Ano, Turnitin odhaluje parafrázovaný text, a byl k tomu vytvořen. Jeho systém podobnosti zachytí přeformulované pasáže, které se stále překrývají s publikovanými a dříve odevzdanými pracemi, a jeho zpráva o AI psaní obsahuje označenou kategorii pro AI generovaný text upravený pomocí nástroje pro parafrázování nebo word spinneru. Zde je vysvětleno, jak jej zachytí každý z těchto systémů a proč nahrazení slov synonymy neobejde ani jeden z nich.

9 min
Diagram answering can Turnitin detect paraphrased text, comparing similarity matching against the AI writing indicator

Ano. Turnitin detekuje parafrázovaný text a bylo k tomu vytvořeno. Zachycují jej dva systémy uvnitř téže zprávy. Similarity Report označuje pasáže, které se i po změně formulace stále překrývají s publikovanými pracemi nebo dříve odevzdanými texty, což je úloha, kterou plní už dávno předtím, než existovalo AI psaní. AI Writing Report má vlastní označenou kategorii pro text vytvořený AI, který prošel parafrázovacím nástrojem nebo word spinnerem. Nahrazení slov synonymy nevyčistí ani jeden z nich.

To, který systém zachytí danou pasáž, závisí na tom, odkud text pochází. Přeformulovaný materiál převzatý ze zdroje je problém similarity. Přeformulovaný materiál vygenerovaný ChatGPT je problém AI psaní. Mnoho odevzdaných prací je současně obojím a oba systémy stejně čtou každé odevzdání.

Turnitin označuje parafrázovaný AI text jako vlastní kategorii

Toto není závěr vyvozený z toho, jak detektory obecně fungují. AI Writing Report od Turnitin rozděluje své procento do dvou označených kategorií a tou druhou je parafrázovaný AI text.

Turnitin AI Writing Overview page listing two categories: AI-generated only, described as likely AI-generated text from a large-language model, and AI-generated text that was AI-paraphrased, described as likely AI-generated text that was likely revised using an AI-paraphrase tool or word spinner
Turnitin AI Writing Overview, s kategorií parafráze vytištěnou ve vlastním produktu. Hlavní procento kombinuje oba řádky a druhý pokrývá text upravený pomocí AI paraphraseru nebo word spinneru.

Zpráva definuje své hlavní číslo jako "the combined amount of likely AI-generated text as well as likely AI-generated text that was also likely AI-paraphrased". Druhá položka je označena jako "AI-generated text that was AI-paraphrased" a popsána jako "likely AI-generated text that was likely revised using an AI-paraphrase tool or word spinner".

Podpůrná dokumentace Turnitin odpovídá na tuto otázku výslovně. Na přímý dotaz, zda dokáže detekovat obsah parafrázovaný pomocí nástroje pro AI parafrázování, uvádí toto: "Yes, Turnitin's AI indicator includes detection of AI-generated content that may have been paraphrased using a word spinner/AI paraphrasing tool." Téměř totožná odpověď se vztahuje i na text zpracovaný nástrojem pro obcházení, který byl vytvořen speciálně k přepisování výstupu AI tak, aby prošel detektorem. Ani jeden z nich nevytváří samostatné skóre. Oba vstupují do stejného jediného procenta, které vidí vyučující.

Co zachytí každý systém

Similarity ReportAI Writing Report
Co kontrolujeZda se text překrývá se zdroji, které už jsou v databázi webového obsahu, publikací a studentských prací TurnitinZda próza statisticky odpovídá typickému strojově generovanému psaní
Zachytí parafrázováníPublikované nebo odevzdané práce někoho jinéhoDrafty generované AI, včetně těch upravených parafrázovačem nebo bypasserem
Účinek nahrazení synonymySnižuje procento, ale ponechává shodu v charakteristických termínech, citacích a stavbě větNechává skóre z velké části tam, kde bylo, protože klasifikátor čte vzorec vět, nikoli volbu slov
Kde se zobrazujeProcento plus skupiny shod s uvedením každého zdrojeJedno procento, rozdělené na AI-generated only a AI-paraphrased

Tyto dva reporty jsou samostatné produkty se samostatnými čísly a práce může být v jednom čistá a v druhém označená. TextPulse tento rozdíl plně pokrývá ve svém srovnání similarity score Turnitin s jeho AI score a samotnou mechaniku klasifikátoru v textu jak Turnitin detekuje AI writing.

Zlidštit vlastní práci

Proměňte svůj text s pomocí AI a nechte ho znít lidsky, aniž byste zasahovali do důležitých slov nebo citací.

Začít zdarma

Strana similarity: Přeformulovaný text se stále překrývá

Kontrola podobnosti je úloha porovnávání. Turnitin porovnává odevzdaný text se svým repozitářem webového obsahu, publikací a dříve odevzdaných prací a uvádí, jak velká část se překrývá s něčím, co už bylo indexováno. Změňte dostatečně formulaci a přesné řetězce, které se porovnávají, se zmenší, takže procento klesne. To je skutečné a právě proto existují nástroje pro parafrázování.

To, co po této výměně zůstává, je část, kterou studenti podceňují. Technické termíny, vlastní jména, citované údaje a přímé citace se přenášejí beze změny, protože pro ně neexistuje synonymum. Totéž platí pro stavbu vět, když se nahradí jen spojovací slova. Turnitin uvádí překryv jako skupiny shod, z nichž každá uvádí svůj zdroj, a právě to odlišuje řádně citovaný úryvek od přeformulovaného.

Turnitin similarity report showing 12% overall similarity broken into match groups: 115 matches not cited or quoted at 9%, and 41 matches with missing quotations at 3%, with top sources listed across internet, publications and student papers
Zpráva o podobnosti rozděluje své procento do skupin shod. 115 shod „not cited or quoted“ jsou ty, které působí jako přeformulovaný nebo převzatý materiál, nikoli jako připsaná citace.

Přeformulování zdroje při zachování pořadí vět a podpůrných detailů se nazývá patchwriting a ve většině univerzitních předpisů je považováno za formu plagiátorství bez ohledu na to, zda procento podobnosti klesne. Hodnotitelé vyškolení k jeho rozpoznání je často odhalí pouhým okem, protože argument, který sleduje zdroj odstavec po odstavci, působí jako převzatý bez ohledu na slovní zásobu. Nízké číslo není totéž co bezvadná práce, a právě proto TextPulse nabízí průvodce co se počítá jako dobré skóre Turnitin.

Strana AI, průchod synonymy skóre neposune

Ukazatel psaní pomocí AI nikdy neporovnával váš odstavec se zdrojem, takže zde není žádná shoda, kterou by mohl synonymní zásah narušit. Hodnotí prózu větu po větě podle toho, jak přesně odpovídá statistickému vzoru strojově generovaného psaní, tedy podle předvídatelnosti slov, rytmu vět a obecného formulování, k němuž se jazykový model ve výchozím nastavení uchyluje.

Nahrazování slov ponechává téměř vše z toho beze změny. Věta si zachová svou délku, své pořadí i stejné ustálené spojovací vazby mezi větami. Proto je tak běžnou zkušeností spustit návrh vytvořený pomocí AI přes parafrázovací nástroj a sledovat, že skóre AI zůstane stejné. Slovní zásoba se změnila. Vzor, který klasifikátor hodnotí, nikoli, takže text je stále čten jako strojově napsaný, přesně jak říká kategorie parafrází v Turnitin.

Rozložení délky vět přežívá přepsání

Próza vytvořená strojem se ustaluje v úzkém pásmu délek vět, protože model, který předpovídá jeden token po druhém, nemá důvod, aby byla čtvrtá věta kratší než třetí. Lidské psaní se naopak rozptyluje, devatenáctislovná věta, pak šestislovná, pak dvaatřicetislovná, která nese tvrzení i jeho omezení zároveň. Vlastní vysvětlení GPTZero to pojmenovává přímo, když definuje burstiness jako míru toho, nakolik se v průběhu dokumentu liší vzorce psaní a textové perplexities.

Výměna synonym posune délku věty o jedno či dvě slova a každou větu posune o podobně malý rozsah, takže rozložení si zachová svůj tvar. Odstavec, který před úpravou běží v délkách osmnáct, devatenáct, sedmnáct a dvacet slov, poběží po ní v rámci jednoho či dvou slov od stejného plochého profilu.

To lze měřit, aniž by bylo třeba se přibližovat k detektoru. bezplatný kontrolor burstiness ukazuje, kolik variace na úrovni vět daný úsek obsahuje, a spuštění téhož odstavce před a po parafrázování ukazuje, že se číslo téměř nepohybuje, zatímco slovní zásoba se zcela změní.

Pořadí vět a přechody přežívají také

Pořadí vět je druhý strukturální rys, který parafrázovač ponechává beze změny, a pro čtenáře je viditelnější než délka vět. Strojová próza má tendenci uvést téma na začátku, vyslovit tvrzení a pak na konci znovu a znovu připojit upřesňující vedlejší větu. „Ačkoli byla velikost vzorku omezená, výsledky naznačují“ a „Přestože je zapotřebí dalšího výzkumu, zjištění ukazují“ jsou tatáž věta oblečená do různých slov.

Parafrázovací nástroj převede „while“ na „although“ a „suggest“ na „show“. Nerozhodne však, že upřesnění patří do vlastní krátké věty o tři řádky dál, ani že by se mělo oslabení tvrzení odstranit úplně. To je redakční úsudek o tom, co odstavec tvrdí, a substituční modul nemá na argument žádný názor.

Přechodové výrazy jsou třetí a nejviditelnější. Modely sahají při spojování po malé, stabilní sadě spojek: however, additionally, furthermore, in addition. Parafrázovač jednu z nich nahradí jiným členem téže sady, takže klasifikátor stále vidí běžný přechod z očekávaného rozdělení na očekávaném místě. To je signál, který četl už před zahájením přepisu.

Prvek, který klasifikátor čteZměněno při průchodu parafrázíProč
Volba jednotlivých slovAno, podstatněJediný prvek, který je substituční modul navržen ke změně
Délka vět a její variabilitaTéměř neNahrazená slova mají podobnou délku, takže profil zůstává zachován
Pořadí vět v rámci souvětíZřídkaPřeskupení mění důraz, což omezení významu odrazuje
Spojky na přechodechVyměněny uvnitř téže malé sadyJedna běžná přechodová spojka nahrazuje jinou běžnou přechodovou spojku
Předvídatelnost dalšího slovaMírněVzácnější synonymum je méně očekávané, ale rámec kolem něj zůstává stejně předvídatelný jako dříve
Konkrétní důkazy a detailyNePřepis nemůže přidat materiál, který v návrhu nikdy nebyl

Co skutečně mění výsledek

Oba systémy reagují na různé příznaky stejné povrchní parafráze, takže řešení je pro oba stejné, změnit psaní, ne slova. To znamená přepracovat věty, nikoli jen přeskupit jejich obsah, záměrně měnit délku vět, vypouštět obecné spojovací výrazy, k nimž se model standardně uchyluje, a doplnit podpůrné detaily natolik specifické, že mohly pocházet pouze ze zdrojového materiálu, který jste skutečně četli. Podobnost klesá, protože struktura už nesleduje zdroj. Skóre AI klesá, protože vzorec, který klasifikátor hodnotí, zmizel.

Nástroj pro parafrázování tuto práci vykonat nemůže a rozdíl mezi těmito dvěma kategoriemi nástrojů stojí za pochopení ještě předtím, než za některý z nich zaplatíte, což TextPulse pokrývá v AI humanizer versus paraphraser. Kontrola vlastní slovní předvídatelnosti návrhu pomocí free perplexity checker ukazuje vzorec, na který klasifikátor reaguje, užitečněji než samotné skóre.

AI humanizer for students od TextPulse pracuje na strukturální straně problému, přestavuje rytmus vět, variaci délky a pořadí vět, místo aby nahrazoval jednotlivá slova, což je mezera, kterou ponechává široce otevřenou průchod založený pouze na synonymech. Pro školní práce konkrétně humanizing an AI essay for college pokrývá celý pracovní postup od začátku do konce a whether Turnitin detects DeepSeek odpovídá na tutéž otázku pro jiný model.

Nic z toho nemění, co politika používání AI v kurzu dovoluje, a žádný postup přepisu po faktu nevyřeší skóre. Zkouška, kterou má smysl provést před odevzdáním čehokoli, zní, zda byste dokázali větu po větě vysvětlit, proč práce před vámi říká to, co říká.

XLinkedInFacebook

Často kladené otázky

Ano. Jeho systém podobnosti porovnává odevzdaný text s webovým obsahem, publikacemi a dříve odevzdanými pracemi, takže přeformulované pasáže, které se stále překrývají se zdrojem, zůstávají shodné v charakteristických termínech, citacích a struktuře vět. Samostatně jeho zpráva o AI psaní obsahuje označenou kategorii pro AI generovaný text, který byl upraven pomocí AI nástroje pro parafrázování nebo word spinneru, což podle vlastní dokumentace Turnitin slouží k označování.

Moe

PhD in natural language processing, with years spent building NLP applications end to end. Moe works on text analysis: lexical and syntactic structure, and what separates machine-generated prose from human prose statistically. He has been experimenting with computational linguistics since the early days of NLTK, spaCy and WordNet, and still writes most of his tooling in Python.

Zůstaňte v obraze o humanizaci AI

Získejte tipy na akademické psaní, detekci AI a humanizaci doručené do vaší schránky.

Žádný spam. Kdykoli se můžete odhlásit.