AI Detection

Co je dobré skóre Turnitin?

Turnitin nezveřejňuje žádné přijatelné procento podobnosti a instituce si místo toho stanovují vlastní pokyny. Tento příspěvek vysvětluje, co ve skutečnosti určuje vysoké nebo nízké skóre, proč citovaný materiál a seznamy literatury zvyšují skóre, aniž by bylo něco v nepořádku, a jak číst rozpis shod za číslem samotným, nikoli číslo samotné.

6 min
What is a good Turnitin score? A similarity report broken into matched sources rather than one number.

Jeden studentovi vedoucí sdělí, že cokoli pod patnáct procent je v pořádku. Jinému studentovi, také na téže katedře, je jeho práce označena na chodbě jako problematická při dvanácti procentech, protože tři z těchto bodů spadají do jednoho souvislého odstavce bez uvozovek v jeho blízkosti. Oba čtou skóre podobnosti v Turnitin správně. Tento nástroj nebyl od začátku vytvořen k tomu, aby uděloval jediné číslo typu projít nebo neprojít.

Co je tedy dobré skóre Turnitin? Takové číslo neexistuje. Turnitin nezveřejňuje přijatelné procento, nehodnotí odevzdanou práci a výslovně uvádí, že toto číslo samo o sobě není měřítkem plagiátorství. Každá instituce si stanovuje vlastní pokyny a často to dělá i každý vedoucí uvnitř ní, proto může tentýž report v jedné kanceláři působit nevýrazně a v další znepokojivě. Číslo, které stojí za to se naučit, je to, jak číst to, co se za ním skrývá.

Co je dobré skóre Turnitin?

Turnitin nikdy nezveřejnil číslo, které by bylo považováno za dobré, bezpečné nebo přijatelné, a to z konkrétního důvodu: skóre podobnosti měří, kolik textu v odevzdané práci se shoduje s textem již obsaženým v databázích Turnitin, nikoli zda bylo toto překrytí použito nevhodně. Vysoké skóre může zcela pocházet z materiálu, který je správně citován a uveden. Nízké skóre může být vyšší než u práce, která parafrázuje jeden zdroj natolik těsně, že to znepokojí zkoušejícího, aniž by se vůbec spustil mechanismus porovnávání. Číst číslo jako známku znamená chápat nástroj obráceně.

Hodnota jako deset až dvacet procent se široce šíří jako neformální orientační pravidlo, opakovaně se objevuje na fórech a ve studijních příručkách, až začne znít oficiálně. Oficiální není. Turnitin žádnou takovou hodnotu nestanovuje a orientační pravidlo, které ignoruje délku dokumentu, hustotu citací a oborovou konvenci, se rozpadá ve chvíli, kdy narazí na skutečnou práci. Přehled literatury sestavený z třiceti správně citovaných zdrojů může jen na citacích překročit dvacet procent. Jeden těsně parafrázovaný odstavec bez uvozovek může zůstat pod pěti procenty a přesto být závažnějším problémem.

Co skóre podobnosti ve skutečnosti měří

Turnitin popisuje svůj vlastní nástroj téměř přesně těmito slovy. Pokyny Boise State University, vycházející z vlastního jazyka Turnitin, vysvětlují, že skóre podobnosti je procento obsahu práce, které se shoduje s materiálem již obsaženým v databázích Turnitin, a že samotné procento není posouzením toho, zda práce obsahuje plagiovaný materiál. Tento rozdíl má skutečný význam, shoda je mechanická, řetězec slov se zarovnává s řetězcem slov někde jinde, a posoudit, zda bylo toto překrytí řádně citováno, vyžaduje člověka, nikoli algoritmus.

Databáze, na nichž je shoda založena, jsou záměrně rozsáhlé, zahrnují aktuální i archivované studentské práce, otevřený web a velký soubor akademických publikací. Žádný z tohoto obsahu není čten pro význam. Systém vyhledává překrývající se řetězce slov a uvádí, jak velkou část odevzdané práce pokrývají, proto může citovaná věta i potichu zkopírovaná věta vyvolat totožnou shodu. Pouze podrobný pohled v reportu ukazuje, které z nich je které.

Proč může být vysoké skóre zcela legitimní

Dvě běžné vlastnosti akademického psaní vysvětlují většinu těchto případů. Citované pasáže se shodují záměrně, protože slova jsou úmyslně převzata a na stránce označena jako cizí. Seznamy literatury se shodují stejně spolehlivě, protože jména autorů, názvy časopisů a citační formáty se opakují v tisících dalších prací, které citují stejné zdroje. Obojí je přesně to, jak má správné akademické psaní vypadat.

Vedle sebe působí nadhodnocené skóre a skutečný problém na první pohled odlišně.

Co bylo shodnéProč se to staloStojí to za bližší prozkoumání?
Citovaný úryvek s uvozovkami a citacíSlova byla záměrně převzata a na stránce řádně uvedenaNe, takto vypadá správná citace
Seznam literatury nebo bibliografieJména autorů, názvy časopisů a citační formáty se opakují napříč mnoha dalšími pracemiNe, pokud nebylo použito nastavení pro vyloučení
Standardní metodika nebo procedurální formulaceSdílená slovní zásoba daného oboru popisuje tentýž proces stejným způsobem napříč pracemiZřídka, pokud není celá část převzata místo toho, aby byla napsána nově
Jeden dlouhý, souvislý odstavec bez uvozovek, odpovídající jedinému zdrojiFormulace sleduje větu jiného autora dostatečně těsně na to, aby ji zachytil vyhledávací mechanismus shodAno, to je vzorec, u něhož stojí za to otevřít zdroj a ověřit jej

Zlidštit vlastní práci

Proměňte svůj text s pomocí AI a nechte ho znít lidsky, aniž byste zasahovali do důležitých slov nebo citací.

Začít zdarma

Proč nízké skóre může stále skrývat problém

Nízké číslo odpovídá užší otázce, než se zdá, totiž zda se malé množství textu shoduje slovo od slova s databázemi Turnitin, a nic víc. Parafráze, která změní dostatek formulací, ale zachová strukturu a argument jiného autora, může dosáhnout skóre blízkého nule a přesto představovat závažný problém akademické integrity, protože mechanismus pracuje s řetězci slov, nikoli s převzatými myšlenkami. Přeložený obsah nebo materiál pocházející mimo indexované databáze Turnitin se chová stejně, není s čím porovnávat, nic se neoznačí.

Vymyšlené zdroje vytvářejí stejnou slepou skvrnu z opačného směru. Odkaz, který neexistuje, se nemůže s ničím shodovat, protože nikde není nic, s čím by se mohl shodovat, a skóre podobnosti nemá způsob, jak označit citaci, která od počátku nikdy nebyla skutečná. Bezplatná kontrola citací pomocí AI od TextPulse free AI citation checker existuje právě pro tuto mezeru, ověřuje každou položku v seznamu literatury vůči skutečným registrům, v nichž by se tyto zdroje měly objevit, dříve než čtenář musí mezeru odhalit obtížným způsobem.

Ještě jedno rozlišení stojí za to učinit, než se od samotného čísla posuneme dál. Odevzdaná práce s nízkým skóre podobnosti může stále nést samostatný ukazatel psaní pomocí AI v Turnitin, což je jiné měření navržené k odhalení jiného druhu problému, o němž pojednává průvodce tohoto webu k tomu, zda Turnitin skutečně dokáže odhalit ChatGPT. Tato dvě procenta se nepočítají stejným způsobem a tento text se zabývá pouze skóre podobnosti.

Jak číst zprávu místo čísla

Nereagujte na celkový výsledek dříve, než otevřete rozpis shod. Turnitin seřadí zdrojové osoby, které tvoří skóre, podle jejich příspěvku k němu. Celkových dvacet dva procent tvořených jedenácti zdroji, z nichž každý přispívá dvěma procenty, nepůsobí stejně jako celek tvořený jediným zdrojem. První vzorec obvykle odráží překryv v mnoha běžných frázích. U druhého je vhodné podívat se přímo na to, co daný zdroj skutečně říká.

Turnitin také zařazuje stejné procento do barevného pásma, jak je uvedeno ve vlastním pokynu Loughborough College pro studenty: modrá pro žádný shodný text, zelená od jednoho slova do dvaceti čtyř procent, žlutá od dvaceti pěti do čtyřiceti devíti, oranžová od padesáti do sedmdesáti čtyř, červená od sedmdesáti pěti a výše. Vlastní pokyn college je přímý v tom, co barvy neznamenají: kontroly podobnosti neznamenají, že odevzdaná práce obsahuje plagiovaný materiál. Barva slouží k uspořádání zprávy podle naléhavosti, nikoli jako verdikt.

Vyplatí se také ověřit, zda vlastní nastavení instituce vylučuje z počtu citace a bibliografii, protože tatáž odevzdaná práce může při jiném nastavení tohoto přepínače vytvořit dvě různá čísla. Nic z toho není složité, jakmile je to viditelné. Neviditelné je to jen tehdy, když nikdo neotevře zprávu za její první stránku.

Co dělat, pokud vás vaše skóre překvapí

Znovu otevřete každý označený zdroj jednotlivě, místo abyste reagovali na souhrnný celkový výsledek. Ověřte, zda verze, která je hodnocena, má vyloučené citace v uvozovkách a bibliografii, protože číslo, které student vidí při psaní, není vždy nastaveno stejně jako číslo, které vidí vyučující při odevzdání. Kde se objeví skutečná neoznačená shoda, opravte citaci přímo, místo abyste přeformulovávali věty tak, aby prošly kolem porovnávacího mechanismu, který řeší příznak a ponechává problém na místě.

Pokud se číslo stále zdá být v rozporu s tím, co očekává vedoucí, zeptejte se přímo, jaká je vlastní konvence daného oddělení. Oddíly výše už ukazují, že neexistuje jediná hranice, které je třeba dosáhnout, takže odpověď má někdo, kdo má nad zadáním místní pravomoc, ne procento, které si mohl kdokoli předem vyhledat. Sbírka bezplatných nástrojů TextPulse zahrnuje kontroly citací a psaní, které se vyplatí spustit, než se zpráva dostane do něčí schránky.

Skóre z různých nástrojů nejsou zaměnitelná a jak GPTZero funguje je vysvětleno na samostatné stránce, spolu s statistikou perplexity, která leží pod oběma.

Skóre se chová tak, jak se chová, kvůli tomu, jak probíhá porovnávání pod ním, a novější číslo, které nyní stojí vedle něj ve stejné zprávě, funguje na jiném mechanismu, který plně popisuje průvodce tohoto webu, jak AI detektory skutečně fungují. Číst kterékoli z těchto čísel jako verdikt znamená přeskočit jedinou část zprávy, která stojí za přečtení.

XLinkedInFacebook

Často kladené otázky

Co je dobré skóre Turnitin? Takové číslo neexistuje. Turnitin nezveřejňuje přijatelné procento a skóre podobnosti měří, kolik textu se shoduje s jeho databázemi, nikoli kolik bylo plagiováno. Správně citovaná literární rešerše může jen z citací sama o sobě přesáhnout dvacet procent, zatímco jediná neoznačená parafráze může zůstat pod pěti. Čtěte shodné zdroje, ne hlavní údaj.

Moe

PhD in natural language processing, with years spent building NLP applications end to end. Moe works on text analysis: lexical and syntactic structure, and what separates machine-generated prose from human prose statistically. He has been experimenting with computational linguistics since the early days of NLTK, spaCy and WordNet, and still writes most of his tooling in Python.

Zůstaňte v obraze o humanizaci AI

Získejte tipy na akademické psaní, detekci AI a humanizaci doručené do vaší schránky.

Žádný spam. Kdykoli se můžete odhlásit.