Co je dobré skóre Turnitin?
Turnitin nezveřejňuje žádné přijatelné procento podobnosti a instituce si místo toho stanovují vlastní pokyny. Tento příspěvek vysvětluje, co ve skutečnosti způsobuje vysoké nebo nízké skóre, proč citovaný materiál a seznamy literatury toto skóre zvyšují, aniž by bylo něco v nepořádku, a jak číst rozpis shod za číslem samotným, nikoli číslo samotné.
Jeden studentovi vedoucí řekne, že cokoli pod patnáct procent je v pořádku. Jinému studentovi, také na téže katedře, je práce označena v chodbě při dvanácti procentech, protože tři z těchto bodů spadají do jednoho souvislého odstavce bez uvozovek v jeho blízkosti. Oba čtou Turnitin's similarity score správně. Tento nástroj nebyl od počátku určen k tomu, aby uděloval jediné číslo typu projde nebo neprojde.
Co je tedy dobré Turnitin skóre? Žádné takové číslo neexistuje. Turnitin nezveřejňuje přijatelné procento, nehodnotí odevzdanou práci a výslovně uvádí, že toto číslo samo o sobě není měřítkem plagiátorství. Každá instituce stanovuje vlastní pokyny a často to dělá i každý vedoucí uvnitř ní, proto může tentýž report v jedné kanceláři působit nevýrazně a v další znepokojivě. Číslo, které stojí za to se naučit, je to, jak číst to, co je za ním.

Co je dobré Turnitin skóre?
Turnitin nikdy nezveřejnil číslo, které by se považovalo za dobré, bezpečné nebo přijatelné, a to z konkrétního důvodu: similarity score měří, kolik textu v odevzdané práci se shoduje s textem již uloženým v databázích Turnitin, nikoli zda bylo toto překrytí použito nevhodně. Vysoké skóre může zcela pocházet z materiálu, který je správně citován a uveden v odkazech. Nízké skóre může být vyšší než u práce, která parafrázuje jeden zdroj natolik těsně, že to znepokojí zkoušejícího, aniž by vůbec spustila mechanismus porovnávání. Číst číslo jako známku znamená chápat nástroj obráceně.
Číslo jako deset až dvacet procent se široce šíří jako neformální pravidlo, opakuje se napříč fóry a studijními příručkami, až začne znít oficiálně. Oficiální není. Turnitin žádné takové číslo nestanovuje a pravidlo, které ignoruje délku dokumentu, hustotu citací a konvence daného oboru, se rozpadá ve chvíli, kdy narazí na skutečný text. Přehled literatury sestavený ze třiceti řádně citovaných zdrojů může jen na citacích sám dosáhnout dvaceti procent. Jediný těsně parafrázovaný odstavec bez uvozovek může zůstat pod pěti procenty a přesto být závažnějším problémem.
Co Similarity Score ve skutečnosti měří
Turnitin popisuje svůj vlastní nástroj téměř přesně těmito slovy. Pokyny Boise State University, vycházející z vlastního jazyka Turnitin, vysvětlují, že similarity score je procento obsahu práce, které se shoduje s materiálem již obsaženým v databázích Turnitin, a že samotné procento není posouzením toho, zda práce obsahuje plagiovaný materiál. Tento rozdíl je podstatný, shoda je mechanická, jde o řetězec slov, který se někde jinde zarovnává s jiným řetězcem slov, a posoudit, zda bylo toto překrytí řádně připsáno, vyžaduje člověka, nikoli algoritmus.
Databáze, na nichž je shoda založena, jsou záměrně široké, zahrnují aktuální i archivované studentské odevzdané práce, otevřený web a rozsáhlý soubor akademických publikací. Žádný z tohoto obsahu se nečte s ohledem na význam. Systém vyhledává překrývající se řetězce slov a uvádí, jak velkou část odevzdané práce pokrývají, proto může citovaná věta i potichu zkopírovaná věta vyvolat totožnou shodu. Pouze podrobný pohled v reportu ukazuje, co je co.
Proč může být vysoké skóre zcela legitimní
Dvě běžné vlastnosti akademického psaní vysvětlují většinu z toho. Citované pasáže se shodují záměrně, protože slova jsou úmyslně převzata a na stránce označena jako cizí. Seznamy literatury se shodují stejně spolehlivě, protože jména autorů, názvy časopisů a citační formáty se opakují v tisících dalších prací citujících stejné zdroje. Obojí je přesně to, jak má správné akademické psaní vypadat.
Vedle sebe vypadají nafouknuté skóre a skutečný problém na první pohled odlišně.
| Co se shodovalo | Proč se to stalo | Stojí to za bližší prozkoumání? |
|---|---|---|
| Citovaný úryvek s uvozovkami a citací | Slova byla záměrně převzata a na stránce řádně uvedena | Ne, takto vypadá správná citace |
| Seznam literatury nebo bibliografie | Jména autorů, názvy časopisů a citační formáty se opakují v mnoha dalších pracích | Ne, pokud nebylo použito nastavení pro vyloučení |
| Standardní metody nebo procedurální formulace | Sdílená slovní zásoba oboru popisuje tentýž proces v různých pracích stejným způsobem | Zřídka, pokud není převzata celá sekce místo toho, aby byla napsána nově |
| Jeden dlouhý, souvislý odstavec bez uvozovek, odpovídající jedinému zdroji | Formulace sleduje větu jiného autora dostatečně těsně, aby ji zachytil vyhledávací mechanismus shody | Ano, toto je vzorec, u něhož stojí za to otevřít zdroj a zkontrolovat jej |
Zlidštit vlastní práci
Proměňte svůj text s pomocí AI a nechte ho znít lidsky, aniž byste zasahovali do důležitých slov nebo citací.
Proč nízké skóre může stále skrývat problém
Nízké číslo odpovídá užší otázce, než se zdá, totiž zda se malé množství textu shoduje slovo od slova s databázemi Turnitin, a nic víc. Parafráze, která změní dostatek formulací, ale zachová strukturu a argument jiného autora, může dosáhnout skóre blízkého nule a přesto představovat závažný problém akademické integrity, protože mechanismus pracuje s řetězci slov, nikoli s převzatými myšlenkami. Přeložený obsah nebo materiál pocházející mimo indexované databáze Turnitin se chová stejně, nic ke shodě, nic se neoznačí.
Vymyšlené zdroje vytvářejí stejnou slepou skvrnu z opačného směru. Odkaz, který neexistuje, nemůže s ničím odpovídat, protože nikde není nic, s čím by mohl odpovídat, a skóre podobnosti nemá způsob, jak označit citaci, která od počátku nikdy nebyla skutečná. Bezplatný kontrolor citací AI od TextPulse, free AI citation checker, existuje právě pro tuto mezeru, ověřuje každou položku v seznamu literatury vůči skutečným registrům, v nichž by se tyto zdroje měly objevit, dříve než student musí mezeru odhalit obtížným způsobem.
Ještě jedno rozlišení stojí za to učinit, než se od samotného čísla posuneme dál. Odevzdaný text s nízkým skóre podobnosti může stále nést samostatný ukazatel AI psaní od Turnitin, jiné měření navržené k odhalení jiného druhu problému, které je popsáno v průvodci na tomto webu guide to whether Turnitin can actually detect ChatGPT. Tato dvě procenta se nepočítají stejným způsobem a tento text se zabývá pouze skóre podobnosti.
Jak číst zprávu místo čísla
Nereagujte na celkový výsledek dříve, než otevřete rozpis shod. Turnitin seřadí zdrojové osoby, které tvoří skóre, podle jejich podílu na něm. Celkových dvacet dva procent složených z jedenácti zdrojů, z nichž každý přispívá dvěma procenty, nevyznívá stejně jako celek složený z jednoho zdroje. První vzorec obvykle odráží překryv v mnoha běžných frázích. Druhý si zaslouží přímý pohled na to, co ten zdroj skutečně říká.
Turnitin také rozděluje stejné procento do barevného pásma, jak je uvedeno v pokynech Loughborough College pro studenty: modrá pro žádný shodný text, zelená od jednoho slova do dvaceti čtyř procent, žlutá od dvaceti pěti do čtyřiceti devíti, oranžová od padesáti do sedmdesáti čtyř, červená od sedmdesáti pěti a výše. Vlastní pokyny college jsou přímé v tom, co barvy neznamenají: kontroly podobnosti neznamenají, že odevzdaný text obsahuje plagiovaný materiál. Barva třídí zprávu podle toho, čemu je třeba věnovat pozornost, nikoli podle verdiktu.
Zda vlastní nastavení instituce vylučuje z počtu citace a bibliografii, stojí také za ověření, protože tatáž odevzdaná práce může podle toho, jak je tento přepínač nastaven, vyprodukovat dvě různá čísla. Nic z toho není složité, jakmile je to viditelné. Je to neviditelné jen tehdy, když nikdo neotevře zprávu dál než na její první stránce.
Co dělat, pokud vás vaše skóre překvapí
Znovu otevřete každý označený zdroj jednotlivě, místo abyste reagovali na souhrnný celkový výsledek. Ověřte, zda má verze, která je hodnocena, vyloučené citace a bibliografii, protože číslo, které student vidí při psaní, není vždy nastaveno stejně jako číslo, které vidí vyučující při odevzdání. Kde se objeví skutečná neoznačená shoda, opravte citaci přímo, místo abyste přeformulovali věty tak, abyste proklouzli přes porovnávací mechanismus, který řeší příznak a problém ponechává na místě.
Pokud se číslo stále zdá být v rozporu s tím, co očekává vedoucí, zeptejte se přímo, jaká je vlastní konvence daného pracoviště. Oddíly výše už ukazují, že neexistuje jediná hranice, které je třeba dosáhnout, takže odpověď má někdo, kdo má nad zadáním místní pravomoc, ne procento, které si kdokoli mohl předem vyhledat. Sbírka bezplatných nástrojů TextPulse zahrnuje kontroly citací a psaní, které stojí za to provést, než se zpráva dostane do něčí cizí schránky.
Skóre z různých nástrojů nejsou zaměnitelná a jak GPTZero funguje je vysvětleno na samostatné stránce, spolu s statistikou perplexity, která leží pod oběma.
Skóre se chová tak, jak se chová, kvůli tomu, jak probíhá porovnávání pod ním, a novější číslo, které nyní stojí vedle něj ve stejné zprávě, funguje na jiném mechanismu, ten plně rozebírá průvodce tohoto webu, jak AI detektory skutečně fungují. Číst kterékoli z těchto čísel jako verdikt znamená přeskočit jedinou část zprávy, kterou stojí za to číst.
Často kladené otázky
Co je dobré skóre Turnitin? Takové číslo neexistuje. Turnitin nezveřejňuje přijatelné procento a skóre podobnosti měří, kolik textu se shoduje s jeho databázemi, nikoli kolik bylo plagiováno. Správně citovaná literární rešerše může jen z citací sama o sobě přesáhnout dvacet procent, zatímco jediná neoznačená parafráze může být pod pěti. Čtěte shodné zdroje, ne hlavní údaj.
PhD in natural language processing, with years spent building NLP applications end to end. Moe works on text analysis: lexical and syntactic structure, and what separates machine-generated prose from human prose statistically. He has been experimenting with computational linguistics since the early days of NLTK, spaCy and WordNet, and still writes most of his tooling in Python.