Může Turnitin detekovat ChatGPT? Co zachytí a co přehlédne
Zpráva Turnitin o AI psaní a jeho zpráva o podobnosti jsou odlišné produkty s odlišným publikem a odlišnou mírou přesnosti. Zde je uvedeno, co skóre AI skutečně měří, kde nezávislé testování ukazuje jeho selhávání a proč váš report nemusí vypadat stejně jako report vašeho spolubydlícího.
Ano, ale pouze pro určitý druh použití AI a uvnitř zprávy, kterou většina studentů nikdy nevidí. Ukazatel psaní pomocí AI v Turnitin označuje prózu, která statisticky odpovídá tomu, jak obvykle píše jazykový model, a činí tak u rostoucího podílu esejí, které kontroluje: přibližně 15 procent vykázalo mezi říjnem 2025 a únorem 2026 80 procent nebo více textu vytvořeného AI, oproti zhruba 3 procentům při spuštění nástroje v dubnu 2023. Zda označí právě vaše konkrétní odevzdání, závisí na detailech, které většina odpovědí na can Turnitin detect ChatGPT přeskakuje, jak se zpráva o AI liší od zprávy o plagiátorství, kdo vlastně číslo uvidí a jak často se ukáže, že je toto číslo chybné.
Tento příspěvek se zabývá mechanismem tohoto jednoho produktu, nikoli akademickou integritou obecně. Vymezuje, co zpráva o psaní pomocí AI měří, co nezávislé testování zjistilo, že vyhodnocuje správně a nesprávně, a proč dva studenti odevzdávající totožnou práci mohou dospět k různým výsledkům podle toho, na jaké univerzitě studují. Nic z toho nemění to, co ve vašem vlastním sylabu kurzu stojí o přípustném použití AI. Nahrazuje odhad o černé skříňce popisem toho, co je v ní skutečně obsaženo.
Can Turnitin Detect ChatGPT? Co zpráva ve skutečnosti ukazuje
Zpráva o psaní pomocí AI v Turnitin je samostatný produkt od zprávy o podobnosti, která kontroluje plagiátorství. Běží na různých modelech a v tomtéž rozhraní se zobrazuje na různých kartách. Skóre podobnosti se dívá na vaše odevzdání a porovnává je s databází dříve publikovaných zdrojů a dalších studentských prací, aby vrátilo procento shody. Skóre AI dělá něco zcela jiného, je to klasifikátor, který čte vaši prózu větu po větě, každé větě přiřazuje pravděpodobnost, že byla vytvořena AI, a poté tato skóre na úrovni vět shrnuje do jediného procenta dokumentu. Protože měří různé věci, může mít odevzdání skóre podobnosti 2 procenta a skóre AI 60 procent, nebo naopak.
Toto procento je ve skutečnosti užší, než jak zní. Jde o podíl způsobilé prózy, o níž model předpovídá, že byla napsána AI, nikoli o celý dokument, protože při výpočtu skóre odstraňují věci jako bloky kódu, odrážky, nadpisy a krátkou formu psaní. Detektor lze použít pouze na dokumenty, které mají alespoň 300 slov dlouhé prózy, a k okamžiku psaní je určen jen pro anglický, španělský a japonský text. Jak se dalo očekávat, když to postavíme vedle toho, jak AI detektory obecně počítají toto skóre, je zde známý vzorec, číslo na úrovni dokumentu, které vypadá přesně, je postaveno na užším výřezu textu, než naznačuje hlavní údaj.
Co se zobrazuje jako AI: ChatGPT a ostatní
Turnitin uvádí, že jeho klasifikátor hledá spíše vzorec psaní než název značky, a jeho pokrytí se od původního spuštění GPT-3.5 a GPT-4 v roce 2023 opakovaně rozšířilo. Současné pokyny uvádějí mezi systémy, proti nimž je trénován, řadu GPT-5, Gemini a Claude, přičemž nové verze modelů jsou průběžně přidávány. To zahrnuje i text, který se nikdy nedostal přímo do ChatGPT. Student, který místo toho použil Gemini, Claude nebo DeepSeek, detektor neobchází jen tím, že zvolil jinou společnost, vlastní popis modelu od Turnitin výslovně uvádí, že se nezaměřuje na to, který dodavatel text vytvořil, ale pouze na to, jak text zní.
Parafrázovaný AI text má vlastní kategorii, nikoli volný průchod. Dokumentace Turnitin rozlišuje text, který považuje pouze za AI generovaný, od textu, který považuje za AI generovaný a poté AI parafrázovaný, a v srpnu 2025 přidala detekci zaměřenou konkrétně na nástroje pro obcházení AI, které jsou vytvořeny k přepisování strojového výstupu tak, aby prošel detektorem. To neznamená, že parafrázování je zbytečné nebo že každý přepsaný úsek bude zachycen. Znamená to, že předpoklad, že parafrázování je pro Turnitin ve výchozím nastavení neviditelné, je už nějakou dobu zastaralý.
Jak přesné je skóre AI od Turnitin?
Tvrdzení Turnitin o přesnosti se odvíjí od jednoho hlavního čísla, uvádí, že u dokumentů, kde je označeno více než 20 procent textu, udržuje míru falešně pozitivních výsledků pod 1 procentem. Společnost také uvádí, že každou novou verzi svých modelů testuje proti 700,000 akademickým pracím napsaným předtím, než ChatGPT existoval, aby tuto přesnost ověřila. Jde o konkrétní, testovatelný nárok týkající se určitého souboru okolností. Stojí za to jej číst přesně takto. Turnitin v roce 2023, krátce po svém spuštění, vznesl i další tvrzení o přesnosti. Hlavní produktový ředitel společnosti veřejně přiznal, že laboratorní testování nepředpovědělo, kolik falešně pozitivních výsledků se objeví v reálném používání, zejména u krátkých odevzdání, a uvedl, že procento falešně pozitivních výsledků bylo v praxi vyšší než při testování. Uvedl míru falešně pozitivních výsledků na úrovni vět, tedy přibližně 4 procenta, a poznamenal, že Turnitin v důsledku toho zvýšil minimální délku odevzdání, která může být hodnocena, z 150 na 300 slov. Současné minimum je stále 300 slov.
Nezávislé testování doplňuje podrobnosti, které údaj od dodavatele neobsahuje. Centrum pro rozvoj výuky na Temple University provedlo jednu z pečlivějších dostupných analýz, ve stejném duchu jako nezávislé testování AI detektorů, které stále odhaluje rozdíly mezi laboratorními podmínkami a skutečnými odevzdáními. Výzkumníci předložili 120 vzorků psaní, rovnoměrně rozdělených mezi zcela lidské texty, zcela AI generované texty, AI generované texty upravené pomocí nástroje pro parafrázování a hybridní texty kombinující lidské a AI příspěvky, a zaznamenali, co Turnitin v každém případě vrátil. Nástroj správně identifikoval 93 procent čistě lidských vzorků a 77 procent čistě AI generovaných vzorků.
U obtížnějších otázek přesnost klesla ještě více. Turnitin správně identifikoval pouze 63 procent parafrázovaných vzorků AI jako generovaných AI a jen 43 procent hybridních vzorků jako ani zcela lidských, ani zcela AI, což jsou kategorie nejblíže tomu, jak se ve skutečnosti vytváří text s pomocí AI. Právě hybridní text byl pro výzkumníky zvlášť zajímavý, protože se domnívají, že bude pravděpodobně tvořit velkou část, možná většinu, skutečných odevzdaných prací do budoucna, jak bude stále více kurzů zadávat úkoly, které studentům ukládají použít AI na část práce.
| Co bylo testováno | Výsledek Turnitin |
|---|---|
| 100% vzorky napsané člověkem | 93% správně identifikováno jako lidské |
| 100% vzorky generované AI | 77% správně identifikováno jako AI |
| Text AI prohnaný nástrojem pro parafrázování | 63% správně identifikováno jako AI |
| Hybridní vzorky, část lidská a část AI | 43% správně identifikováno jako ani 0% ani 100% |
| Dokumenty s více než 20% označenými pasážemi (vlastní údaj Turnitin) | Míra falešně pozitivních výsledků pod 1% |
Humanize your own paper
Transform your AI-assisted text and make it sound human, without touching important words or citations.
Kde to selhává, i když číslo vypadá správně
Skóre na úrovni dokumentu není jediná věc, kterou může vyučující vidět, a druhý pohled je méně spolehlivý. Některá rozhraní umožňují vyučujícímu otevřít zprávu s označením, která zvýrazňuje konkrétní věty jako pravděpodobně napsané AI. Výzkumníci z Temple tato zvýraznění porovnali s tím, které věty v jejich hybridních vzorcích byly skutečně napsané AI, a nenašli mezi nimi žádnou souvislost. To je důležité, pokud vám profesor pošle snímek obrazovky se zvýrazněným odstavcem místo souhrnného procenta: celkové skóre dokumentu si vedlo podstatně lépe než zvýraznění na úrovni vět.
Nižší skóre se zpracovávají znovu odlišně a opatrněji než dříve. Od července 2024 Turnitin zobrazuje místo čísla hvězdičku vždy, když jeho model odhaduje, že méně než 20 procent dokumentu je napsáno AI, protože právě v tomto rozmezí je nejpravděpodobnější, že se nástroj mýlí jedním či druhým směrem. Lehké úpravy s pomocí AI, jeden odstavec přepsaný s pomocí a zbytek napsaný bez pomoci, často nevyvolají vůbec žádné viditelné procento, spíše než malé, což je dobré vědět dříve, než se absence čísla začne považovat za důkaz čehokoli.
Kdo vlastně vidí číslo
Skóre AI není ve výchozím nastavení součástí zprávy určené studentům. Nachází se na samostatné kartě, viditelné pro vyučující a administrátory, a student je uvidí jen tehdy, pokud se vyučující rozhodne zprávu sdílet nebo ji přímo zpřístupnit. To je skutečný strukturální rozdíl oproti skóre podobnosti, které si studenti obvykle mohou sami zobrazit ve stejném systému poté, co byla odevzdaná práce zpracována.
Totéž platí i pro to, zda je tato funkce pro konkrétní kurz vůbec k dispozici, což je institucionální rozhodnutí nad rámec vyučujícího. Administrátoři na úrovni účtu mohou detekci AI v Turnitin zapnout nebo vypnout pro celou instituci. Jeden vyučující ji nemusí být schopen zapnout, pokud ji jeho univerzita vypnula, a naopak. Student z jedné univerzity, který odevzdá podobnou práci jinému studentovi z jiné univerzity, může mít s tímto nástrojem velmi odlišnou zkušenost, a to z důvodů, které nemají nic společného s tím, co kterýkoli z nich napsal.
Proč ji některé univerzity vypnuly
Univerzita ve Waterloo v září 2025 ukončila funkci detekce AI v Turnitin a její zveřejněné zdůvodnění je neobvykle přímé. Univerzita uvedla zdokumentovanou nespolehlivost nástroje, jeho zaujatost vůči studentům, jejichž prvním jazykem není angličtina, a také vlastní interní testování, které zahrnovalo alespoň jeden případ zcela lidsky napsaného textu ohodnoceného jako 100 procent AI-generovaného. Po zvážení nákladů na nástroj univerzita dospěla k závěru, že náklady převyšují přínosy, a úsilí místo toho přesměrovala na přepracování hodnocení a školení v oblasti AI gramotnosti.
Waterloo je jeden viditelný příklad širšího rozdělení, nikoli odlehlá výjimka. Univerzity, které tuto funkci ponechávají zapnutou, obvykle přidaly pojistky, místo aby považovaly skóre samo o sobě za verdikt, vyžadují rozhovor se studentem, než začne cokoli formálního, a číslo berou jako důvod tento rozhovor otevřít, nikoli uzavřít. Seznámení se s tím, jak univerzity obecně řeší politiku AI, činí tento vzorec zřetelnějším: zda se k vám nějaké skóre vůbec dostane, závisí na rozhodnutí učiněném daleko nad úrovní vašeho semináře, nikoli na pevné vlastnosti samotné technologie.
Co vysoké skóre prokazuje a co neprokazuje
Vysoké skóre AI je důkaz, nikoli verdikt. Samotný Turnitin rámuje procento jako jeden údaj pro úsudek vyučujícího, nikoli jako zjištění pochybení, a výše uvedené údaje o přesnosti vysvětlují, proč na tomto rámci záleží: i skóre na úrovni dokumentu, které funguje poměrně dobře, chybně vyhodnocuje významný podíl silně upravovaného, parafrázovaného nebo hybridního psaní a zvýraznění na úrovni vět jsou výrazně méně spolehlivá než souhrnné číslo. Nic z toho nezaručuje, že je jakékoli jednotlivé skóre chybné. Znamená to, že jedno procento je důvodem klást otázky, nikoli zjištěním, které je třeba přijmout na první pohled. Pokud chcete vidět, kde se vaše vlastní psaní nachází dříve, než je kdokoli jiný ohodnotí, stejné vzorce nízké variace a obecného formulování, na které klasifikátor reaguje, lze přímo ověřit pomocí bezplatného perplexity checkeru.
TextPulse's AI humanizer pro studenty funguje na stejném statistickém základě a totéž platí pro jeho bezplatný kontrolor burstiness pro polovinu stejného měření, která se týká rytmu vět. Dává vám odhadované Human Score založené na vašem vlastním návrhu, nikoli predikci toho, co o něm řekne Turnitin. Žádný nástroj nemůže odpovědně slibovat něco takového o systému, který nekontroluje. Berte to jako druhé přečtení vlastního textu, nic víc.
Některé z těchto otázek mají vlastní stránky. Zda profesor pozná, že jste použili ChatGPT bez jakéhokoli detektoru, a jeho přímočařejší verze, budu přistižen, jsou zodpovězeny samostatně. Totéž platí pro chování Turnitin u parafrázovaného textu a pro zda Turnitin konkrétně detekuje výstup DeepSeek. Pro konkrétní prostředí existují texty o detekci AI v ošetřovatelských programech a o zda přijímací kanceláře vysokých škol tyto kontroly provádějí. Širší rámování je obsaženo v samostatném textu o akademické integritě a AI.
Nic z toho pravděpodobně nebude konečná verze. Turnitin od roku 2023 více než jednou přepsal své prahy, pravidla viditelnosti i pokrytí modelů a srpen 2026 nebude ani posledním slovem. To, co zůstává stálé, je návyk, který stojí za to mít bez ohledu na to, jaký detektor daný kurz používá, pište s dostatečným množstvím konkrétních, nerovnoměrných, skutečně vašich detailů, aby to, co si nějaký klasifikátor náhodou myslí, bylo vedlejší.
Frequently Asked Questions
Ukazatel AI psaní Turnitin existuje právě proto, aby odpověděl na tuto otázku. Může Turnitin detekovat ChatGPT? Obvykle ano, pokud dokument obsahuje podstatné množství AI psaní, klasifikátor označí prózu, která statisticky odpovídá typickému jazyku modelu, a vlastní data Turnitin ukazují, že přibližně 15 procent naskenovaných esejí nyní dosahuje vysokého podílu AI psaní. Zároveň text pravidelně přehlíží, přičemž nezávislé testování zjistilo, že přesnost klesla na 63 procent u parafrázovaného AI psaní a na 43 procent u hybridního textu.
PhD in natural language processing, with years spent building NLP applications end to end. Moe works on text analysis: lexical and syntactic structure, and what separates machine-generated prose from human prose statistically. He has been experimenting with computational linguistics since the early days of NLTK, spaCy and WordNet, and still writes most of his tooling in Python.