AI Detection

Képes a Turnitin felismerni a ChatGPT-t? Mit észlel és mit nem

A Turnitin AI írásjelentése és a plágiumjelentése külön termékek, eltérő közönséggel és eltérő pontossági mutatókkal. Íme, mit mér valójában az AI pontszám, hol mutatnak az önálló tesztek hibát, és miért nem feltétlenül hasonlít a jelentése a szobatársa jelentésére.

8 min
Illustration answering can Turnitin detect ChatGPT, showing the AI writing report displayed separately from the similarity report

Igen, de csak egy meghatározott típusú AI-használat esetében, és egy olyan jelentésben, amelyet a legtöbb hallgató soha nem lát. A Turnitin AI writing indicator olyan prózát jelöl meg, amely statisztikailag tipikusnak tűnik egy nyelvi modellhez képest, és ezt az általa átvizsgált dolgozatok egyre nagyobb részén teszi meg: 2025 októbere és 2026 februárja között körülbelül 15 százalék mutatott 80 százalékos vagy annál nagyobb AI-generated writing arányt, szemben a körülbelül 3 százalékkal, amikor az eszköz 2023 áprilisában elindult. Az, hogy a saját beadott munkáját megjelöli-e, olyan részletektől függ, amelyeket a can Turnitin detect ChatGPT kérdésre adott válaszok többsége figyelmen kívül hagy: miben különbözik az AI report a plagiarism reporttól, ki látja valójában a számot, és milyen gyakran bizonyul ez a szám tévesnek.

Ez a bejegyzés ennek az egy terméknek a működését tárgyalja, nem pedig az academic integrity kérdését általában. Bemutatja, mit mér az AI writing report, mit találtak róla a független tesztek, mi az, amit helyesen és mi az, amit hibásan azonosít, valamint azt is, miért kaphat két hallgató azonos munka beadása esetén eltérő eredményt attól függően, melyik egyetemre járnak. Mindez nem változtat azon, amit az Ön saját kurzuskalauza mond az elfogadható AI-használatról. Egy fekete dobozról alkotott találgatást egy tényleges leírással helyettesít arról, mi van benne valójában.

Can Turnitin Detect ChatGPT? Mit mutat valójában a report

A Turnitin AI writing report külön termék a similarity reporttól, amely a plagiarism ellenőrzésére szolgál. Különböző modelleken futnak, és ugyanazon felületen külön füleken jelennek meg. A similarity score az Ön beadott munkáját vizsgálja, és összeveti egy korábban publikált forrásokból és más hallgatói dolgozatokból álló adatbázissal, hogy megadja a megegyező rész százalékos arányát. Az AI score egészen mást tesz: ez egy osztályozó, amely mondatról mondatra olvassa a prózát, minden egyes mondathoz AI-generated valószínűséget rendel, majd ezeket a mondatszintű pontszámokat egyetlen dokumentumszázalékba összesíti. Mivel különböző dolgokat mérnek, előfordulhat, hogy egy beadott munka similarity score-ja 2 százalék, miközben az AI score-ja 60 százalék, vagy fordítva.

Ez a százalék valójában szűkebb, mint amilyennek hangzik. Ez a jogosult prózai szöveg azon aránya, amelyről a modell azt jósolja, hogy AI írta, nem pedig a teljes dokumentumé, mert az eredmény kiszámításakor eltávolítják az olyan elemeket, mint a kódblokkok, a felsoroláspontok, a címsorok és a rövid formájú írások. Az észlelő csak olyan dokumentumokra alkalmazható, amelyek legalább 300 szóból álló, hosszú formájú prózát tartalmaznak, és a jelen írás idején csak angol, spanyol és japán szövegre használható. Ahogy várható, ha ezt általában az AI észlelők hogyan számítják ki ezt az eredményt mellé tesszük, az itt látható minta is ismerős, egy dokumentumszintű szám, amely pontosnak tűnik, valójában a szöveg egy szűkebb szeletéből épül fel, mint amit a címsorban szereplő érték sugall.

Mi jelenik meg AI-ként: ChatGPT és a többiek

Turnitin szerint az osztályozója inkább írási mintázatot keres, mint márkanevet, és a lefedettsége az eredeti GPT-3.5 és GPT-4 2023-as bevezetése óta többször bővült. A jelenlegi útmutatás a GPT-5 sorozatot, a Gemini és a Claude rendszereket is megnevezi azok között, amelyekkel szemben tanítják, és az új modellkiadások folyamatosan hozzáadásra kerülnek. Ez magában foglalja az olyan szöveget is, amely soha nem érintette kifejezetten a ChatGPT-t. Az a hallgató, aki helyette Gemini, Claude vagy DeepSeek használatával dolgozott, nem kerüli meg az észlelőt pusztán azzal, hogy másik céget választ; Turnitin saját modellleírása egyértelműen kimondja, hogy nem arra figyel, melyik gyártó készítette a szöveget, hanem arra, hogyan olvasható a szöveg.

Az AI szövegként átfogalmazott tartalom külön kategóriát kap, nem pedig automatikus felmentést. Turnitin dokumentációja elkülöníti azokat a szövegeket, amelyeket kizárólag AI által generáltnak ítél, azoktól, amelyeket AI által generáltnak, majd AI által átfogalmazottnak ítél, és 2025 augusztusában olyan észlelést adott hozzá, amely kifejezetten az AI megkerülő eszközökre irányul, amelyeket arra építettek, hogy a gépi kimenetet egy észlelő előtt átírják. Ez nem azt jelenti, hogy az átfogalmazás haszontalan, vagy hogy minden átírt részletet elkapnak. Azt jelenti, hogy az a feltételezés, miszerint az átfogalmazás alapértelmezés szerint láthatatlan Turnitin számára, már jó ideje elavult.

Mennyire pontos a Turnitin AI pontszáma?

A Turnitin pontossági állítása egyetlen fő számra vezethető vissza: azt állítja, hogy a hamis pozitív arány 1 százalék alatt marad azokon a dokumentumokon, ahol a szöveg több mint 20 százalékát megjelöli. A vállalat azt is állítja, hogy minden új modellverzióját 700,000, ChatGPT előtti akadémiai cikken teszteli, hogy ezt a pontosságot ellenőrizze. Ez egy konkrét, ellenőrizhető állítás egy meghatározott körülményegyüttesről. Érdemes pontosan így olvasni. Turnitin 2023-ban, röviddel a bevezetése után, más pontossági állításokat is tett. A vállalat termékigazgatója nyilvánosan elismerte, hogy a laboratóriumi tesztelés nem jelezte előre, hány hamis pozitív jelenik majd meg a valós használatban, különösen a rövid beadások esetében, és azt mondta, hogy a hamis pozitívok aránya a gyakorlatban magasabb volt, mint a tesztelésben. A mondatszintű hamis pozitív arányt körülbelül 4 százaléknak jelentette, és megjegyezte, hogy ennek következtében Turnitin 150-ről 300 szóra emelte a pontozható beadások minimális hosszát. A jelenlegi minimum továbbra is 300 szó.

A független tesztelés olyan részleteket ad hozzá, amelyeket a szállítói adat nem tartalmaz. A Temple University Oktatásfejlesztési Központja az elérhető egyik leggondosabb vizsgálatot végezte el, ugyanabban a szellemben, mint az AI detektorok független tesztelése, amely újra és újra feltárja a laboratóriumi körülmények és a valós beadások közötti eltéréseket. A kutatók 120 írásmintát nyújtottak be, egyenlő arányban elosztva teljesen emberi írás, teljesen AI által generált írás, parafrazáló eszközön átfuttatott AI által generált írás, valamint emberi és AI hozzájárulásokat ötvöző hibrid szövegek között, és rögzítették, hogy Turnitin mit adott vissza mindegyikre. Az eszköz a tisztán emberi minták 93 százalékát és a tisztán AI által generált minták 77 százalékát helyesen azonosította.

A nehezebb kérdéseknél a pontosság még tovább csökkent. A Turnitin a parafrazált AI-minták közül mindössze 63 százalékot azonosított helyesen AI által generáltnak, a hibrid minták közül pedig csak 43 százalékot helyesen úgy, hogy azok sem nem teljesen emberiek, sem nem teljesen AI, vagyis azokba a kategóriákba, amelyek a legközelebb állnak ahhoz, ahogyan az AI-val segített írás valójában létrejön. A hibrid szöveg különösen érdekelte a kutatókat, mert úgy vélik, hogy a jövőben a valódi beadott munkák jelentős részét, esetleg a többségét is ez fogja adni, ahogy egyre több kurzus ír elő olyan feladatokat, amelyekben a hallgatóknak a munka egy részéhez AI-t kell használniuk.

Mit teszteltekA Turnitin eredménye
100% ember által írt minták93% helyesen emberinek azonosítva
100% AI által generált minták77% helyesen AI-ként azonosítva
AI-szöveg, amelyen parafrazáló eszközt futtattak végig63% helyesen AI-ként azonosítva
Hibrid minták, részben emberi, részben AI43% helyesen sem 0%, sem 100% nemként azonosítva
20% felett megjelölt dokumentumok (a Turnitin saját adata)1% alatti téves pozitív arány

Humanize your own paper

Transform your AI-assisted text and make it sound human, without touching important words or citations.

Get started free

Hol vall kudarcot még akkor is, amikor a szám helyesnek tűnik

A dokumentumszintű pontszám nem az egyetlen dolog, amit az oktató láthat, és a másik nézet kevésbé megbízható. Egyes felületek lehetővé teszik, hogy az oktató megnyisson egy jelölési jelentést, amely bizonyos mondatokat valószínűleg AI által írtként emel ki. A Temple kutatói összevetették ezeket a kiemeléseket azzal, hogy hibrid mintáik mely mondatai voltak valójában AI által írtak, és nem találtak kapcsolatot a kettő között. Ennek jelentősége van, ha egy professzor inkább egy kiemelt bekezdés képernyőképet küld Önnek, mint az összesített százalékot: az egész dokumentumra vonatkozó pontszám lényegesen jobban teljesített, mint a mondatszintű kiemelések.

Az alacsony pontszámokat ismét másként, és óvatosabban kezelik, mint korábban. 2024 júliusa óta a Turnitin csillagot jelenít meg szám helyett, amikor a modell becslése szerint egy dokumentum kevesebb mint 20 percenta AI által írt, mert ebben a tartományban a legvalószínűbb, hogy az eszköz bármelyik irányban téved. Egy enyhe AI-segítséggel végzett szerkesztés, amikor egy bekezdést segítséggel átírnak, a többi részt pedig önállóan írják, gyakran egyáltalán nem látható százalékot eredményez, nem pedig egy alacsonyat, és ezt érdemes tudni, mielőtt a szám hiányát bárminek is bizonyítékaként kezelnék.

Ki látja valójában a számot

Az AI pontszám alapértelmezés szerint nem része a hallgatóknak szánt jelentésnek. Külön fülön található, amelyet az oktatók és az adminisztrátorok láthatnak, a hallgató pedig csak akkor látja, ha az oktató úgy dönt, hogy megosztja a jelentést, vagy közvetlenül megmutatja neki. Ez valódi szerkezeti különbség a hasonlósági pontszámhoz képest, amelyet a hallgatók jellemzően maguk is megtekinthetnek ugyanabban a rendszerben, miután a beküldést feldolgozták.

Ugyanez vonatkozik arra is, hogy egy adott kurzus esetében egyáltalán létezik-e ez a funkció, ami intézményi döntés, az oktatótól függetlenül. A fiókszintű adminisztrátorok egy teljes intézmény számára be- vagy kikapcsolhatják a Turnitin AI észlelését. Előfordulhat, hogy egy oktató nem tudja bekapcsolni, ha az egyeteme kikapcsolta, és fordítva. Egy hallgató, aki az egyik egyetemen nyújt be hasonló munkát, egészen más tapasztalatot szerezhet erről az eszközről, mint egy másik egyetem hallgatója, olyan okokból, amelyeknek semmi közük ahhoz, amit bármelyikük írt.

Miért kapcsolták ki egyes egyetemek

A Waterlooi Egyetem 2025 szeptemberében megszüntette a Turnitin AI-észlelési funkcióját, és a nyilvánosan közölt indoklás szokatlanul egyenes. Az egyetem a eszköz dokumentált megbízhatatlanságára, azokra a hallgatókra gyakorolt elfogultságára hivatkozott, akiknek az első nyelve nem angol, valamint a saját belső tesztelésére, amely legalább egy olyan esetet is tartalmazott, amikor teljes egészében ember által írt szöveget 100 százalékban AI által generáltnak értékelt. Az eszköz költségét mérlegelve az egyetem arra a következtetésre jutott, hogy a költségek meghaladják az előnyöket, ezért inkább az értékelés áttervezésére és az AI-műveltségi képzésre irányította át az erőfeszítéseket.

Waterloo egy látható példája egy szélesebb megosztottságnak, nem pedig kivétel. Azok az egyetemek, amelyek bekapcsolva tartják a funkciót, általában inkább védőkorlátokat adnak hozzá, mintsem hogy az eredményt önmagában ítéletként kezelnék, megkövetelik a hallgatóval folytatott beszélgetést, mielőtt bármi formális eljárás elkezdődne, és a számot inkább okként kezelik arra, hogy ezt a beszélgetést megnyissák, ne pedig lezárják. Ha elolvassuk, hogyan kezelik az egyetemek tágabban az AI-szabályozást, a minta világosabbá válik: hogy egy pontszám egyáltalán eljut-e Önhöz, az jóval a szemináriumi terem fölött meghozott döntéstől függ, nem pedig magának a technológiának valamely rögzített tulajdonságától.

Mit bizonyít, és mit nem bizonyít egy magas pontszám

A magas AI-pontszám bizonyíték, nem ítélet. Maga a Turnitin is úgy keretezi a százalékos értéket, mint az oktató megítélésének egyik adatpontját, nem pedig a szabálytalanság megállapítását, és a fenti pontossági adatok megmagyarázzák, miért fontos ez a keretezés: még egy olyan dokumentumszintű pontszám is, amely elfogadhatóan teljesít, jelentős arányban félreérti a nagymértékben szerkesztett, parafrazált vagy hibrid írást, a mondatszintű kiemelések pedig lényegesen kevésbé megbízhatók, mint az összesített szám. Mindez nem garantálja, hogy bármely egyedi pontszám téves. Azt jelenti, hogy egyetlen százalék inkább ok a kérdések feltevésére, mint olyan megállapítás, amelyet első pillantásra el kell fogadni. Ha szeretné látni, hogy az Ön saját szövege hol áll, mielőtt bárki más pontozná, ugyanazok az alacsony változatosságú, általános megfogalmazási minták, amelyekre egy osztályozó reagál, közvetlenül ellenőrizhetők egy ingyenes perplexity-ellenőrzővel.

TextPulse AI humanizer for students ugyanazon statisztikai alapon működik, és ugyanez igaz a free burstiness checker eszközére is, amely ugyanennek a mérésnek a mondatritmusra vonatkozó felére szolgál. Ez egy becsült Human Score értéket ad az Ön saját vázlata alapján, nem pedig azt jósolja meg, hogy Turnitin mit fog mondani róla. Egyetlen eszköz sem ígérheti ezt felelősen egy olyan rendszerről, amelyet nem irányít. Tekintse ezt saját írásának egy második átolvasásaként, semmi többként.

E kérdések közül többnek saját oldala van. Azt, hogy egy professzor meg tudja-e állapítani, hogy ChatGPT-t használt bármilyen detektor nélkül is, valamint ennek nyersebb változatát, a lebukom-e kérdését külön tárgyaljuk. Ugyanez igaz a Turnitin parafrazált szövegre vonatkozó viselkedésére, valamint arra is, hogy Turnitin kimutatja-e a DeepSeek kimenetét kifejezetten. Egyes helyzetekre külön írások foglalkoznak az AI detection a nursing programmes-ben témájával, illetve azzal, hogy a college admissions offices elvégzik-e ezeket az ellenőrzéseket. A tágabb keret egy külön írásban jelenik meg az academic integrity and AI témájáról.

Valószínűleg egyik sem lesz a végleges változat. Turnitin 2023 óta már többször átírta a küszöbértékeit, a láthatósági szabályait és a modelllefedettségét, és 2026 augusztusa sem lesz az utolsó szó. Ami állandó marad, az az a szokás, amelyet érdemes kialakítani, függetlenül attól, hogy egy adott kurzus melyik detektort használja: írjon elég konkrét, egyenetlen, valóban saját részletekkel ahhoz, hogy az, amit egy osztályozó éppen gondol, másodlagossá váljon.

Frequently Asked Questions

A Turnitin AI írásjelzője éppen erre a kérdésre szolgál. Képes a Turnitin felismerni a ChatGPT-t? Általában igen, ha egy dokumentum jelentős mennyiségű AI által írt szöveget tartalmaz, a besorolórendszer olyan prózát jelöl, amely statisztikailag tipikusnak tűnik egy nyelvi modell számára, és a Turnitin saját adatai szerint a vizsgált dolgozatok mintegy 15 százaléka ma már erősen AI által írtnak számít. Ugyanakkor rendszeresen kihagy szövegeket is, és független tesztelés szerint a pontosság 63 százalékra esett vissza parafrazált AI szövegnél, valamint 43 százalékra hibrid szövegnél.

Moe

PhD in natural language processing, with years spent building NLP applications end to end. Moe works on text analysis: lexical and syntactic structure, and what separates machine-generated prose from human prose statistically. He has been experimenting with computational linguistics since the early days of NLTK, spaCy and WordNet, and still writes most of his tooling in Python.

Képes a Turnitin felismerni a ChatGPT-t? | TextPulse.ai