AI Detection

Képes-e a Turnitin felismerni az átfogalmazott szöveget?

Igen, a Turnitin felismeri az átfogalmazott szöveget, és erre is készült. A hasonlósági motorja kiszűri azokat az átfogalmazott részeket, amelyek továbbra is átfednek a publikált és korábban benyújtott munkákkal, az AI írásjelentése pedig címkézett kategóriát tartalmaz az AI által generált, parafrázis eszközzel vagy szóforgatóval átdolgozott szöveg számára. Íme, hogyan találja meg ezt mindkét rendszer, és miért nem oldja meg egyiknél sem a problémát a szavak szinonimákra cseréje.

9 min
Diagram answering can Turnitin detect paraphrased text, comparing similarity matching against the AI writing indicator

Igen. A Turnitin felismeri az átfogalmazott szöveget, és eleve erre tervezték. Ugyanazon jelentésen belül két rendszer is kiszűri. A Similarity Report megjelöli azokat a szakaszokat, amelyek a megfogalmazás megváltoztatása után is átfedésben maradnak a közzétett munkákkal vagy a korábban benyújtott dolgozatokkal, és ez az a feladat, amelyet már jóval azelőtt ellátott, hogy az AI írás létezett volna. Az AI Writing Report saját, külön címkézett kategóriát tart fenn az AI által generált szöveg számára, ha azt parafrazáló eszközzel vagy word spinnerrel dolgozták át. A szavak szinonimákra cserélése egyik rendszert sem tisztítja meg.

Az, hogy egy adott szakaszt melyik rendszer fog ki, attól függ, honnan származik a szöveg. A forrásból átvett, átfogalmazott anyag similarity probléma. A ChatGPT által generált, átfogalmazott anyag AI writing probléma. Sok beadott munka egyszerre mindkettő, és mindkét rendszer amúgy is elolvassa az összes beadott munkát.

A Turnitin a parafrazált AI szöveget saját kategóriaként nevezi meg

Ez nem abból levont következtetés, ahogyan az észlelőrendszerek általában működnek. A Turnitin AI Writing Reportja a százalékos értéket két címkézett kategóriára bontja, és a második ezek közül a parafrazált AI szöveg.

Turnitin AI Writing Overview page listing two categories: AI-generated only, described as likely AI-generated text from a large-language model, and AI-generated text that was AI-paraphrased, described as likely AI-generated text that was likely revised using an AI-paraphrase tool or word spinner
A Turnitin AI Writing Overview, amelyben a parafrázis kategória a saját termékében jelenik meg. A fő százalék mindkét sort egyesíti, a második pedig az AI parafrazálóval vagy word spinnerrel átdolgozott szöveget fedi le.

A jelentés a fő értéket úgy határozza meg, mint "a valószínűleg AI által generált szöveg, valamint a valószínűleg AI által generált, de valószínűleg AI-val is parafrazált szöveg együttes mennyisége". A második tétel "AI-generated text that was AI-paraphrased" címkét viseli, és úgy írják le, mint "valószínűleg AI által generált szöveg, amelyet valószínűleg egy AI-paraphrase tool vagy word spinner segítségével dolgoztak át".

Turnitin támogatási dokumentációja ezt a kérdést részletesen megválaszolja. Amikor közvetlenül megkérdezik, hogy képes-e felismerni egy AI parafrazáló eszközzel átfogalmazott tartalmat, az útmutató ezt állítja: "Yes, Turnitin's AI indicator includes detection of AI-generated content that may have been paraphrased using a word spinner/AI paraphrasing tool." Egy csaknem azonos válasz vonatkozik arra a szövegre is, amelyet egy kifejezetten arra épített bypasser eszközön futtattak át, hogy az AI-kimenetet egy detektor előtt átírja. Egyik sem hoz létre külön pontszámot. Mindkettő ugyanabba az egyetlen százalékértékbe kerül, amelyet az oktató lát.

Mit észlel az egyes rendszer

Hasonlósági jelentésAI írásjelentés
Mit ellenőrizHogy a szöveg átfed-e olyan forrásokkal, amelyek már szerepelnek a Turnitin webes tartalmakból, publikációkból és hallgatói dolgozatokból álló adatbázisábanHogy a próza statisztikailag tipikusnak olvasható-e a gép által generált írásra
Mit észlel a parafrazálásbólValaki más közzétett vagy benyújtott munkájátAI által generált vázlatokat, beleértve azokat is, amelyeket egy parafrazáló vagy bypasser eszköz átdolgozott
Egy szinonimacserés átírás hatásaCsökkenti a százalékot, de meghagyja az egyedi kifejezéseket, idézeteket és a mondatszerkezet egyezésétA pontszámot nagyrészt ott hagyja, ahol volt, mert az osztályozó a mondatmintázatot olvassa, nem a szóválasztást
Hol jelenik megEgy százalékérték, valamint egyezési csoportok, amelyek megnevezik az egyes forrásokatEgy százalékérték, amely AI-generated only és AI-paraphrased részekre oszlik

A két jelentés külön termék, külön számokkal, és egy dolgozat az egyikben tiszta lehet, a másikban pedig megjelölhető. TextPulse ezt a megosztást teljes egészében lefedi a Turnitin hasonlósági pontszámának és AI pontszámának összehasonlításában, valamint magának az osztályozónak a működését a hogyan észleli a Turnitin az AI írást című részben.

Emberibbé tenni saját dolgozatát

Alakítsa át az AI által támogatott szövegét úgy, hogy emberinek hangozzon, anélkül hogy fontos szavakat vagy hivatkozásokat érintene.

Kezdje el ingyen

A hasonlósági oldal: Az átfogalmazott szöveg továbbra is átfed

A hasonlóságellenőrzés egyeztetési feladat. A Turnitin egy benyújtott dolgozatot összevet a webes tartalmakból, kiadványokból és korábban benyújtott dolgozatokból álló adattárával, és azt jelzi, hogy mennyire fed át valami olyasmivel, amelyet már indexelt. Ha elég sok szót megváltoztatunk, az összehasonlított pontos sztringek száma csökken, így az arány is esik. Ez valós jelenség, és ezért léteznek parafrazáló eszközök.

A csere során az marad meg, amit a hallgatók alábecsülnek. A szakkifejezések, tulajdonnevek, idézett adatok és szó szerinti idézetek változatlanul kerülnek át, mert ezekre nincs szinonima. Ugyanez igaz a mondatszerkezetre is, ha csak az összekötő szavakat cserélik le. A Turnitin az átfedést egyezési csoportokként jelzi, mindegyik megnevezve a forrását, és ez különíti el a szabályosan idézett részletet az átírt változattól.

Turnitin hasonlósági jelentés, amely 12% összesített hasonlóságot mutat egyezési csoportokra bontva: 115 egyezés nem idézett vagy nem hivatkozott 9%-on, és 41 egyezés hiányzó idézőjelekkel 3%-on, a legfontosabb források az internet, kiadványok és hallgatói dolgozatok között felsorolva
A hasonlósági jelentés az arányt egyezési csoportokra bontja. A 115, "not cited or quoted" jelölésű egyezés azok közé tartozik, amelyek átírt vagy átvett anyagként olvashatók, nem pedig attribútummal ellátott idézetként.

Egy forrás átírását úgy, hogy közben megmarad a mondatsorrendje és a támogató részletek, patchwritingnak nevezik, és ezt a legtöbb egyetemi szabályzat a plágium egyik formájaként kezeli, függetlenül attól, hogy a hasonlósági arány csökken-e. Az ezt felismerni tanított értékelők gyakran szemmel is észreveszik, mert egy olyan érvelés, amely mondatról mondatra követ egy forrást, szókincstől függetlenül is annak olvasható. Az alacsony szám nem azonos a tiszta munkával, és éppen erről szól a TextPulse útmutatója a mi számít jó Turnitin pontszámnak.

Az AI oldala, egy szinonimacsere nem mozdítja el az eredményt

Az AI írásjelző soha nem hasonlította össze az Ön bekezdését egy forrással, ezért nincs olyan egyezés, amelyet egy szinonima fel tudna bontani. A prózát mondatról mondatra pontozza aszerint, hogy mennyire illeszkedik a gép által generált írás statisztikai mintázatához, a szójósolhatósághoz, a mondatritmushoz és ahhoz az általános megfogalmazáshoz, amelyhez egy nyelvi modell alapértelmezés szerint nyúl.

A szavak helyettesítése mindebből csaknem mindent érintetlenül hagy. A mondat megőrzi a hosszát, a sorrendjét és ugyanazt a megszokott kötőszövetet a tagmondatok között. Ezért olyan gyakori élmény, hogy egy AI vázlatot parafrazáló eszközön futtatnak át, majd azt látják, hogy az AI pontszám változatlan marad. A szókincs megváltozott. Az a minta, amelyet az osztályozó pontozott, nem változott, ezért a szöveget továbbra is gépi írásként olvassa, pontosan úgy, ahogyan Turnitin parafrázis kategóriája szerint kellene.

A mondathossz-eloszlás túléli az átírást

A gép által megfogalmazott próza szűk sávba rendeződik a mondathosszak tekintetében, mert egy modellnek, amely egyszerre egy tokent jósol, nincs oka arra, hogy a negyedik mondat rövidebb legyen, mint a harmadik. Az emberi írás ezzel szemben szórtabb, egy tizenkilenc szavas mondat, aztán egy hat szavas, majd egy harminckét szavas, amely együtt hordoz egy állítást és annak pontosítását. GPTZero saját magyarázata ezt közvetlenül meg is nevezi, a burstiness fogalmát úgy határozva meg, mint annak mértékét, hogy mennyire változnak az írásminták és a szöveg perplexity értékei egy dokumentumon belül.

Egy szinonimacsere egy mondat hosszát egy vagy két szóval módosítja, és minden mondatot hasonlóan kis mértékben módosít, így az eloszlás megtartja az alakját. Egy bekezdés, amely egy átfutás előtt tizennyolc, tizenkilenc, tizenhét és húsz szavas mondatokból áll, utána is egy vagy két szón belül ugyanahhoz a lapos profilhoz fog igazodni.

Ez mérhető anélkül, hogy egy detektor közelébe kellene menni. Egy ingyenes burstiness ellenőrző megmutatja, hogy egy szövegrész mennyi mondatszintű változatosságot hordoz, és ugyanannak a bekezdésnek a parafrazálás előtti és utáni futtatása azt mutatja, hogy a szám alig mozdul, miközben a szókincs teljesen megváltozik.

A tagmondatok sorrendje és az átmenetek is túlélnek

A tagmondatok sorrendje a második szerkezeti jellemző, amelyet egy parafrazáló érintetlenül hagy, és ez az olvasó számára jobban látható, mint a mondathossz. A gépi próza hajlamos előre hozni a témát, kimondani az állítást, majd a végén ismételten egy megszorító tagmondatot hozzáfűzni. A "While the sample size was limited, the results suggest" és az "Although further research is needed, the findings indicate" ugyanaz a mondat, csak más szavakkal.

Egy parafrazáló eszköz a "while" szót "although" szóra, a "suggest" szót pedig "show" szóra cseréli. Nem fogja eldönteni, hogy a megszorításnak három sorral később a saját rövid mondatában van a helye, vagy hogy a bizonytalanságot teljesen el kell hagyni. Ez szerkesztői döntés arról, hogy a bekezdés mit állít, és egy helyettesítő motor nem foglal állást az érvelésről.

Az átmeneti elemek a harmadik, és a leginkább látható jellemzők. A modellek a kapcsolódásoknál egy kicsi, stabil kötőszókészlethez nyúlnak, például however, additionally, furthermore, in addition. Egy parafrazáló ezek egyikét ugyanazon készlet egy másik tagjára cseréli, így az osztályozó továbbra is egy megszokott átmenetet lát az elvárt eloszlásból, az elvárt helyzetben. Ez az a jel, amelyet az átírás megkezdése előtt is olvasott.

Az osztályozó által olvasott jellemzőVáltozik-e egy parafrazáló futtatás soránMiért
Egyedi szóválasztásIgen, jelentősenEz az egyetlen jellemző, amelyet egy helyettesítő motor kifejezetten változtatásra épül
A mondathossz és annak szórásaAligA helyettesített szavak hossza közel azonos, ezért a profil megmarad
A tagmondatok sorrendje egy mondaton belülRitkánAz átrendezés megváltoztatja a hangsúlyt, amit a jelentéskorlát visszatart
A kapcsolódásoknál álló kötőszókUgyanazon kis készleten belül felcserélveEgy megszokott átmenetet egy másik megszokott átmenet vált fel
A következő szó előrejelezhetőségeKisséEgy ritkább szinonima kevésbé várható, de a körülötte lévő szerkezet ugyanolyan előrejelezhető marad
Konkrét bizonyíték és részletNemEgy átírás nem adhat hozzá olyan anyagot, amely soha nem volt a vázlatban

Mi változtatja meg valójában az eredményt

Mindkét rendszer ugyanannak a felszínes átírásnak különböző tüneteire reagál, ezért a megoldás is mindkettőnél ugyanaz, az írást kell megváltoztatni, nem a szavakat. Ez azt jelenti, hogy a mondatokat át kell szervezni, nem csupán az elemeiket újrarendezni, tudatosan változtatni kell a mondathosszt, el kell hagyni azokat az általános kötőelemeket, amelyekhez egy modell alapértelmezetten nyúl, és olyan támogató részleteket kell hozzáadni, amelyek elég konkrétak ahhoz, hogy csak abból a forrásanyagból származhassanak, amelyet valóban elolvasott. A hasonlóság azért csökken, mert a szerkezet már nem követi a forrást. Az AI pontszám azért csökken, mert eltűnik az a minta, amelyet az osztályozó pontoz.

Egy parafrazáló eszköz ezt a munkát nem tudja elvégezni, és a két eszközkategória közötti különbséget érdemes megérteni, mielőtt bármelyikért fizetne, amit TextPulse a AI humanizer versus paraphraser című írásban tárgyal. Egy vázlat saját szószintű előrejelezhetőségét egy free perplexity checker segítségével ellenőrizni hasznosabban mutatja meg azt a mintázatot, amelyre egy osztályozó reagál, mint önmagában egy pontszám.

TextPulse AI humanizer for students eszköze a probléma szerkezeti oldalán dolgozik, újraépíti a mondatok ritmusát, a hosszváltozatosságot és a tagmondatok sorrendjét, ahelyett hogy egyes szavakat cserélne, és éppen ez az a rés, amelyet egy kizárólag szinonimákkal dolgozó átírás tágra nyitva hagy. Kifejezetten a kurzusmunkákhoz a humanizing an AI essay for college a teljes munkafolyamatot végigveszi, a whether Turnitin detects DeepSeek pedig ugyanezt a kérdést válaszolja meg egy másik modellre vonatkozóan.

Ez semmit sem változtat azon, hogy egy kurzus AI-használati szabályzata mit enged meg, és utólag egyetlen átírási módszer sem rendezi el a pontszámot. A benyújtás előtt érdemes feltenni azt a kérdést, hogy képes lenne-e mondatról mondatra megmagyarázni, miért azt mondja az Ön előtt álló munka, amit mond.

XLinkedInFacebook

Gyakran ismételt kérdések

Igen. A hasonlósági motorja összeveti a benyújtott szöveget a webes tartalommal, a publikációkkal és a korábban beadott dolgozatokkal, ezért az átfogalmazott részek, amelyek továbbra is átfednek egy forrással, megőrzik az egyezést a jellegzetes kifejezésekben, az idézetekben és a mondatszerkezetben. Emellett az AI írásjelentése címkézett kategóriát tartalmaz az AI által generált szöveghez, amelyet egy AI parafrázis eszközzel vagy szóforgatóval dolgoztak át, és a Turnitin saját dokumentációja megerősíti, hogy ezt a rendszer kifejezetten jelölésre épült.

Moe

PhD in natural language processing, with years spent building NLP applications end to end. Moe works on text analysis: lexical and syntactic structure, and what separates machine-generated prose from human prose statistically. He has been experimenting with computational linguistics since the early days of NLTK, spaCy and WordNet, and still writes most of his tooling in Python.

Maradjon naprakész az AI humanizálásról

Kapjon tippeket az akadémiai íráshoz, az AI-észleléshez és a humanizáláshoz közvetlenül az e-mail fiókjába.

Nincs spam. Bármikor leiratkozhat.