AI Detection

Bolehkah Turnitin Mengesan Teks yang Diparafrasa?

Ya, Turnitin mengesan teks yang diparafrasa, dan ia dibina untuk itu. Enjin kesamaannya mengesan petikan yang diolah semula yang masih bertindih dengan karya diterbitkan dan yang telah dihantar sebelum ini, dan laporan penulisan AI-nya mempunyai kategori berlabel untuk teks yang dijana AI yang disemak dengan alat parafrasa atau penukar kata. Berikut ialah cara setiap sistem mengesannya, dan mengapa menukar kata dengan sinonim tidak membersihkan mana-mana satu pun.

9 min
Diagram answering can Turnitin detect paraphrased text, comparing similarity matching against the AI writing indicator

Ya. Turnitin mengesan teks parafrasa, dan memang itulah tujuan pembinaannya. Dua sistem dalam laporan yang sama mengesannya. Similarity Report menandakan petikan yang masih bertindih dengan karya yang diterbitkan atau kertas yang telah dihantar sebelum ini selepas perkataan diubah, dan itulah tugas yang telah dilakukannya sejak jauh sebelum penulisan AI wujud. AI Writing Report mempunyai kategori berlabelnya sendiri untuk teks yang dijana AI yang telah melalui alat parafrasa atau penukar perkataan. Menukar perkataan kepada sinonim tidak membersihkan mana-mana satu pun.

Sistem yang menangkap sesuatu petikan bergantung pada asal teks itu. Bahan yang diparafrasa dan diambil daripada sumber ialah masalah similarity. Bahan yang diparafrasa dan dijana oleh ChatGPT ialah masalah penulisan AI. Banyak penyerahan adalah kedua-duanya sekali, dan kedua-dua sistem membaca setiap penyerahan juga.

Turnitin Menamakan Teks AI yang Diparafrasa sebagai Kategorinya Sendiri

Ini bukan inferens daripada cara pengesan berfungsi secara umum. AI Writing Report Turnitin membahagikan peratusannya kepada dua kategori berlabel, dan yang kedua ialah teks AI yang diparafrasa.

Turnitin AI Writing Overview page listing two categories: AI-generated only, described as likely AI-generated text from a large-language model, and AI-generated text that was AI-paraphrased, described as likely AI-generated text that was likely revised using an AI-paraphrase tool or word spinner
Turnitin AI Writing Overview, dengan kategori parafrasa dicetak dalam produknya sendiri. Peratusan utama menggabungkan kedua-dua baris, dan yang kedua merangkumi teks yang disemak dengan parafrasa AI atau penukar perkataan.

Laporan itu mentakrifkan nombor utamanya sebagai "jumlah gabungan teks yang berkemungkinan dijana AI serta teks yang berkemungkinan dijana AI yang juga berkemungkinan diparafrasa AI". Item baris kedua dilabel "teks yang dijana AI yang diparafrasa AI" dan dihuraikan sebagai "teks yang berkemungkinan dijana AI yang berkemungkinan disemak menggunakan alat parafrasa AI atau penukar perkataan".

Dokumentasi sokongan Turnitin menjawab soalan itu dengan jelas. Apabila ditanya secara langsung sama ada ia boleh mengesan kandungan yang diparafrasa dengan alat parafrasa AI, panduannya menyatakan: "Yes, Turnitin's AI indicator includes detection of AI-generated content that may have been paraphrased using a word spinner/AI paraphrasing tool." Jawapan yang hampir sama merangkumi teks yang diproses melalui alat bypasser yang dibina khusus untuk menulis semula output AI supaya melepasi pengesan. Kedua-duanya tidak menghasilkan skor berasingan. Kedua-duanya menyumbang kepada peratusan tunggal yang sama yang dilihat oleh pengajar.

Apa yang Dikesan oleh Setiap Sistem

Laporan KeserupaanLaporan Penulisan AI
Apa yang diperiksaSama ada teks bertindih dengan sumber yang sudah ada dalam pangkalan data Turnitin bagi kandungan web, penerbitan dan kertas pelajarSama ada prosa itu kelihatan secara statistik seperti penulisan yang dijana mesin
Mengesan parafrasa bagiKarya orang lain yang diterbitkan atau dihantarDraf yang dijana AI, termasuk yang disemak semula oleh alat parafrasa atau bypasser
Kesan penggunaan sinonimMenurunkan peratusan, tetapi mengekalkan istilah khas, petikan dan struktur ayat yang sepadanMengekalkan skor hampir sama seperti asal, kerana pengelas membaca pola ayat dan bukannya pilihan kata
Tempat ia dipaparkanPeratusan serta kumpulan padanan yang menamakan setiap sumberSatu peratusan, dipecahkan kepada AI-generated only dan AI-paraphrased

Kedua-dua laporan ialah produk yang berasingan dengan nombor yang berasingan, dan sesuatu kertas boleh bersih pada satu laporan tetapi ditandakan pada laporan yang lain. TextPulse membincangkan pembahagian itu secara penuh dalam perbandingan skor keserupaan Turnitin dengan skor AI-nya, dan mekanisme pengelas itu sendiri dalam cara Turnitin mengesan penulisan AI.

Humanisasikan kertas anda sendiri

Ubah teks anda yang dibantu AI dan jadikannya kedengaran seperti ditulis manusia, tanpa menyentuh perkataan penting atau sitasi.

Mula secara percuma

Sisi Keserupaan: Teks yang Diolah Semula Masih Bertindih

Pemeriksaan keserupaan ialah satu latihan pemadanan. Turnitin membandingkan sesuatu penyerahan dengan repositori kandungan web, penerbitan dan kertas yang telah diserahkan sebelum ini, lalu melaporkan sejauh mana kandungan itu bertindih dengan sesuatu yang sudah diindeks. Tukar cukup banyak perkataan, dan rentetan tepat yang dibandingkan menjadi lebih kecil, maka peratusannya menurun. Itu benar, dan itulah sebab alat parafrasa wujud.

Yang kekal selepas pertukaran ialah bahagian yang sering dipandang rendah oleh pelajar. Istilah teknikal, kata nama khas, angka yang dipetik dan petikan langsung kekal tidak berubah kerana tiada sinonim bagi semuanya. Begitu juga dengan struktur ayat, apabila hanya kata penghubung yang diganti. Turnitin melaporkan pertindihan sebagai kumpulan padanan, setiap satu menamakan sumbernya, dan itulah yang membezakan petikan yang dipetik dengan betul daripada petikan yang telah diungkap semula.

Turnitin similarity report showing 12% overall similarity broken into match groups: 115 matches not cited or quoted at 9%, and 41 matches with missing quotations at 3%, with top sources listed across internet, publications and student papers
Laporan keserupaan memecahkan peratusannya kepada kumpulan padanan. 115 padanan yang "not cited or quoted" ialah yang dibaca sebagai bahan yang diungkap semula atau dipinjam, bukannya petikan yang diatributkan.

Mengungkap semula sesuatu sumber sambil mengekalkan susunan ayat dan butiran sokongannya dipanggil patchwriting, dan ia dianggap sebagai satu bentuk plagiarisme dalam kebanyakan dasar universiti sama ada peratusan keserupaan menurun atau tidak. Penanda yang dilatih untuk mengenal pastinya sering mengesannya secara visual, kerana hujah yang mengikuti perenggan sumber ayat demi ayat dibaca seperti sumber itu juga, tanpa mengira kosa kata. Nombor yang rendah tidak sama dengan kerja yang bersih, dan itulah tujuan panduan TextPulse tentang apa yang dikira sebagai skor Turnitin yang baik.

Bahagian AI, satu laluan sinonim tidak mengubah skor

Penunjuk penulisan AI tidak pernah membandingkan perenggan anda dengan sumber, jadi tiada padanan untuk sinonim dipecahkan. Ia menilai prosa ayat demi ayat berdasarkan sejauh mana ia sepadan dengan pola statistik penulisan yang dijana mesin, kebolehramalan kata, irama ayat, dan frasa generik yang secara lalai digunakan oleh model bahasa.

Menggantikan kata-kata meninggalkan hampir semua itu tetap pada tempatnya. Ayat mengekalkan panjangnya, susunannya, dan tisu penghubung yang sama antara klausa. Inilah sebabnya menjalankan draf AI melalui alat parafrasa dan melihat skor AI kekal tidak berubah ialah pengalaman yang begitu lazim. Perbendaharaan kata berubah. Corak yang dinilai oleh pengelas tidak berubah, jadi teks itu masih dibaca sebagai ditulis mesin, tepat seperti yang dinyatakan oleh kategori parafrasa Turnitin.

Taburan Panjang Ayat Kekal Selepas Penulisan Semula

Prosa yang drafnya dijana mesin cenderung berada dalam julat panjang ayat yang sempit, kerana model yang meramalkan satu token pada satu masa tidak mempunyai sebab untuk menjadikan ayat empat lebih pendek daripada ayat tiga. Penulisan manusia pula lebih berselerak, satu ayat sembilan belas perkataan, kemudian satu ayat enam perkataan, kemudian satu ayat tiga puluh dua perkataan yang membawa satu dakwaan dan batasannya bersama-sama. Penjelasan GPTZero sendiri menamakan ini secara langsung, dengan mentakrifkan burstiness sebagai ukuran sejauh mana pola penulisan dan perplexities teks berbeza merentasi sesuatu dokumen.

Penukaran sinonim mengubah panjang sesuatu ayat sebanyak satu atau dua perkataan, dan ia mengubah setiap ayat dengan jumlah kecil yang serupa, jadi taburan itu mengekalkan bentuknya. Satu perenggan yang sebelum semakan berjalan pada lapan belas, sembilan belas, tujuh belas dan dua puluh perkataan akan kekal dalam lingkungan satu atau dua perkataan daripada profil mendatar yang sama selepas itu.

Ini boleh diukur tanpa perlu menghampiri pengesan. free burstiness checker melaporkan sejauh mana variasi pada tahap ayat yang dibawa oleh sesuatu petikan, dan menjalankan perenggan yang sama melaluinya sebelum dan selepas proses parafrasa menunjukkan nombor itu hampir tidak berubah sementara perbendaharaan kata berubah sepenuhnya.

Susunan Klausa dan Peralihan Juga Kekal

Susunan klausa ialah ciri struktur kedua yang dibiarkan tidak berubah oleh parafrasa, dan ia lebih jelas kepada pembaca berbanding panjang ayat. Prosa mesin cenderung meletakkan topik di hadapan, menyatakan dakwaan, kemudian menambah klausa pengkualifikasi di hujung, berulang kali. "While the sample size was limited, the results suggest" dan "Although further research is needed, the findings indicate" ialah ayat yang sama dengan kata-kata yang berbeza.

Alat parafrasa akan menukar "while" kepada "although" dan "suggest" kepada "show". Ia tidak akan memutuskan bahawa pengkualifikasian itu patut berada dalam ayat pendeknya sendiri tiga baris kemudian, atau bahawa pengekangan itu harus dibuang sepenuhnya. Itu ialah pertimbangan editorial tentang apa yang dihujahkan oleh perenggan itu, dan enjin penggantian tidak mempunyai pandangan tentang hujah tersebut.

Peralihan ialah yang ketiga dan yang paling jelas. Model cenderung menggunakan set penghubung yang kecil dan stabil pada titik sambungan: however, additionally, furthermore, in addition. Parafrasa menukar salah satu daripadanya dengan ahli lain daripada set yang sama, jadi pengelas masih melihat peralihan lazim daripada taburan yang dijangka pada kedudukan yang dijangka. Itulah isyarat yang dibacanya sebelum penulisan semula bermula.

Ciri yang dibaca oleh pengelasDiubah oleh laluan parafrasaSebab
Pilihan kata individuYa, dengan ketaraSatu-satunya ciri yang dibina oleh enjin penggantian untuk diubah
Panjang ayat dan variansnyaHampir tidakKata yang diganti hampir sama panjang, jadi profilnya kekal
Susunan klausa dalam ayatJarangPenyusunan semula mengubah penekanan, yang dihalang oleh kekangan makna
Penghubung pada titik sambunganDitukar dalam set kecil yang samaSatu peralihan lazim menggantikan peralihan lazim yang lain
Kebolehramalan kata seterusnyaSedikitSinonim yang lebih jarang kurang dijangka, tetapi rangka di sekelilingnya kekal sama boleh dijangka seperti sebelumnya
Bukti dan perincian khususTidakPenulisan semula tidak boleh menambah bahan yang tidak pernah ada dalam draf

Apa yang Sebenarnya Mengubah Keputusan

Kedua-dua sistem bertindak balas terhadap simptom yang berbeza bagi penulisan semula yang sama dangkal, jadi pembetulannya juga sama bagi kedua-duanya, ubah penulisan, bukan perkataan. Ini bermaksud menyusun semula ayat, bukannya menyusun semula kandungannya, mempelbagaikan panjang ayat secara sengaja, memotong kata penghubung umum yang menjadi lalai bagi model, dan menambah butiran sokongan yang cukup khusus sehingga ia hanya boleh datang daripada bahan sumber yang benar-benar anda baca. Keserupaan menurun kerana strukturnya tidak lagi menjejaki sumber. Skor AI menurun kerana corak yang dinilai oleh pengelas itu telah hilang.

Alat parafrasa tidak dapat melakukan kerja itu, dan perbezaan antara dua kategori alat ini wajar difahami sebelum membayar untuk mana-mana satu, yang dihuraikan oleh TextPulse dalam AI humanizer versus paraphraser. Menyemak kebolehramalan peringkat perkataan bagi draf itu sendiri dengan free perplexity checker menunjukkan corak yang ditindak balas oleh pengelas dengan lebih berguna daripada skor semata-mata.

AI humanizer for students TextPulse berfungsi pada sisi struktur masalah, membina semula irama ayat, variasi panjang dan susunan klausa, bukannya menukar perkataan individu, yang merupakan jurang yang ditinggalkan terbuka luas oleh semakan yang hanya berasaskan sinonim. Untuk kerja kursus secara khusus, humanizing an AI essay for college menghuraikan aliran kerja dari awal hingga akhir, dan whether Turnitin detects DeepSeek menjawab soalan yang sama untuk model yang berbeza.

Tiada satu pun daripada ini mengubah apa yang dibenarkan oleh dasar penggunaan AI sesuatu kursus, dan tiada pendekatan penulisan semula yang menyelesaikan skor selepas fakta. Ujian yang wajar digunakan sebelum menghantar apa-apa ialah sama ada anda boleh menjelaskan, ayat demi ayat, mengapa karya di hadapan anda menyatakan apa yang dinyatakannya.

XLinkedInFacebook

Soalan Lazim

Ya. Enjin kesamaannya membandingkan penyerahan dengan kandungan web, penerbitan dan kertas yang telah dihantar sebelum ini, jadi petikan yang diolah semula yang masih bertindih dengan sumber terus sepadan pada istilah tersendiri, petikan dan struktur ayat. Secara berasingan, laporan penulisan AI-nya mempunyai kategori berlabel untuk teks yang dijana AI yang telah disemak dengan alat parafrasa AI atau penukar kata, yang didokumenkan sendiri oleh Turnitin sebagai sesuatu yang dibina untuk dikesan.

Moe

PhD in natural language processing, with years spent building NLP applications end to end. Moe works on text analysis: lexical and syntactic structure, and what separates machine-generated prose from human prose statistically. He has been experimenting with computational linguistics since the early days of NLTK, spaCy and WordNet, and still writes most of his tooling in Python.

Kekal dikemas kini tentang pemanusiaan AI

Dapatkan petua tentang penulisan akademik, pengesanan AI, dan pemanusiaan dihantar ke peti masuk anda.

Tiada spam. Boleh berhenti melanggan pada bila-bila masa.