AI Detection

Apakah Skor Turnitin yang Baik?

Turnitin tidak menerbitkan peratusan kesamaan yang boleh diterima, dan institusi menetapkan panduan mereka sendiri. Catatan ini menerangkan apa yang sebenarnya mendorong skor tinggi atau rendah, mengapa bahan yang dipetik dan senarai rujukan menaikkannya tanpa ada apa-apa yang salah, dan cara membaca pecahan padanan di sebalik nombor itu, bukan nombor itu sendiri.

6 min
What is a good Turnitin score? A similarity report broken into matched sources rather than one number.

Seorang pelajar diberitahu oleh penyelia bahawa apa-apa di bawah lima belas peratus adalah memadai. Seorang lagi pelajar, juga dalam jabatan yang sama, mempunyai kertasnya ditandakan di koridor pada dua belas peratus apabila tiga daripada mata itu berada dalam satu perenggan berterusan tanpa tanda petik berhampirannya. Kedua-duanya membaca skor kesamaan Turnitin dengan betul. Alat ini memang tidak pernah dibina untuk memberikan satu nombor lulus atau gagal sejak awal lagi.

Jadi, apakah skor Turnitin yang baik? Tiada nombor sedemikian. Turnitin tidak menerbitkan peratusan yang boleh diterima, tidak menilai penyerahan, dan menyatakan dengan jelas bahawa angka itu bukan ukuran plagiarisme secara sendirian. Setiap institusi menetapkan panduannya sendiri, dan selalunya setiap penyelia di dalamnya juga berbuat demikian, sebab itulah laporan yang sama boleh kelihatan biasa sahaja di satu pejabat dan membimbangkan di pejabat yang seterusnya. Nombor yang wajar dipelajari ialah cara membaca apa yang berada di sebaliknya.

Apakah Skor Turnitin yang Baik?

Turnitin tidak pernah menerbitkan nombor yang dikira sebagai baik, selamat atau boleh diterima, dan atas sebab yang khusus: skor kesamaan mengukur berapa banyak teks dalam sesuatu penyerahan sepadan dengan teks yang sudah berada dalam pangkalan data Turnitin, bukan sama ada pertindihan itu digunakan secara tidak wajar. Skor yang tinggi boleh datang sepenuhnya daripada bahan yang dipetik dan disitasi dengan betul. Skor yang rendah boleh berada di atas kertas yang memparafrasa satu sumber dengan cukup rapat sehingga menimbulkan kebimbangan kepada pemeriksa, tanpa mencetuskan enjin padanan langsung. Membaca nombor itu sebagai gred membalikkan fungsi alat ini.

Angka seperti sepuluh hingga dua puluh peratus beredar secara meluas sebagai aturan praktis tidak rasmi, diulang dalam forum dan panduan belajar sehingga mula kedengaran rasmi. Ia bukan rasmi. Turnitin tidak menetapkan angka sedemikian, dan aturan praktis yang mengabaikan panjang dokumen, ketumpatan sitasi dan konvensyen bidang akan gagal sebaik sahaja ia berdepan dengan kertas sebenar. Ulasan literatur yang dibina daripada tiga puluh sumber yang dipetik dengan betul boleh melepasi dua puluh peratus hanya pada petikan. Satu perenggan yang diparafrasa dengan rapat tanpa tanda petik boleh berada di bawah lima peratus dan tetap menjadi masalah yang lebih serius.

Apakah yang Sebenarnya Diukur oleh Skor Kesamaan

Turnitin menerangkan alatnya sendiri dalam istilah yang hampir sama. Panduan daripada Boise State University, yang bersandar pada bahasa Turnitin sendiri, menjelaskan bahawa skor persamaan ialah peratusan kandungan sesebuah kertas yang sepadan dengan bahan yang sudah ada dalam pangkalan data Turnitin, dan bahawa peratusan itu sendiri bukanlah penilaian sama ada kertas tersebut mengandungi bahan yang diplagiat. Perbezaan ini benar-benar penting, padanan ialah proses mekanikal, rentetan kata yang sejajar dengan rentetan kata di tempat lain, dan menilai sama ada pertindihan itu telah diberi pengiktirafan dengan betul memerlukan manusia, bukan algoritma.

Pangkalan data di sebalik padanan itu sengaja dibuat luas, penyerahan pelajar semasa dan arkib, web terbuka, dan sejumlah besar penerbitan akademik. Tiada satu pun kandungan itu dibaca untuk makna. Sistem ini mencari rentetan kata yang bertindih dan melaporkan sejauh mana ia meliputi sesuatu penyerahan, sebab itulah ayat yang dipetik dan ayat yang disalin secara senyap boleh menghasilkan padanan yang sama. Hanya paparan terperinci laporan menunjukkan yang mana satu yang mana.

Mengapa Skor Tinggi Boleh Sepenuhnya Sah

Dua ciri biasa penulisan akademik menjelaskan kebanyakannya. Petikan yang dipetik sepadan secara sengaja, kerana kata-kata itu disalin dengan tujuan dan ditandakan sebagai milik orang lain pada halaman. Senarai rujukan pula sepadan dengan sama andalnya, kerana nama pengarang, tajuk jurnal dan format sitasi berulang merentasi ribuan kertas lain yang memetik sumber yang sama. Kedua-duanya ialah rupa yang sepatutnya ada pada penulisan akademik yang betul.

Apabila diletakkan bersebelahan, skor yang melambung dan masalah yang sebenar kelihatan berbeza pada pandangan pertama.

Apa yang sepadanMengapa ia berlakuAdakah ia wajar diperiksa dengan lebih dekat?
Petikan dengan tanda petik dan sitasiKata-kata itu disalin dengan sengaja dan diberi kredit pada halamanTidak, inilah rupa petikan yang betul
Senarai rujukan atau bibliografiNama pengarang, tajuk jurnal dan format sitasi berulang merentasi banyak kertas lainTidak, melainkan tetapan pengecualian tidak digunakan
Kaedah standard atau frasa proseduralPerbendaharaan kata yang dikongsi dalam sesuatu bidang menerangkan proses yang sama dengan cara yang sama merentasi kertasJarang, melainkan keseluruhan bahagian diambil dan bukannya ditulis semula dengan baharu
Satu perenggan panjang yang tidak terputus tanpa tanda petik, sepadan dengan satu sumberPilihan kata itu menjejaki ayat pengarang lain dengan cukup rapat untuk dikesan oleh enjin padananYa, inilah corak yang wajar dibuka sumbernya untuk diperiksa

Humanisasikan kertas anda sendiri

Ubah teks anda yang dibantu AI dan jadikannya kedengaran seperti ditulis manusia, tanpa menyentuh perkataan penting atau sitasi.

Mula secara percuma

Mengapa Skor Rendah Masih Boleh Menyembunyikan Masalah

Angka yang rendah menjawab soalan yang lebih sempit daripada yang kelihatan, iaitu sama ada sedikit teks sepadan perkataan demi perkataan dengan pangkalan data Turnitin, tidak lebih daripada itu. Parafrasa yang mengubah cukup banyak perkataan sambil mengekalkan struktur dan hujah pengarang lain boleh mendapat skor hampir sifar dan masih menjadi masalah integriti yang serius, kerana enjin ini berfungsi berdasarkan rentetan kata, bukan idea yang dipinjam. Kandungan terjemahan, atau bahan daripada pangkalan data terindeks Turnitin di luar, berkelakuan dengan cara yang sama, tiada yang boleh dipadankan, tiada yang dibenderakan.

Sumber yang direka mencipta titik buta yang sama dari arah yang berbeza. Rujukan yang tidak wujud tidak boleh sepadan dengan apa-apa, kerana tiada apa-apa di mana-mana untuk dipadankan dengannya, dan skor kesamaan tidak mempunyai cara untuk membenderakan sitasi yang sejak awal lagi tidak pernah benar. Pemeriksa sitasi AI percuma TextPulse wujud tepat untuk jurang itu, ia menyelesaikan setiap entri dalam senarai rujukan terhadap daftar sebenar yang sepatutnya memuatkan sumber-sumber tersebut, sebelum pembaca terpaksa mencari jurang itu dengan cara yang sukar.

Satu lagi perbezaan wajar dibuat sebelum beralih sepenuhnya daripada nombor itu. Sesuatu penyerahan dengan skor kesamaan yang rendah masih boleh membawa penunjuk penulisan AI berasingan Turnitin, satu ukuran berbeza yang dibina untuk mengesan jenis masalah yang berbeza, seperti dihuraikan dalam panduan laman ini tentang sama ada Turnitin benar-benar boleh mengesan ChatGPT. Kedua-dua peratusan itu tidak dikira dengan cara yang sama, dan bahagian ini hanya membincangkan skor kesamaan.

Cara Membaca Laporan, Bukan Nombor

Jangan bertindak balas terhadap jumlah keseluruhan sebelum membuka pecahan padanan. Turnitin akan menyusun sumber orang, yang membentuk skor, mengikut urutan sumbangannya kepada skor itu. Jumlah dua puluh dua peratus yang terdiri daripada sebelas sumber yang masing-masing menyumbang dua peratus tidak sama seperti jumlah yang terdiri daripada satu sumber. Corak pertama cenderung mencerminkan pertindihan merentasi banyak frasa lazim. Corak kedua wajar diteliti secara langsung pada apa yang sebenarnya dikatakan oleh sumber itu.

Turnitin juga mengelaskan peratusan yang sama ke dalam jalur warna, seperti yang diterbitkan semula dalam panduan Loughborough College sendiri untuk pelajar: biru bagi tiada teks sepadan, hijau dari satu perkataan hingga dua puluh empat peratus, kuning pada dua puluh lima hingga empat puluh sembilan, jingga pada lima puluh hingga tujuh puluh empat, merah pada tujuh puluh lima dan ke atas. Panduan rasmi kolej itu jelas tentang apa yang bukan dimaksudkan oleh warna tersebut: semakan kesamaan tidak bermaksud sesuatu penyerahan mengandungi bahan yang diplagiat. Warna hanya menyusun laporan untuk diberi perhatian, bukan sebagai keputusan muktamad.

Sama ada tetapan institusi sendiri mengecualikan petikan dan bibliografi daripada kiraan juga wajar diperiksa, kerana penyerahan yang sama boleh menghasilkan dua nombor berbeza bergantung pada cara suis itu ditetapkan. Tiada satu pun daripada ini rumit apabila sudah kelihatan. Ia hanya tidak kelihatan jika tiada siapa membuka laporan melepasi halaman pertamanya.

Apa yang Perlu Dilakukan Jika Skor Anda Mengejutkan Anda

Buka semula setiap sumber yang dibenderakan secara individu, bukannya bertindak balas terhadap jumlah gabungan. Sahkan sama ada versi yang dinilai telah mengecualikan petikan dan bibliografi, kerana nombor yang dilihat oleh pelajar semasa draf tidak selalu dikonfigurasikan dengan cara yang sama seperti nombor yang dilihat oleh pensyarah semasa penyerahan. Apabila padanan sebenar tanpa atribusi muncul, betulkan sitasi secara langsung, bukannya menulis semula ayat untuk melepasi enjin padanan, yang hanya merawat gejala dan membiarkan masalah kekal.

Jika nombor itu masih terasa tidak selaras dengan apa yang dijangka oleh penyelia, tanya secara langsung apakah konvensyen jabatan itu sendiri. Bahagian di atas sudah menunjukkan bahawa tiada satu garis tunggal untuk dicapai, jadi jawapannya terletak pada seseorang yang mempunyai kuasa tempatan ke atas tugasan itu, bukan pada peratusan yang boleh disemak oleh sesiapa lebih awal. koleksi alat percuma TextPulse merangkumi semakan sitasi dan draf yang wajar dijalankan sebelum sesuatu laporan sampai ke peti masuk orang lain.

Skor daripada alat yang berbeza tidak boleh saling ditukar ganti, dan cara GPTZero berfungsi dihuraikan pada halamannya sendiri, bersama-sama dengan statistik perplexity yang terletak di bawah kedua-duanya.

Skor itu berkelakuan seperti itu kerana cara padanan dijalankan di bawahnya, dan nombor yang lebih baharu yang kini terletak di sebelahnya pada laporan yang sama berfungsi pada mekanisme yang berbeza, iaitu yang dihuraikan sepenuhnya oleh panduan laman ini tentang cara pengesan AI sebenarnya berfungsi. Membaca mana-mana nombor itu sebagai keputusan muktamad mengabaikan satu-satunya bahagian laporan yang wajar dibaca.

XLinkedInFacebook

Soalan Lazim

Apakah skor Turnitin yang baik? Tiada nombor sedemikian. Turnitin tidak menerbitkan peratusan yang boleh diterima, dan skor kesamaan mengukur berapa banyak teks yang sepadan dengan pangkalan datanya, bukan berapa banyak yang diplagiat. Tinjauan literatur yang dipetik dengan betul boleh melepasi dua puluh peratus hanya daripada petikan, manakala satu parafrasa tanpa atribusi boleh berada di bawah lima. Baca sumber yang dipadankan, bukan angka utama.

Moe

PhD in natural language processing, with years spent building NLP applications end to end. Moe works on text analysis: lexical and syntactic structure, and what separates machine-generated prose from human prose statistically. He has been experimenting with computational linguistics since the early days of NLTK, spaCy and WordNet, and still writes most of his tooling in Python.

Kekal dikemas kini tentang pemanusiaan AI

Dapatkan petua tentang penulisan akademik, pengesanan AI, dan pemanusiaan dihantar ke peti masuk anda.

Tiada spam. Boleh berhenti melanggan pada bila-bila masa.