AI Detection

Skor Kesamaan Turnitin vs Skor AI: Dua Laporan Berbeza

Skor kesamaan dan skor AI menjawab soalan yang berbeza, jadi sesuatu kertas boleh mendapat skor rendah pada satu dan tinggi pada yang lain tanpa mana-mana nombor itu salah. Apa yang diukur oleh setiap satu, apa yang mencetuskannya, dan apa yang dibuktikan serta tidak dibuktikan oleh nombor tinggi.

Dikemas kini pada 5 min
Turnitin similarity vs AI score comparison chart showing two independent report numbers

Satu laporan muncul dengan dua nombor padanya: skor kesamaan sebanyak 3 peratus dan skor AI sebanyak 88 peratus. Bacaan yang wajar ialah kedua-duanya mesti mengukur perkara yang sama, jadi nombor yang rendah sepatutnya bermakna nombor yang tinggi itu mungkin salah juga. Ia tidak berfungsi begitu. Kesamaan Turnitin berbanding skor AI ialah perbandingan antara dua sistem berasingan yang memeriksa dua perkara berasingan, dan sesuatu penyerahan boleh mendapat skor rendah pada satu sistem dan tinggi pada yang lain tanpa mana-mana nombor itu menjadi kesilapan.

Ia lebih lama daripada yang AI, dibina untuk mengesan teks yang sepadan dengan sesuatu yang sudah wujud. Ia lebih baharu, ditambah ke dalam Similarity Report yang sama sebagai ukuran bebasnya sendiri, dibina untuk menganggar sama ada prosa dibaca seperti dijana mesin tanpa mengira sama ada ia sepadan dengan apa-apa pun. Kedua-duanya benar-benar bebas dan tidak saling mempengaruhi, menurut dokumentasi Turnitin sendiri. Semua yang lain dalam bahagian ini.

Turnitin similarity report showing 12% overall similarity, with match groups of 115 not cited or quoted at 9% and 41 missing quotations at 3%, top sources across internet, publications and student papers, and zero integrity flags
Laporan kesamaan menjawab satu soalan: berapa banyak teks ini sepadan dengan sesuatu yang sudah ada dalam pangkalan data Turnitin. Di sini nilainya ialah 12%, dipecahkan kepada kumpulan padanan dan sumber, tanpa sebarang bendera integriti dinaikkan.
Gambaran keseluruhan penulisan AI Turnitin yang menunjukkan 71% dikesan sebagai AI, terdiri daripada 18 segmen ditandakan sebagai AI-generated only pada 71% dan sifar segmen ditandakan sebagai AI-paraphrased, di samping amaran bahawa penyemak harus memahami batasan pengesanan AI
Laporan penulisan AI ialah dokumen berasingan dengan nombornya sendiri. Kertas yang sama dibaca sebagai 71% dikesan sebagai AI, dibahagikan antara teks AI-generated only dan AI-paraphrased, dengan amaran Turnitin sendiri tentang batasan pengesanan dicetak di sebelahnya.

Similarity Turnitin vs Skor AI: Apa yang Dilaporkan oleh Setiap Nombor

Turnitin menganggap kedua-duanya sebagai ukuran yang berbeza yang digabungkan dalam satu produk, bukannya dua pandangan terhadap satu hasil. Laporan Similarity membandingkan penyerahan dengan pangkalan data kandungan web, penerbitan akademik, dan kertas pelajar yang telah diserahkan sebelum ini, lalu mengembalikan peratusan teks penyerahan yang sepadan dengan sesuatu yang sudah ada dalam pangkalan data itu. Pengesanan penulisan AI menjalankan model yang sama sekali berbeza, ditambahkan ke dalam laporan yang sama sebagai skor bebasnya sendiri, model yang dilatih untuk menilai sejauh mana prosa sesuatu petikan menyerupai penulisan yang dijana mesin, tanpa merujuk kepada mana-mana pangkalan data luaran sama sekali. Mekanisme yang lebih lengkap tentang bagaimana pengelas AI Turnitin mencapai nombor itu dihuraikan secara berasingan, yang penting di sini ialah ia menjawab soalan yang berbeza daripada enjin similarity yang berada dalam laporan yang sama.

Apa yang Sebenarnya Diukur oleh Skor Similarity

Similarity ialah latihan padanan, bukan penilaian. Panduan Turnitin sendiri menyatakan dengan jelas bahawa alat ini tidak memeriksa plagiarisme. Alat ini memeriksa pertindihan dan menyerahkan tafsiran kepada pengajar yang membaca laporan itu. Petikan yang ditandakan dengan betul, frasa bahagian kaedah yang dikongsi merentasi seluruh subbidang, senarai rujukan yang diformatkan seperti cara setiap kertas dalam jurnal memformat senarai rujukannya, semuanya boleh direkodkan sebagai padanan, kerana sistem ini mengira rentetan teks yang bertindih dan bukannya menilai sama ada pertindihan itu sah.

Itulah juga sebabnya skor kesamaan sifar membuktikan kurang daripada yang kelihatan. Ini bermaksud penyerahan itu tidak mengandungi sebarang rentetan teks yang panjang dan tidak terputus yang ditemui di tempat lain dalam sumber terindeks Turnitin. Ia tidak mengatakan apa-apa tentang bagaimana ayat-ayat yang ada itu dihasilkan, kerana menghasilkan ayat yang sepadan dengan tiada apa-apa dalam pangkalan data bukanlah kemahiran yang sama seperti menghasilkan ayat yang tidak akan diramalkan oleh model bahasa.

Humanisasikan kertas anda sendiri

Ubah teks anda yang dibantu AI dan jadikannya kedengaran seperti ditulis manusia, tanpa menyentuh perkataan penting atau sitasi.

Mula secara percuma

Apa yang Sebenarnya Diukur oleh Skor AI

Skor AI tidak mempunyai pangkalan data untuk dibandingkan. Sebuah pengelas membaca prosa yang diserahkan dan menganggarkan, daripada corak yang dipelajarinya merentas contoh penulisan manusia dan penulisan yang dijana AI, sejauh mana kemungkinan prosa itu datang daripada model dan bukannya daripada seseorang. Tiada apa-apa dalam anggaran itu bergantung pada sama ada ayat yang tepat itu pernah muncul di mana-mana sebelum ini. Sebuah ayat boleh menjadi sepenuhnya unik, tidak pernah ditaip oleh sesiapa pun sehingga penyerahan ini, dan masih dibaca sebagai tipikal secara statistik bagi output AI jika pilihan kata dan ritmanya mengikut corak yang cenderung dihasilkan oleh model bahasa.

Ini ialah wilayah statistik yang sama yang dihuraikan sepenuhnya dalam penjelasan yang lebih luas tentang cara pengesan AI sebenarnya berfungsi: kebolehramalan pada tahap kata dan ritma pada tahap ayat, digabungkan menjadi satu skor dokumen. Versi pengelas Turnitin itu adalah proprietari, tetapi premis asasnya, bahawa teks yang dijana cenderung lebih tipikal secara statistik daripada penulisan manusia, ialah premis yang sama yang mendasari setiap alat dalam kategori ini.

Skor KeserupaanSkor AI
Apa yang diukurSejauh mana teks penyerahan sepadan dengan dokumen terindeks lainSejauh mana prosa menyerupai penulisan yang dijana AI yang lazim secara statistik
Apa yang mencetuskan nombor tinggiSitasi panjang, frasa lazim khusus bidang, bahan yang digunakan semula, atau padanan terhadap penyerahan terdahuluIrama ayat yang seragam dan pilihan kata yang sentiasa dapat diramalkan merentasi dokumen
Apa yang tidak dibuktikan oleh nombor tinggiBahawa teks yang sepadan itu digunakan secara tidak wajar. Bahan yang dipetik dengan betul masih boleh direkodkan sebagai padanan.Bahawa mana-mana ayat tunggal dijana oleh AI. Pengelas membaca pola keseluruhan dokumen, bukan satu baris secara terasing.

Adakah Sesuatu Kertas Boleh Mempunyai 0 Peratus Keserupaan dan Skor AI 90 Peratus?

Ya, dan gabungan ini bukan gangguan. Kedua-dua skor menjawab soalan yang berbeza, jadi semua empat gabungan tinggi dan rendah adalah mungkin, dan setiap satu menunjukkan sesuatu yang berbeza tentang cara teks itu dihasilkan.

  • Keserupaan rendah, skor AI rendah: penulisan asli biasa yang juga dibaca dengan variasi manusia yang lazim. Kes biasa bagi kebanyakan kerja pelajar yang tulen.
  • Keserupaan rendah, skor AI tinggi: ayat asli, bukan disalin dari mana-mana, yang dibaca sebagai dapat diramalkan secara statistik seperti kecenderungan teks yang dijana. Tanda penulisan AI yang tidak disunting yang tidak diparafrasa daripada sumber sedia ada.
  • Keserupaan tinggi, skor AI rendah: teks yang sepadan rapat dengan sumber sedia ada yang ditulis oleh manusia, tanpa kerataan statistik yang dikaitkan oleh pengelas dengan penjanaan. Teks yang disalin, dikesan oleh alat yang lebih lama dan bukannya yang lebih baharu.
  • Keserupaan tinggi, skor AI tinggi: teks yang sepadan dengan sumber sedia ada yang juga dijana AI, misalnya kertas yang ditulis AI yang telah diserahkan sebelum ini atau halaman teks yang dihasilkan AI yang sudah diindeks daripada web terbuka.

Tiada satu pun gabungan ini memerlukan apa-apa yang luar biasa pada bahagian perisian. Ia terhasil daripada hakikat bahawa satu sistem memeriksa padanan dan satu lagi memeriksa pola, dan sesuatu teks boleh membawa salah satu sifat itu, kedua-duanya, atau tiada satu pun.

Apa yang Dibuktikan, dan Tidak Dibuktikan, oleh Skor AI yang Tinggi

Skor AI yang tinggi ialah anggaran statistik, bukan pengakuan yang diekstrak daripada teks. Ia menyatakan bahawa prosa di hadapan pengelas menyerupai, dari segi pilihan kata dan ritma, jenis penulisan yang model itu dilatih untuk kaitkan dengan penjanaan AI. Ia tidak mengenal pasti ayat tertentu sebagai pasti ditulis oleh mesin, dan ia tidak mengetahui apa-apa tentang bagaimana dokumen itu sebenarnya dihasilkan, hanya bagaimana ia dibaca setelah selesai. TextPulse mengambil pendirian yang sama tentang nombornya sendiri: apa yang dilaporkannya ialah Human Score yang dianggarkan dan dikira daripada teks di hadapannya, bukan keputusan tentang alat mana, jika ada, yang menyentuh dokumen itu.

Tindak balas praktikal terhadap mana-mana nombor itu, skor keserupaan yang rendah atau skor AI yang tinggi, adalah sama: anggap ia sebagai sebab untuk meneliti dengan lebih dekat, bukan sebagai dapatan untuk diterima atau diketepikan secara sepintas lalu. Draf, nota, dan sejarah versi menunjukkan bagaimana sesuatu dokumen sebenarnya ditulis dengan cara yang tidak pernah dapat dilakukan oleh peratusan, pada mana-mana laporan. Sesiapa yang ingin tahu apa sebenarnya yang sedang ditindak balas oleh pengelas dalam draf mereka sendiri boleh melihat pola pada tahap perkataan yang sama untuk diri mereka dengan free perplexity checker, jauh sebelum sebarang laporan dijana.

Koleksi free tools collection TextPulse merangkumi lapisan statistik lain yang wajar diperiksa sebelum sesuatu draf dihantar ke mana-mana, bukan hanya dua yang dibandingkan di sini.

Setelah kedua-dua nombor itu dipisahkan, soalan seterusnya ialah apakah yang dikira sebagai skor Turnitin yang baik. Bagi pengesan lain yang paling kerap ditemui oleh pelajar, bagaimana GPTZero berfungsi dihuraikan pada halamannya sendiri.

Dua nombor itu akan terus berada bersebelahan antara satu sama lain dalam laporan yang sama, dan ia akan terus dibaca sebagai satu nombor oleh orang yang tergesa-gesa. Mengetahui soalan yang sebenarnya dijawab oleh setiap satu ialah perkara yang menukar pasangan peratusan yang mengelirukan menjadi dua maklumat yang berasingan dan berguna.

XLinkedInFacebook

Soalan Lazim

Kesamaan Turnitin vs skor AI bergantung pada apa yang diperiksa oleh setiap satu. Skor kesamaan melaporkan berapa banyak sesuatu penyerahan sepadan dengan teks yang sudah ada dalam pangkalan data Turnitin bagi halaman web, penerbitan, dan kertas pelajar terdahulu. Skor AI ialah ukuran berasingan dan bebas yang menganggar sejauh mana prosa itu dibaca sebagai dijana mesin, tanpa merujuk kepada mana-mana pangkalan data langsung. Dokumentasi Turnitin sendiri menyatakan kedua-dua angka itu tidak mempengaruhi satu sama lain.

Moe

PhD in natural language processing, with years spent building NLP applications end to end. Moe works on text analysis: lexical and syntactic structure, and what separates machine-generated prose from human prose statistically. He has been experimenting with computational linguistics since the early days of NLTK, spaCy and WordNet, and still writes most of his tooling in Python.

Kekal dikemas kini tentang pemanusiaan AI

Dapatkan petua tentang penulisan akademik, pengesanan AI, dan pemanusiaan dihantar ke peti masuk anda.

Tiada spam. Boleh berhenti melanggan pada bila-bila masa.