Bolehkah Turnitin Mengesan Teks AI yang Dimanusiakan?
Turnitin menyatakan penunjuk penulisan AI-nya sudah meliputi teks yang melalui humanizer. Apa yang dimaksudkan dan tidak dimaksudkan oleh dakwaan itu, mengapa dokumen yang dimanusiakan kadangkala masih mendapat skor tinggi dan kadangkala tidak, serta nilai nombor itu kepada pelajar dalam kedua-dua keadaan.
Turnitin menjawab soalan ini di laman sokongan mereka sendiri, dan jawapannya lebih khusus daripada mana-mana pihak dalam hujah biasa. Penunjuk penulisan AI mereka, kata Turnitin, sudah merangkumi pengesanan kandungan yang dijana AI yang mungkin telah dihumanisasikan atau melalui bypasser untuk mengelakkan pengesanan. Itu ialah vendor yang menghuraikan produknya sendiri. Ia juga tempat yang tepat untuk bermula, kerana ia memberitahu anda apa yang didakwa diliputi oleh model itu.
Jadi, bolehkah Turnitin mengesan teks yang dihumanisasikan? Soalan itu mempunyai bentuk yang lebih sempit dan lebih berguna. Model Turnitin tidak mencari cap jari humanizer dan tidak menyimpan senarai alat. Ia menilai prosa ayat demi ayat berdasarkan sejauh mana penulisan itu sepadan dengan pola statistik teks yang dijana mesin, kemudian merata-ratakan skor tersebut merentasi dokumen. Sama ada petikan yang dihumanisasikan masih mendapat skor tinggi bergantung pada sejauh mana pola itu diubah oleh penulisan semula, dan pada sejauh mana keseluruhan dokumen itu telah ditulis semula.
Bolehkah Turnitin Mengesan Teks yang Dihumanisasikan? Apa yang Didakwa oleh Turnitin
Pendirian yang diterbitkan mereka ialah ya, secara jelas. Apabila menjawab sama ada ia boleh mengesan kandungan yang telah diproses melalui humanizer, panduan mereka menyatakan: "Ya, penunjuk AI Turnitin merangkumi pengesanan kandungan yang dijana AI yang mungkin telah dihumanisasikan atau melalui bypasser untuk mengelakkan pengesanan." Halaman yang sama memberikan jawapan yang sama untuk alat parafrasa AI.
Dakwaan itu tidak muncul sebagai nombor kedua di suatu tempat dalam laporan. Turnitin memasukkannya ke dalam satu peratusan penulisan AI, dan definisi yang diterbitkan bagi peratusan itu menyatakannya secara langsung: ia merangkumi teks yang ditentukan oleh model sebagai kemungkinan dijana oleh AI, atau kemungkinan dijana dan kemudian diubah suai oleh parafrasa AI atau bypasser. Hanya ada satu skor, dan ia sudah mengambil kira penulisan semula itu setakat yang mampu dilakukan oleh model.
Baca dengan teliti, itu ialah pernyataan tentang liputan dan bukannya pernyataan tentang ketepatan. Turnitin sedang mengatakan bahawa teks yang dihumanisasikan berada dalam skop apabila model itu dibina. Ia jauh daripada mengatakan bahawa setiap dokumen yang dihumanisasikan mendapat skor tinggi, dan angka yang diterbitkannya sendiri, lebih bawah, menerangkan model yang menganggap ayat individu sebagai tidak pasti.
Apa yang Sebenarnya Dinilai oleh Penunjuk Penulisan AI
Ia bukan peratusan. Ia ialah pecahan teks, jadi ia bukan tahap keyakinan. Ia ialah ukuran tentang berapa banyak teks dalam dokumen anda yang menurut model kami berkemungkinan dijana oleh AI. Kami menyebutnya teks berkelayakan, yang bermaksud ayat prosa dalam format penulisan bentuk panjang. Ia tidak merangkumi senarai berbulet atau kod atau jadual atau fragmen pendek. Dan itulah sebabnya anda mungkin melihat nombor yang berbeza bagi kertas yang sama berdasarkan berapa banyak daripadanya ialah prosa berterusan.
Mekanisme di bawahnya cukup mudah untuk dibayangkan. Turnitin membahagikan dokumen kepada segmen bertindih yang terdiri daripada kira-kira beberapa ratus perkataan, sekitar lima hingga sepuluh ayat setiap satu, dengan pertindihan supaya setiap ayat mendapat skor dalam konteks. Setiap ayat menerima nilai antara 0 dan 1. Skor segmen kemudian dipuratakan merentasi dokumen untuk menghasilkan satu nombor yang dilihat oleh pengajar. Huraian langkah demi langkah tentang cara Turnitin mengesan AI menghuraikan setiap peringkat dengan lebih terperinci.
Langkah pemurataan itu lebih penting bagi teks yang dihumanisasikan daripada apa-apa yang lain dalam saluran ini, dan itulah bahagian yang hampir tiada siapa ambil kira. Angka yang dibaca oleh pengajar ialah min aritmetik bagi pertimbangan peringkat segmen. Sebuah dokumen boleh ditulis semula separuh dan berakhir di suatu tempat di tengah atas sebab yang sedikit berkaitan dengan sejauh mana penulisan semula itu baik.
Mengapa Output yang Dihumanisasikan Kadangkala Masih Mendapat Skor Tinggi
Sebab yang paling biasa ialah liputan. Humanizer yang digunakan pada pengenalan dan kesimpulan membiarkan ulasan literatur dan perbincangan tidak disentuh, dan segmen-segmen itu membawa skor asalnya terus ke dalam purata. Pada bab yang panjang, menulis semula halaman pembukaan mengubah beberapa segmen dan membiarkan selebihnya tepat seperti asalnya, yang menghasilkan pergerakan yang lebih kecil daripada yang dijangka oleh penulis daripada kerja yang terasa besar.
Sebab kedua ialah kedalaman penulisan semula. Satu laluan yang menggantikan kosa kata sambil mengekalkan panjang ayat, susunan klausa dan pilihan peralihan di tempatnya membiarkan corak yang telah digunakan untuk melatih pengelas itu sebahagian besarnya kekal utuh. Model itu menilai bentuk prosa, jadi menukar perkataan yang mengisi bentuk itu memberi kesan yang kurang daripada yang disangka oleh kebanyakan orang. free perplexity checker akan menunjukkan sejauh mana sesuatu petikan masih kelihatan boleh diramal selepas penulisan semula, yang merupakan isyarat yang lebih bermaklumat daripada perbandingan pada tahap perkataan antara sebelum dan selepas.
Sebab ketiga ialah penulisan semula boleh memasukkan keteraturan tersendiri. Perisian yang menerapkan transformasi yang sama pada setiap perenggan akan menghasilkan corak baharu yang sama teraturnya dengan corak lama. Jika setiap ayat mempunyai jenis potongan sendi yang sama melaluinya, atau jika setiap ayat mempunyai jenis klausa pengelakan yang sama ditambah pada tempat yang sama, ayat-ayat itu akan dilihat secara sekata oleh pengelas seperti mana ia akan dilihat sekiranya semuanya pada asalnya mempunyai panjang yang sama.
| Situasi | Apa yang dilakukan oleh skor AI | Mengapa |
|---|---|---|
| Hanya sebahagian dokumen telah ditulis semula | Menurun kurang daripada yang dijangka | Segmen yang tidak disentuh membawa skor asalnya ke dalam purata |
| Perbendaharaan kata diubah, struktur ayat dikekalkan | Berubah sangat sedikit | Pengelasan menilai pola pada tahap ayat yang dibiarkan oleh pertukaran itu |
| Ayat benar-benar distruktur semula sepanjang teks | Berubah lebih banyak | Rentak seragam yang dilatih oleh model untuk dikenali menjadi terputus |
| Kurang daripada 300 perkataan prosa dihantar | Tiada skor dijana langsung | Turnitin memerlukan 300 perkataan prosa yang layak sebelum ia melaporkan peratusan |
| Hasil jatuh di bawah 20 percent | Tanda asterisk dan bukannya angka | Turnitin menandai hasil dalam julat itu sebagai kurang boleh dipercayai |
Mengapa Penulisan Semula yang Sama Kadangkala Menghasilkan Skor Rendah
Dokumen yang dihumanisasikan boleh kembali dengan skor rendah atas sebab yang tiada kaitan dengan penulisan semula itu. Turnitin memerlukan sekurang-kurangnya 300 perkataan prosa yang layak sebelum ia akan menjana peratus AI sama sekali, suatu ambang yang dinaikkannya daripada 150 perkataan asal atas alasan yang dinyatakan bahawa ketepatan bertambah baik dengan sedikit lebih banyak teks. Petikan reflektif yang pendek tidak menghasilkan nombor, dan skor yang tiada bukanlah perkara yang sama dengan skor yang bersih.
Turnitin menandai julat di bawah 20 percent dengan asterisk dan bukannya memberikan peratusan yang tepat, kerana terdapat insiden positif palsu yang lebih tinggi dalam julat ini. Pada masa pelancaran, laporan pendidikan juga merujuk kepada tingkah laku ini, dengan menyatakan bahawa hasil yang dilaporkan sebagai kurang daripada 20 percent ditulis oleh AI mempunyai insiden positif palsu yang lebih tinggi dan oleh itu Turnitin menambah penafian. Dokumen yang berada dalam jalur itu telah ditandai sebagai julat yang Turnitin enggan laporkan dengan tepat, yang merupakan perkara yang berbeza daripada dibersihkan.
Terdapat juga pintu masuk institusi di atas semuanya. Turnitin memproses penyerahan untuk pengesanan penulisan AI hanya jika institusi telah mengaktifkan ciri tersebut, dan pentadbir boleh menyahaktifkannya untuk seluruh akaun. Vanderbilt University melakukan perkara itu pada Ogos 2023, dengan merujuk kadar positif palsu 1 percent yang telah diterbitkan oleh Turnitin ketika itu terhadap kira-kira 75,000 penyerahan tahunan, bias terhadap penulis bahasa Inggeris bukan penutur asli, dan kekurangan ketelusan tentang cara model itu berfungsi. Seorang pelajar di institusi yang mematikan ciri tersebut tidak mempunyai skor AI pada mana-mana penyerahan, sama ada yang dihumanisasikan atau sebaliknya.
Dan apabila penulisan semula itu benar-benar bersifat struktur, skor boleh menurun kerana pola yang diukur telah berubah. Turnitin melaporkan anggaran yang dikira daripada pola penulisan, jadi teks yang polanya berbeza akan memperoleh skor yang berbeza. Mekanisme ini berfungsi dalam kedua-dua arah, dan itulah bahagian yang tidak selesa, penulisan manusia asli kadangkala memperoleh skor tinggi atas sebab yang sama.
Humanisasikan kertas anda sendiri
Ubah teks anda yang dibantu AI dan jadikannya kedengaran seperti ditulis manusia, tanpa menyentuh perkataan penting atau sitasi.
Apa yang Didakwa oleh Setiap Vendor Humanizer, dan Apa yang Didokumentasikan
Satu peraturan mengawal jadual ini. Lajur tengah ialah bahasa pemasaran vendor itu sendiri, diambil daripada laman webnya sendiri apabila laman tersebut dapat digunakan sebagai sumber. Lajur kanan merekodkan apa yang sebenarnya menyokong setiap dakwaan, yang dalam kebanyakan kes langsung bukan dataset, tarikh atau kaedah. Tiada ujian awam secara bersemuka wujud untuk jenama-jenama ini.
| Jenama | Apa yang didakwa oleh vendor | Apa yang didokumentasikan |
|---|---|---|
| Undetectable.ai | Menyenaraikan kejayaan melepasi pengesan AI sebagai ciri produk tanpa angka yang disertakan, dan menawarkan bayaran balik kos pemanusiaan jika output ditandai sebagai bukan manusia | Bayaran balik itu ialah terma komersial, tiada set data, tarikh atau hasil mengikut pengesan yang menyokong dakwaan tersebut |
| QuillBot | Tidak membuat dakwaan pengesanan atau pintasan untuk ciri humanizer pada halamannya sendiri. Pengesan AI yang berasingan hanya dihuraikan sebagai mengesan kandungan yang dijana AI | QuillBot menjual humanizer dalam suite penulisan umum dan tidak membuat dakwaan khusus Turnitin untuknya |
| WriteHuman | Dirangking nombor satu pada Humanizer Leaderboard, dan dihuraikan sebagai humanizer AI premium untuk penulisan serius | Leaderboard itu tidak menyebut metodologi atau sampel, dan WriteHuman tidak melampirkan angka ketepatan bernombor pada ranking tersebut |
| Walter Writes AI | Memasarkan pemanusiaan yang luas merentasi 80+ bahasa tanpa dakwaan khusus Turnitin | Tiada data ujian sama ada menyokong atau menafikan |
| HIX Bypass | Memasarkan halaman pintasan mengikut pengesan tanpa angka khusus Turnitin | HIX Bypass dan BypassGPT ialah produk berasingan pada domain berasingan, jadi pastikan yang mana satu yang dihuraikan oleh sesuatu dakwaan |
| StealthGPT | Purata manusia 98% pada Turnitin dan 95% pada GPTZero, masing-masing daripada satu larian yang dinyatakan sebanyak 30 sampel dengan sifar pengesanan, serta jaminan wang dikembalikan jika pelanggan dikesan | Dilaporkan sendiri. Tiada set data, pemilihan sampel, tarikh atau kaedah diterbitkan bersama angka tersebut, dan 30 dokumen ialah larian yang kecil untuk dakwaan tentang model yang menilai jutaan penyerahan |
| Phrasly | Menempatkan dirinya sebagai penyingkir pengesanan AI, tiada data ujian diterbitkan | Tiada dakwaan awam sama ada menyokong atau menafikan. Angka yang beredar dalam ulasan ialah maklumat pihak ketiga dan dikecualikan di sini atas prinsip |
| Grammarly | Tidak memasarkan penulisannya semula sebagai pintasan pengesanan sama sekali. Halaman pengesan AI-nya mendakwa ketepatan pengesanan 99% dan ranking nombor satu pada penanda aras bebas RAID's | Halaman Grammarly yang sama menyatakan bahawa tiada pengesan AI yang 100% tepat. Ciri Authorship-nya melabel teks sebagai ditaip oleh manusia, dicipta dengan AI, atau disunting dengan Grammarly |
| TextPulse | Kadar lulus 92.33% pada Turnitin AI, 89.12% pada Originality.ai dan 87.91% pada GPTZero, diukur pada korpus akademik 2,000 dokumen | Diukur dan diterbitkan oleh TextPulse, maka dilaporkan sendiri seperti setiap angka di atasnya. Saiz korpus dan pengesan dinamakan, tiada hasil pengesan dijanjikan untuk mana-mana dokumen individu |
Tiga perkara timbul daripada jadual itu. Kebanyakan alat ini tidak menerbitkan sebarang dakwaan pengesan untuk diperiksa langsung. Beberapa daripadanya menyertakan saiz sampel bersama satu angka, yang lebih baik daripada apa yang mampu dicapai oleh baki kategori ini. Dan tiada satu pun menerbitkan set data yang boleh dijalankan sendiri oleh sesiapa di luar syarikat. Namun, berikan kredit di tempat setiap jenama memang layak menerimanya. Undetectable.ai meletakkan bayaran balik di sebalik dakwaannya, yang merupakan komitmen konkrit dan bukannya kata sifat. WriteHuman menerbitkan had permintaan dan perkataan yang tepat bagi setiap peringkat, jadi pembeli tahu apa yang mereka peroleh. Grammarly mengkualifikasikan angka ketepatannya sendiri pada halaman yang sama yang memaparkannya, yang lebih baik daripada apa yang dilakukan oleh kebanyakan vendor pengesan. Dan QuillBot yang enggan membuat dakwaan bypass langsung ialah kedudukan yang paling boleh dipertahankan dalam senarai ini.
Mengapa Tiada Sesiapa di Luar Vendor Boleh Memeriksa Angka Ini
Seorang vendor humanizer yang mendakwa kadar lulus Turnitin sedang menghuraikan larian yang dibuat melalui akaun yang dikawalnya, pada dokumen yang dipilihnya, pada tarikh yang biasanya tidak dinyatakannya, terhadap pengelas yang Turnitin semak semula apabila model bahasa baharu dilancarkan. Hal ini benar bagi angka tiga puluh sampel StealthGPT dan juga benar bagi angka 2,000 dokumen yang diterbitkan oleh laman ini. Saiz korpus mengubah jumlah hingar yang terkandung dalam sesuatu angka. Ia tidak menukar laporan kendiri menjadi audit.
Separuh lagi masalahnya ialah senarai model Turnitin sendiri yang didakwanya dapat dikesan disunting apabila keluaran baharu tiba. Kadar lulus yang diukur terhadap pengelas suku tahun lalu hanya menghuraikan pengelas suku tahun lalu dan tiada yang lain. Mengapa hal ini bermaksud tiada sesiapa boleh menamakan humanizer AI terbaik untuk bypass Turnitin dihuraikan secara berasingan. Setiap angka pada setiap laman utama humanizer, termasuk laman ini, ialah petikan keadaan yang membawa tarikh yang mungkin tidak pernah diterbitkan oleh vendor.
Cara Membaca Dakwaan Bypass Sebelum Anda Membayarnya
Empat soalan membezakan dakwaan yang wajar dipertimbangkan daripada dakwaan yang wajar diabaikan, dan soalan-soalan ini terpakai kepada setiap baris dalam jadual di atas, termasuk baris terakhir.
- Berapa banyak dokumen yang diuji, dan siapa yang memilihnya? Peratusan tanpa saiz sampel di belakangnya ialah slogan yang memakai nombor.
- Pada tarikh apa, dan terhadap versi pengesan yang mana? Model pengesanan disemak semula apabila model bahasa baharu dilancarkan, dan kadar lulus tanpa tarikh menjadi lapuk dengan cepat.
- Adakah jaminan itu bayaran balik atau hasil? Janji wang dikembalikan memindahkan risiko kewangan yang kecil dan tidak melakukan apa-apa langsung terhadap panel integriti akademik.
- Apa yang dikatakan oleh vendor berlaku kepada petikan, istilah teknikal atau petikan blok? Kebanyakan halaman humanizer tidak mengatakan apa-apa, dan itu sendiri ialah jawapan.
Soalan terakhir itu menentukan lebih daripada yang ditentukan oleh aritmetik pengesan bagi sesiapa yang menghantar kerja akademik. Satu penulisan semula yang mendapat skor baik dan secara senyap mengeneralisasikan ayat kaedah telah mengorbankan perkara yang anda dinilai. humanizer akademik TextPulse mendokumentasikan pemeliharaan petikan merentasi APA, MLA, IEEE, Chicago, Harvard dan Vancouver, istilah beku untuk mengunci kosa kata tepat sebelum satu laluan dijalankan, dan latihan pada teks akademik yang disemak rakan sebaya dengan output dikekalkan pada Flesch-Kincaid gred 13 hingga 18. Itu ialah dakwaan tentang apa yang berlaku kepada teks, yang merupakan jenis dakwaan yang berbeza daripada peratusan tentang pengesan, dan pembaca boleh mengesahkannya dalam output dalam masa seminit.
Apa Maksud Skor Itu bagi Seorang Pelajar, Dalam Apa Jua Keadaan
Turnitin jelas menyatakan bahawa penunjuk penulisan AI bukanlah penemuan salah laku. Halaman produk Turnitin secara eksplisit menyatakan bahawa Turnitin Originality "does not make a determination of misconduct through our AI writing detection (or similarity checking) technology." Ia juga menjelaskan bahawa Turnitin membekalkan maklumat untuk membolehkan guru membuat keputusan yang dimaklumkan berdasarkan dasar institusi mereka. Ini diulangi dengan amaran bahawa model itu "may not always be accurate (it may misidentify human-written, AI-generated, and AI-paraphrased text), so it should not be used as the sole basis for adverse actions against a student."
Pelajar tidak melihat skor secara lalai. Turnitin menyatakan dengan jelas bahawa penunjuk dan laporan pengesanan penulisan AI tidak kelihatan kepada pelajar, dan satu-satunya cara untuk melihatnya ialah pengajar memuat turun laporan sebagai PDF dan menyerahkannya. Pelajar yang menyemak draf mereka sendiri sedang menyemak alat yang berbeza, dilatih pada data yang berbeza, dan kedua-dua nombor itu tidak mempunyai kewajipan untuk sepadan.
Ini meninggalkan bahagian yang tidak diselesaikan oleh sebarang skor. Sama ada bantuan AI dibenarkan sama sekali ialah persoalan untuk kursus dan institusi, dan dasar penggunaan AI menjawabnya dengan cara yang tidak pernah dilakukan oleh peratusan. Skor tinggi pada penggunaan yang dibenarkan dan didedahkan ialah perbualan dengan bukti di belakangnya. Skor rendah pada penggunaan yang tidak didedahkan yang dilarang oleh dasar itu masih merupakan penggunaan yang tidak didedahkan.
Bagi penulis yang menyunting draf sendiri, tafsiran praktikal bagi semua ini ialah skor mengikuti penulisan. Model Turnitin mengukur pola pada tahap ayat merentasi keseluruhan dokumen, jadi penulisan semula separa menghasilkan pergerakan separa dan penggantian kosa kata menghasilkan pergerakan yang sangat sedikit. Panduan penuh cara memanusiakan teks AI menghuraikan suntingan struktur yang mengubah pola itu, mengikut urutan yang paling banyak menggerakkannya.
AI humanizer TextPulse menerapkan suntingan struktur itu merentasi keseluruhan dokumen sekali gus dan melaporkan anggaran Skor Manusia yang dikira daripada teks itu sendiri, bukan ramalan tentang apa yang akan dikatakan oleh mana-mana pengesan yang dinamakan. Tiada alat boleh menjanjikan hasil Turnitin, kerana tiada alat boleh melihat ke dalam model Turnitin. Mana-mana produk yang mendakwa sebaliknya sedang menghuraikan hasil yang tiada cara untuk diperhatikannya.
Perbezaan antara humanizer dan paraphraser penting di sini, begitu juga sebab teks parafrasa masih ditandakan.
Nombor ialah bahagian yang paling kurang menarik dalam hal ini. Apa yang menentukan hasil ialah dua puluh minit selepas seorang penanda melihatnya: sama ada kertas itu boleh menunjukkan proses kerjanya, sejarah draf, satu set nota, sumber yang boleh dibincangkan oleh penulis tanpa membukanya. Bukti itu tersedia kepada sesiapa yang melakukan kerja tersebut, dan ia kekal walaupun selepas skor yang gagal digerakkan oleh penulisan semula.
Soalan Lazim
Panduan Turnitin sendiri menyatakan bahawa penunjuk AI-nya merangkumi pengesanan kandungan yang mungkin telah dimanusiakan atau melalui bypasser. Apa yang sebenarnya dikeluarkan oleh produk itu ialah peratusan teks yang layak, bukan keputusan tentang kepengarangan. Jadi, jawapan praktikal kepada bolehkah Turnitin mengesan teks dimanusiakan ialah skor itu mencerminkan berapa banyak pola penulisan mesin yang kekal selepas penulisan semula.
Content strategist at TextPulse, here since the company started. Mark writes the product and technical coverage: how the humanizer works under the hood, what changes in each release, and what a specification actually means for your writing. His reviews of writing software come from using them on real documents rather than reading a feature list.