AI Detection

Turnitin Similarity Score vs AI Score: Dua Laporan Berbeda

Skor similarity dan skor AI menjawab pertanyaan yang berbeda, sehingga sebuah makalah dapat memperoleh skor rendah pada salah satunya dan tinggi pada yang lain tanpa salah satu angka itu keliru. Apa yang diukur masing-masing, apa yang memicunya, dan apa yang dibuktikan serta tidak dibuktikan oleh angka tinggi.

Diperbarui pada 5 min
Turnitin similarity vs AI score comparison chart showing two independent report numbers

Sebuah laporan muncul dengan dua angka di dalamnya: skor kemiripan 3 persen dan skor AI 88 persen. Pembacaan yang wajar adalah bahwa keduanya pasti mengukur hal yang sama, sehingga angka yang rendah seharusnya berarti angka yang tinggi juga kemungkinan keliru. Namun, tidak demikian. Turnitin similarity vs AI score adalah perbandingan antara dua sistem terpisah yang memeriksa dua hal terpisah, dan sebuah kiriman dapat memperoleh skor rendah pada yang satu dan tinggi pada yang lain tanpa salah satu angka itu merupakan kesalahan.

Ini lebih lama daripada yang AI, dibuat untuk menangkap teks yang cocok dengan sesuatu yang sudah ada. Ini lebih baru, ditambahkan ke Similarity Report yang sama sebagai pengukuran independen tersendiri, dibuat untuk memperkirakan apakah prosa terbaca seperti dihasilkan mesin, terlepas dari apakah ia cocok dengan apa pun atau tidak. Keduanya sepenuhnya independen dan tidak saling memengaruhi, menurut dokumentasi Turnitin sendiri. Semua hal lain dalam bagian ini.

Turnitin similarity report showing 12% overall similarity, with match groups of 115 not cited or quoted at 9% and 41 missing quotations at 3%, top sources across internet, publications and student papers, and zero integrity flags
Laporan kemiripan menjawab satu pertanyaan: seberapa banyak teks ini cocok dengan sesuatu yang sudah ada di basis data Turnitin. Di sini nilainya 12%, dipecah menjadi kelompok kecocokan dan sumber, tanpa ada tanda integritas yang muncul.
Ikhtisar penulisan AI Turnitin yang menunjukkan 71% terdeteksi sebagai AI, terdiri atas 18 segmen yang ditandai hanya sebagai AI-generated dan nol segmen yang ditandai sebagai AI-paraphrased, di samping peringatan bahwa peninjau harus memahami keterbatasan deteksi AI
Laporan penulisan AI adalah dokumen terpisah dengan nomor tersendiri. Makalah yang sama terbaca 71% terdeteksi sebagai AI, terbagi antara teks AI-generated only dan AI-paraphrased, dengan peringatan Turnitin sendiri tentang keterbatasan deteksi tercetak di sampingnya.

Turnitin Similarity vs AI Score: Apa yang Dilaporkan oleh Setiap Angka

Turnitin memperlakukan keduanya sebagai pengukuran yang berbeda yang digabungkan dalam satu produk, bukan dua tampilan dari satu hasil. Similarity Report membandingkan suatu naskah dengan basis data konten web, publikasi akademik, dan makalah mahasiswa yang sebelumnya telah diserahkan, lalu menghasilkan persentase teks naskah yang cocok dengan sesuatu yang sudah ada dalam basis data tersebut. Deteksi penulisan AI menjalankan model yang sama sekali berbeda, ditambahkan ke dalam laporan yang sama sebagai skor independen tersendiri, yang dilatih untuk menilai seberapa dekat prosa suatu bagian menyerupai tulisan yang dihasilkan mesin, tanpa merujuk pada basis data eksternal apa pun. Mekanisme yang lebih lengkap tentang bagaimana klasifikator AI Turnitin mencapai angka itu dibahas secara terpisah, yang penting di sini ialah bahwa ia menjawab pertanyaan yang berbeda dari mesin similarity yang berada di dalam laporan yang sama.

Apa yang Sebenarnya Diukur oleh Similarity Score

Similarity adalah latihan pencocokan, bukan penilaian. Pedoman Turnitin sendiri menegaskan bahwa alat ini tidak memeriksa plagiarisme. Alat ini memeriksa tumpang tindih dan menyerahkan penafsirannya kepada pengajar yang membaca laporan. Kutipan yang dipisahkan dengan benar, frasa pada bagian metode yang digunakan bersama di seluruh subbidang, daftar pustaka yang diformat seperti cara setiap makalah di jurnal itu memformat daftar pustakanya, semuanya dapat tercatat sebagai kecocokan, karena sistem menghitung rangkaian teks yang saling tumpang tindih, bukan menilai apakah tumpang tindih itu sah.

Itulah juga sebabnya skor kemiripan nol membuktikan lebih sedikit daripada yang tampak. Itu berarti pengajuan tersebut tidak memuat rentang teks yang panjang dan tidak terputus yang ditemukan di sumber terindeks Turnitin lainnya. Itu tidak mengatakan apa pun tentang bagaimana kalimat-kalimat yang ada di dalamnya dihasilkan, karena menghasilkan kalimat yang tidak cocok dengan apa pun di basis data bukanlah keterampilan yang sama dengan menghasilkan kalimat yang tidak akan diprediksi oleh model bahasa.

Humanisasi makalah Anda sendiri

Ubah teks berbantuan AI Anda dan buat terdengar manusiawi, tanpa menyentuh kata penting atau sitasi.

Mulai gratis

Apa yang Sebenarnya Diukur oleh Skor AI

Skor AI tidak memiliki basis data untuk diperiksa. Sebuah pengklasifikasi membaca prosa yang diajukan dan memperkirakan, dari pola yang dipelajarinya di berbagai contoh tulisan manusia dan tulisan yang dihasilkan AI, seberapa besar kemungkinan prosa itu berasal dari model, bukan dari manusia. Tidak ada dalam perkiraan itu yang bergantung pada apakah kalimat yang persis sama pernah muncul di mana pun sebelumnya. Sebuah kalimat dapat sepenuhnya unik, belum pernah diketik oleh siapa pun sampai pengajuan ini, dan tetap terbaca sebagai secara statistik khas keluaran AI jika pilihan kata dan ritmenya mengikuti pola yang cenderung dihasilkan oleh model bahasa.

Ini adalah wilayah statistik yang sama yang dibahas secara lengkap dalam uraian yang lebih luas tentang bagaimana AI detectors sebenarnya bekerja: keterprediksian pada tingkat kata dan ritme pada tingkat kalimat, digabungkan menjadi satu skor dokumen. Versi pengklasifikasi milik Turnitin bersifat proprietari, tetapi premis dasarnya, bahwa teks yang dihasilkan cenderung lebih khas secara statistik daripada tulisan manusia, adalah premis yang sama yang bekerja di balik setiap alat dalam kategori ini.

Skor KemiripanSkor AI
Apa yang diukurSeberapa banyak teks dalam pengajuan yang cocok dengan dokumen terindeks lainnyaSeberapa dekat prosa tersebut menyerupai tulisan yang secara statistik khas dihasilkan AI
Apa yang memicu angka tinggiKutipan panjang, frasa umum yang khas bidang tertentu, materi yang digunakan kembali, atau kecocokan dengan pengajuan sebelumnyaIrama kalimat yang seragam dan pilihan kata yang secara konsisten dapat diprediksi di seluruh dokumen
Apa yang tidak dibuktikan oleh angka tinggiBahwa teks yang cocok itu digunakan secara tidak semestinya. Materi yang dikutip dengan benar tetap dapat terdeteksi sebagai kecocokan.Bahwa satu kalimat pun dihasilkan oleh AI. Klasifikator membaca pola keseluruhan dokumen, bukan satu baris secara terpisah.

Bisakah sebuah makalah memiliki 0 Persen Kemiripan dan Skor AI 90 Persen?

Ya, dan kombinasi ini bukan gangguan. Kedua skor tersebut menjawab pertanyaan yang berbeda, sehingga keempat kombinasi tinggi dan rendah mungkin terjadi, dan masing-masing menyiratkan sesuatu yang berbeda tentang bagaimana teks itu diproduksi.

  • Kemiripan rendah, skor AI rendah: tulisan asli biasa yang juga terbaca dengan variasi manusia yang khas. Kasus umum untuk sebagian besar karya mahasiswa yang benar-benar orisinal.
  • Kemiripan rendah, skor AI tinggi: kalimat asli, tidak disalin dari mana pun, yang terbaca secara statistik dapat diprediksi seperti kecenderungan teks yang dihasilkan. Ciri tulisan AI yang belum diedit, yang tidak diparafrasekan dari sumber yang sudah ada.
  • Kemiripan tinggi, skor AI rendah: teks yang sangat cocok dengan sumber yang ditulis manusia yang sudah ada, tanpa kerataan statistik yang diasosiasikan klasifikator dengan generasi. Teks yang disalin, terdeteksi oleh alat yang lebih lama, bukan yang lebih baru.
  • Kemiripan tinggi, skor AI tinggi: teks yang cocok dengan sumber yang sudah ada yang juga dihasilkan AI, misalnya makalah yang sebelumnya diajukan dan ditulis AI atau halaman teks yang dihasilkan AI yang sudah terindeks dari web terbuka.

Tidak satu pun dari kombinasi ini memerlukan sesuatu yang tidak biasa di sisi perangkat lunak. Hal ini muncul dari fakta bahwa satu sistem memeriksa kecocokan dan sistem lainnya memeriksa pola, dan suatu bagian teks dapat memiliki salah satu sifat itu, keduanya, atau tidak keduanya.

Apa yang Dibuktikan, dan Tidak Dibuktikan, oleh Skor AI yang Tinggi

Skor AI yang tinggi adalah estimasi statistik, bukan pengakuan yang diekstraksi dari teks. Skor ini menyatakan bahwa prosa di hadapan pengklasifikasi menyerupai, dalam pilihan kata dan ritmenya, jenis tulisan yang oleh model dilatih untuk diasosiasikan dengan generasi AI. Skor ini tidak mengidentifikasi kalimat tertentu sebagai pasti ditulis mesin, dan tidak mengetahui apa pun tentang bagaimana dokumen itu sebenarnya diproduksi, hanya bagaimana dokumen itu terbaca setelah selesai. TextPulse mengambil posisi yang sama tentang angkanya sendiri: yang dilaporkannya adalah Human Score yang diestimasi dan dihitung dari teks di hadapannya, bukan putusan tentang alat mana, jika ada, yang menyentuh dokumen itu.

Tanggapan praktis terhadap salah satu angka itu, skor kemiripan yang rendah atau skor AI yang tinggi, adalah sama: perlakukan itu sebagai alasan untuk melihat lebih dekat, bukan sebagai temuan yang harus diterima atau ditolak sekilas. Draf, catatan, dan riwayat versi menunjukkan bagaimana suatu dokumen sebenarnya ditulis dengan cara yang tidak pernah dapat dilakukan oleh persentase, pada laporan mana pun. Siapa pun yang ingin tahu apa yang sebenarnya sedang direspons oleh pengklasifikasi dalam drafnya sendiri dapat melihat pola pada tingkat kata yang sama untuk dirinya sendiri dengan free perplexity checker, jauh sebelum laporan apa pun dihasilkan.

Koleksi free tools collection milik TextPulse mencakup lapisan statistik lain yang layak diperiksa sebelum suatu draf mendekati pengajar, bukan hanya dua yang dibandingkan di sini.

Setelah kedua angka dipisahkan, pertanyaan berikutnya adalah apa yang dianggap sebagai skor Turnitin yang baik. Untuk detektor lain yang paling sering ditemui mahasiswa, cara kerja GPTZero dibahas di halaman tersendiri.

Dua angka itu akan terus berdampingan pada laporan yang sama, dan akan terus dibaca sebagai satu angka oleh orang yang terburu-buru. Mengetahui pertanyaan mana yang sebenarnya dijawab oleh masing-masing angka itulah yang mengubah sepasang persentase yang membingungkan menjadi dua informasi yang terpisah dan berguna.

XLinkedInFacebook

Pertanyaan yang Sering Diajukan

Turnitin similarity vs AI score bergantung pada apa yang diperiksa masing-masing. Skor similarity melaporkan seberapa besar bagian suatu kiriman yang cocok dengan teks yang sudah ada dalam basis data Turnitin atas halaman web, publikasi, dan makalah mahasiswa sebelumnya. Skor AI adalah pengukuran terpisah dan independen yang memperkirakan seberapa dekat prosa tersebut terbaca sebagai hasil generasi mesin, tanpa merujuk pada basis data apa pun. Dokumentasi Turnitin sendiri menyatakan bahwa kedua angka itu tidak saling memengaruhi.

Moe

PhD in natural language processing, with years spent building NLP applications end to end. Moe works on text analysis: lexical and syntactic structure, and what separates machine-generated prose from human prose statistically. He has been experimenting with computational linguistics since the early days of NLTK, spaCy and WordNet, and still writes most of his tooling in Python.

Tetap terupdate tentang humanisasi AI

Dapatkan tips tentang penulisan akademik, deteksi AI, dan humanisasi yang dikirim ke kotak masuk Anda.

Tanpa spam. Berhenti berlangganan kapan saja.