Bagaimana GPTZero Berfungsi
GPTZero memasyhurkan perplexity dan burstiness, kemudian secara senyap menghentikan kedua-duanya. Berikut ialah apa yang diukur oleh pengelasnya sekarang, apa yang sebenarnya ditunjukkan oleh laporan, dan di mana alat itu menyatakan hadnya sendiri.
Taip "how gptzero works" ke dalam bar carian dan kebanyakan yang muncul masih menerangkan perplexity dan burstiness, dua statistik yang pengasasnya sendiri jadikan terkenal dalam minggu-minggu awal selepas pelancaran ChatGPT. Huraian itu tepat pada Januari 2023. Huraian itu tidak lagi tepat sejak musim luruh tahun tersebut, apabila dokumentasi GPTZero sendiri menyatakan syarikat itu menggantikan kaedah tersebut dengan sesuatu yang sama sekali lain. Jurang antara apa yang alat itu lakukan pada pelancaran dan apa yang dilakukannya sekarang adalah cukup besar sehingga kebanyakan penjelasan yang masih beredar hari ini menggambarkan produk yang sudah tidak wujud.
Hari ini, GPTZero menjalankan pengelas per ayat ke atas korpus besar yang bercampur, teks yang dijana manusia dan teks yang dijana AI, berbanding pengiraan perplexity. GPTZero hari ini masih memberikan satu nombor tajuk utama, tetapi aritmetikanya berbeza. Penyerlahan pada peringkat ayat di bawah nombor tajuk utama juga mempunyai maksud yang berbeza daripada yang berlaku pada 2023. Kedua-dua versi cerita ini wajar diketahui, versi yang menjadikan istilah tersebut terkenal, dan versi yang sebenarnya dijalankan hari ini.

Sejarah: Bagaimana Perplexity dan Burstiness Menjadikan GPTZero Terkenal
Pada 2 Januari 2023, bekas pelajar Princeton, Edward Tian, mengeluarkan demonstrasi awam GPTZero, hanya beberapa minggu selepas ChatGPT dilancarkan. Halaman penerangan asalnya menerangkan bagaimana beliau menggunakan dua statistik yang dipinjam daripada pemodelan bahasa untuk mengesan apabila sesuatu model bahasa telah menulis sesuatu. Perplexity ialah skor tentang sejauh mana model rujukan berasa terkejut dengan pilihan perkataan dalam teks. Burstiness ialah nama GPTZero untuk tahap sejauh mana kejutan itu berubah-ubah dalam sesuatu dokumen. Halaman penerangan tersebutlah sebab kedua-dua perkataan itu langsung memasuki perbualan harian tentang penulisan AI. Kebanyakan orang yang hari ini boleh mentakrifkan perplexity atau burstiness mempelajari istilah tersebut daripada GPTZero, bukan daripada sebuah buku teks.
Mekanisme itu sendiri mudah untuk dihuraikan. Masukkan satu petikan melalui model bahasa rujukan, dan prosa yang model dapati sangat boleh diramal, perplexity yang rendah, dibaca sebagai tipikal mesin, kerana penjanaan cenderung mengutamakan perkataan seterusnya yang paling mungkin berbanding perkataan yang mengejutkan. Dokumentasi GPTZero sendiri yang sudah tidak digunakan lagi malah menerbitkan satu panduan umum: skor perplexity melebihi 85 dibaca sebagai lebih berkemungkinan manusia berbanding mesin. Ambang itu datang daripada satu vendor, pada satu model, pada satu ketika, dan GPTZero sendiri kini tidak lagi mempertahankannya.
Bagaimana GPTZero Berfungsi Sekarang: Pengelas Tahap Ayat
Pusat sokongan GPTZero menyatakan perkara itu secara jelas: "Setakat musim luruh 2023, GPTZero tidak lagi menggunakan perplexity dan burstiness untuk pengesanan AI kerana kami telah berpindah kepada seni bina berasaskan pembelajaran mendalam." Halaman teknologi semasanya, mengesahkan bahawa pertukaran itu sepenuhnya. Ia menerangkan "pendekatan pembelajaran mendalam hujung ke hujung, dilatih pada set data teks daripada web, pendidikan, dan AI yang dijana daripada pelbagai LLM", di mana "model pengelasan secara ayat demi ayat menentukan kebarangkalian dan keyakinan bahawa sesuatu teks dicipta oleh AI". Perplexity dan burstiness tidak muncul langsung pada halaman itu.
Sejak itu, ia juga menambah lapisan pertahanan, Paraphraser Shield, yang dibina untuk menangkap teks AI yang telah dijalankan melalui alat penulisan semula untuk mengelakkan pengesanan. Anda boleh tampal teks, memuat naik dokumen Word, PDF dan fail imej, serta sehingga lima puluh fail sekali gus. Tiada satu pun infrastruktur tersebut berkaitan dengan pengiraan kekerapan model rujukan akan meneka perkataan yang sama.
Apa yang Laporan GPTZero Sebenarnya Tunjukkan kepada Anda
Keputusan GPTZero mengandungi tiga bahagian, pengelasan AI, manusia atau bercampur, peratus yang menyatakan kebarangkalian model bahawa dokumen itu ditulis oleh AI, dan label keyakinan yang menerangkan sejauh mana ramalan tertentu itu boleh dipercayai. Label itu lebih penting daripada yang mungkin kelihatan. GPTZero mengaitkan "sangat yakin" dengan kadar ralat di bawah 2 peratus dan "keyakinan rendah" dengan kadar ralat 14 peratus atau lebih, julat yang cukup luas sehingga peratus tajuk yang sama boleh membawa berat yang sangat berbeza daripada satu laporan ke laporan yang seterusnya.
Pemeriksaan berbayar menambah penyerlahan pada peringkat ayat, dan adalah berbaloi untuk membacanya dengan betul. GPTZero menerangkan ayat yang diserlahkan sebagai ayat yang memberi kesan secara tidak seimbang terhadap skor keseluruhan, bukan senarai tuduhan terhadap baris individu. Satu ayat boleh tidak diserlahkan dan masih membentuk hasil, kerana pengelas membaca dokumen secara keseluruhan, bukan membuat undian ayat demi ayat.
| Unsur laporan | Apa yang ia beritahu kepada anda |
|---|---|
| Pengelasan | Satu label: AI, manusia, atau bercampur |
| Skor kebarangkalian AI | Peratus yang mencerminkan sejauh mana model menilai dokumen itu sebagai ditulis oleh AI |
| Label keyakinan | Bermula daripada sangat yakin, dengan kadar ralat di bawah 2 peratus, hingga keyakinan rendah, 14 peratus atau lebih |
| Penyerlahan ayat | Menandakan ayat yang menyumbang paling banyak kepada skor pada Advanced Scan, bukan setiap ayat yang berkaitan dengannya |
Tidak satu pun unsur laporan ini wujud dalam bentuk semasanya apabila penjelasan perplexity-dan-burstiness masih merupakan penerangan awam GPTZero tentang dirinya. Antaramuka berubah seiring dengan kaedah.
Humanisasikan kertas anda sendiri
Ubah teks anda yang dibantu AI dan jadikannya kedengaran seperti ditulis manusia, tanpa menyentuh perkataan penting atau sitasi.
Mengapa Huraian Perplexity dan Burstiness Masih Beredar
Penerangan asal GPTZero masih dalam talian, masih diindeks, dan masih salah satu huraian umum yang lebih jelas tentang cara perplexity dan burstiness berfungsi sebagai konsep. Enjin carian dan laman lain terus memetiknya, dan ada yang merujuk kepada ulasan 2026 yang dikongsi secara meluas, yang mendakwa bahawa alat itu masih menjalankan lapisan perplexity dan burstiness secara senyap di samping pengelasnya. Halaman semasa GPTZero sendiri, halaman teknologi dan kedua-dua artikel sokongannya, mengatakan sebaliknya, istilah itu telah ditamatkan, bukan sekadar disembunyikan di belakang tabir. Halaman yang menerangkan sesuatu konsep secara abstrak tidak sama dengan halaman yang menerangkan kaedah semasa alat ini, dan memperlakukan kedua-duanya sebagai boleh ditukar ganti adalah antara sebab utama kekeliruan itu berlarutan selama tiga tahun selepas tarikh tamatnya.
Perkara ini penting di luar trivia. Seorang pelajar atau rakan sekerja yang diberi nasihat untuk menurunkan perplexity atau merenggangkan panjang ayat khususnya untuk mengatasi GPTZero sedang diberikan panduan yang menyasarkan versi produk yang berhenti beroperasi pada 2023. Apa yang menggerakkan pengelas ayat ialah persoalan yang berkaitan tetapi berbeza, lebih dekat kepada huraian umum tentang bagaimana pengesan AI sebenarnya berfungsi berbanding mana-mana statistik itu secara berasingan. GPTZero belum berhenti mengukurnya, menurut akaunnya sendiri, ia berada dalam kalangan tujuh indikator yang memberi input kepada model semasa, tetapi indikator itu tidak lagi menjadi perkara yang menentukan jawapan.
Apa yang GPTZero Katakan Ia Tidak Boleh Lakukan
Penanda aras yang diterbitkan oleh GPTZero adalah lebih kurang sekuat yang vendor mungkin sanggup terbitkan tentang produk mereka sendiri. Syarikat itu melaporkan "kadar ketepatan 99% apabila mengesan teks yang dijana AI berbanding penulisan manusia", menyatakan "kami mengekalkan kadar positif palsu GPTZero pada tidak lebih daripada 1% apabila menilai teks AI berbanding teks manusia", dan merekodkan "kadar ketepatan 96.5%" pada dapatan yang mencampurkan penulisan AI dan manusia, bersama 1.1 peratus pada esei TOEFL, satu penanda lazim bagi penulisan Bahasa Inggeris bukan penutur jati. Angka-angka tersebut datang daripada penilaian kendiri GPTZero, diterbitkan pada Januari 2025, tanpa replikasi bebas yang dipetik pada halaman yang melaporkan angka itu. Halaman yang sama juga menolak dakwaan yang kebanyakan vendor gunakan, dengan menyatakan bahawa "tidak akan ada jaminan 100%" dan bahawa sesiapa yang mendakwa sebaliknya mungkin mempunyai kelemahan dalam data mereka atau kaedah penilaian mereka.
Halaman batasan kendiri GPTZero lebih spesifik berbanding angka pemasaran. Syarikat itu menyatakan bahawa ketepatan bertambah baik apabila lebih banyak teks dihantar dan menurun pada peringkat ayat dan perenggan berbanding dokumen penuh. Ia menyatakan data latihannya kebanyakannya ialah prosa Bahasa Inggeris dewasa, jadi teks yang menyimpang daripada corak itu lebih sukar untuk dikelaskan dengan pasti. Ia menyatakan pengelas itu tidak dilatih untuk mengesan teks AI yang telah diubah secara besar-besaran selepas penjanaan. Dan ia menyatakan secara jelas bahawa penulisan yang dijana mesin lain atau penulisan yang sangat prosedural, bukan sekadar output chatbot, boleh ditandakan dengan cara yang sama.
Semua itu bukan alasan untuk menganggap nombor GPTZero sebagai sesuatu yang tidak boleh dipersoalkan, dan ia bukan satu-satunya pengesan yang wajar difahami mengikut terma tersendiri. Pembaca yang ingin tahu apa yang sebenarnya dibalas oleh pengelas seperti ini boleh melihat versi corak tersebut untuk diri mereka sendiri dengan pemeriksa perplexity percuma atau pemeriksa burstiness percuma, dua komponen dalam koleksi alat percuma yang lebih lengkap, meliputi lapisan statistik lain yang digunakan oleh laporan seperti ini.
GPTZero mempunyai dua statistik utama yang masing-masing mempunyai halaman sendiri: apa yang diukur oleh perplexity dalam pengesanan AI, dan aritmetik kebarangkalian token yang menghasilkan kedua-dua nombor tersebut.
Sebuah alat yang bersedia menamakan titik butanya dengan ketepatan seperti ini lebih wajar dipercayai berbanding alat yang mendakwa tiada, dan peratusan yang tidak dijelaskan seterusnya pada sebuah laporan ialah tempat yang baik untuk mula bertanya jenis alat yang menghasilkannya.
Apa Yang Ditemui Penyelidikan Kami
Dalam kajian persetujuan pengesan TextPulse Research, sembilan pengesan AI komersial menilai 90 teks akademik yang sama. Salah satunya ialah teks hibrid 455 patah perkataan: pembukaan dan penutup tulisan manusia mengapit bahagian tengah 168 patah perkataan janaan AI. GPTZero memberi teks ini skor 41.2% AI, manakala keputusan alat lain terhadap perkataan yang sama berjulat dari 0% hingga 95.7% AI. Kertas penuh, korpus dan matriks skor setiap alat tersedia terbuka di TextPulse Research.

Soalan Lazim
Tidak. Pusat sokongan GPTZero menyatakan bahawa syarikat itu berhenti menggunakan perplexity dan burstiness untuk pengesanan mulai musim luruh 2023, selepas beralih kepada pengelas pembelajaran mendalam. Halaman teknologi semasanya menerangkan model pengelasan ayat demi ayat dan tidak menyebut mana-mana istilah itu. Huraian tersebut masih beredar kerana penjelasan GPTZero sendiri pada 2023 mempopularkan kedua-dua perkataan itu sebelum kaedahnya berubah.
PhD in natural language processing, with years spent building NLP applications end to end. Moe works on text analysis: lexical and syntactic structure, and what separates machine-generated prose from human prose statistically. He has been experimenting with computational linguistics since the early days of NLTK, spaCy and WordNet, and still writes most of his tooling in Python.