Ulasan Pengesan AI Pangram: Alat yang Terus Disahkan oleh Penyelidik
Pangram menerbitkan kadar positif palsu kira-kira 1 dalam 10,000, dan tidak seperti kebanyakan vendor pengesan, kini ia mempunyai penyelidikan bebas terkini yang menunjukkan arah yang sama. Satu kajian semakan rakan sebaya 2026 dari Vrije Universiteit Brussel mendapati bahawa ia ialah satu-satunya alat daripada empat yang menghasilkan keputusan memuaskan pada kertas peringkat sarjana. Inilah yang diukur oleh kajian-kajian itu, di mana buktinya masih tipis, dan apa yang tidak dapat dibuktikan oleh sebarang skor pengesan.
Pangram ialah pengesan AI yang terus dipilih secara khusus oleh penyelidik bebas, dan ini menjadikannya wajar diteliti lebih dekat daripada kad skor vendor yang biasa. Pembuatnya, Pangram Labs, menerbitkan kadar positif palsu kira-kira 1 dalam 10,000 dan ketepatan utama 99.98 percent. Itulah angka syarikat itu sendiri, diukur pada penanda arasnya sendiri. Apa yang membezakan Pangram daripada kebanyakan bidang ini ialah bahawa, buat pertama kali, penyelidikan luar yang terkini menunjukkan arah umum yang sama.
Dua penilaian bebas muncul dalam tempoh setahun yang lalu, satu kajian semakan rakan sebaya dari Vrije Universiteit Brussel, diterbitkan oleh Springer pada June 2026, dan satu kertas kerja University of Chicago Booth School yang dibincangkan dalam Chicago Booth Review pada December 2025. Kedua-duanya meletakkan Pangram dengan jelas di hadapan pesaing yang lebih terkenal, termasuk Turnitin, GPTZero, dan Copyleaks. Tiada satu pun kajian menjadikan skor mana-mana pengesan sebagai bukti tentang mana-mana dokumen tertentu, dan kedua-duanya menyatakan hal itu.
Perkara yang berikut ialah apa yang Pangram dakwa tentang dirinya, apa yang sebenarnya diukur oleh dua kajian itu, di mana buktinya masih tipis, dan apa yang kenaikan alat ini katakan tentang seluruh bidang pengesanan.
Apa Itu Pangram dan Siapa Menggunakannya
Pangram Labs ialah syarikat kecil yang diasaskan pada 2023 di Brooklyn oleh penyelidik AI yang sebelum ini bekerja di Tesla dan Google. Produk ini menyemak teks yang ditampal atau dimuat naik dan mengembalikan anggaran tentang berapa banyak daripadanya dijana oleh AI, dengan penyorotan pada tahap ayat, serta pengesanan imej dan semakan plagiarisme pada pelan berbayar.
Pangkalan penggunanya kelihatan berbeza daripada Turnitin. Turnitin dijual kepada institusi dan beroperasi dalam sistem pengurusan pembelajaran, manakala Pangram boleh digunakan oleh sesiapa sahaja dengan akaun percuma, yang bermaksud pelajar, editor, kakitangan jurnal, dan pembaca kemasukan menggunakannya secara langsung. Ia ialah pendatang baharu dalam pasaran ini, dan semakin kerap menjadi alat yang dirujuk oleh penyelidik integriti akademik apabila mereka mahukan titik perbandingan, tepat kerana ia terus menunjukkan prestasi dalam ujian yang tidak dicapai oleh pemain sedia ada.
Apa yang Didakwa oleh Vendor
Pangram pada halaman utama memaparkan ketepatan 99.98 percent dan menyatakan bahawa kadar positif palsunya, iaitu kadar dokumen manusia tersalah ditandai sebagai AI, pada masa ini ialah 1 in 10,000. Sebuah catatan blog syarikat tentang positif palsu, yang ditulis oleh CTO-nya, memecahkan angka keseluruhan itu mengikut genre: 0.004 percent pada esei akademik, 0.001 percent pada abstrak saintifik, dengan titik lemah yang didedahkan sendiri oleh syarikat, seperti 0.05 percent pada puisi dan 0.23 percent pada resipi. Syarikat itu juga mendakwa modelnya masih mengesan teks AI selepas ia diproses oleh alat yang dipanggil humanizer.
Semua ini ialah angka yang dilaporkan sendiri daripada set ujian milik vendor, dan catatan yang sama turut mengandungi pengehadan vendor sendiri: model ini berfungsi paling baik pada teks yang lebih panjang yang ditulis dalam ayat lengkap, dan syarikat menasihatkan agar tidak menapis senarai berbulet pendek atau teks yang sangat berformula. Perhatikan kedua-dua bahagian ini. Dakwaan tersebut sangat khusus dan sangat rendah, namun ia tetap dakwaan sehingga seseorang di luar syarikat mengesahkannya.

Bukti Bebas yang Ditunjukkan
Ujian paling kukuh setakat ini ialah satu kajian yang disemak rakan sebaya oleh Van Vlasselaer, Van Droogenbroeck, dan Spruyt di Vrije Universiteit Brussel, diterbitkan pada Jun 2026 dalam International Journal for Educational Integrity. Pasukan itu membina 160 kertas akademik peringkat sarjana, setiap satu sekurang-kurangnya 4,000 patah perkataan: 40 ditulis oleh pelajar sebenar sebelum 2019, 40 dijana sepenuhnya dengan GPT-4o Deep Research, 40 hibrid, dan 40 dijana AI kemudian disengajakan menjadi lebih mirip tulisan manusia. Mereka menjalankan kesemuanya melalui Turnitin, GPTZero, Copyleaks, dan Pangram.
Bagi kertas yang dijana AI sepenuhnya, kajian itu melaporkan bahawa Turnitin, GPTZero, dan Copyleaks "gagal sepenuhnya mengesan kandungan yang dijana AI." Turnitin memberikan skor kepada setiap satu daripada 40 kertas itu antara 0 dan 20 peratus AI; median skor ketiga-tiga alat sedia ada semuanya berada di bawah 20 peratus bagi kertas yang 100 peratus ditulis mesin. Pangram mencapai ketepatan ketat 65 peratus dan ketepatan inklusif 97.5 peratus pada set yang sama, dengan salah mengelaskan satu kertas. Pada set yang telah dihumanisasikan, Pangram mengenal pasti kandungan AI dengan betul dalam 37 daripada 40 kes, iaitu ketepatan ketat 92.5 peratus, manakala GPTZero mencapai 2.5 peratus, Copyleaks 22.5 peratus, dan Turnitin 50 peratus.
| Alat | Kertas AI sepenuhnya (ketepatan ketat) | Kertas AI yang dihumanisasikan (ketepatan ketat) | Kertas manusia yang dikenal pasti dengan betul sebagai bukan AI |
|---|---|---|---|
| Pangram | 65% | 92.5% | 100% |
| Turnitin | 0% | 50% | 100% |
| GPTZero | 0% | 2.5% | 100% |
| Copyleaks | 0% | 22.5% | 100% |
Titik data kedua ialah sebuah kertas kerja oleh Brian Jabarian dan Alex Imas di Chicago Booth, yang diringkaskan dalam Chicago Booth Review pada Disember 2025. Dengan menguji pengesan pada kira-kira 2,000 petikan yang ditulis oleh manusia merentasi enam medium serta versi AI daripada empat model frontier, mereka mendapati kadar positif palsu Pangram pada asasnya sifar merentasi kebanyakan ambang keputusan, dengan ketepatan yang tidak pernah jatuh di bawah 99.8 percent dalam korpus mereka dan negatif palsu antara 2 dan 4 percent bergantung pada model. Para penyelidik mencadangkan agar institusi menerima pakai had dasar yang ketat, contohnya tidak lebih daripada 0.5 percent penulisan manusia ditandakan, sebelum mempercayai mana-mana pengesan secara operasi. Perhatikan perbezaan status: kertas Booth itu ialah kertas kerja, belum lagi melalui semakan rakan sebaya, dan ia menguji teks AI yang tidak diubah suai, bukannya kertas akademik yang telah dimanusiakan.
Positif Palsu dan Siapa yang Terjejas
Positif palsu ialah tempat kerosakan pengesan tertumpu, dan corak yang didokumenkan merentasi industri ini ialah bahawa tanda diletakkan secara tidak seimbang pada penulis bahasa Inggeris bukan penutur asli. Kajian VUB wajar dibaca tepat pada perkara ini: 40 kertas manuskripnya semuanya ditulis oleh penutur bahasa Inggeris bukan asli, dan keempat-empat alat, termasuk Pangram, membersihkan 100 percent daripadanya. Itu ialah hasil yang benar-benar menggalakkan, dan itu juga 40 kertas. Saiz sampel sedemikian tidak dapat mengesahkan kadar seperti 0.004 percent; hanya ujian dalaman vendor sendiri yang jauh lebih besar menghasilkan angka yang setepat itu, dan tiada pihak luar telah menirunya pada skala tersebut.
Seksyen dunia sebenar kajian ini menunjukkan mengapa sikap berhati-hati tetap wujud walaupun penanda arasnya baik. Apabila para penyelidik menjalankan Pangram ke atas 1,163 tesis sarjana sebenar dari 2024 dan 2025, ia menandakan 45.5 peratus daripadanya pada suatu tahap, dengan anggaran median bahagian AI sebanyak 30 peratus dalam kes yang ditandakan, dan tiada kebenaran asas wujud bagi mana-mana tesis tersebut. Para penulis menyatakan dengan terus terang, skor pengesanan berguna sebagai tanda awal dan tidak seharusnya menjadi satu-satunya bukti dalam keputusan berisiko tinggi. Seorang pelajar yang berdepan tuduhan masih memerlukan cara berasaskan proses untuk membuktikan keaslian penulisan, tanpa mengira pengesan mana yang menghasilkan nombor itu.
Humanisasikan kertas anda sendiri
Ubah teks anda yang dibantu AI dan jadikannya kedengaran seperti ditulis manusia, tanpa menyentuh perkataan penting atau sitasi.
Harga dan Akses
Laman Pangram menawarkan 20 semakan percuma sehari selepas mendaftar akaun, dengan langganan berbayar menambah jumlah kredit dan ciri seperti pengesanan plagiarisme. Model akses itu sama pentingnya dengan angka ketepatan: berbeza dengan Turnitin, yang hanya ditemui oleh penulis apabila institusi menjalankannya terhadap mereka, Pangram boleh disemak secara langsung, jadi penulis dapat melihat jenis isyarat yang sama seperti yang mungkin dilihat oleh penilai sebelum apa-apa dihantar.
Tempat Pangram dalam Landskap Pengesan
Ringkasan para penulis VUB tentang bidang ini adalah tegas: "Daripada empat alat pengesanan AI yang dikaji di sini, pada masa ini hanya satu menghasilkan keputusan yang memuaskan." Ayat itu mengatakan banyak perkara tentang pemain sedia ada, dan juga tentang Pangram. Turnitin, alat yang paling banyak benar-benar diandalkan oleh institusi, mendapat skor sifar bagi set yang dijana sepenuhnya oleh AI, dan rekod positif palsu yang didokumenkan secara berasingan telah pun memaksa universiti untuk menilai skornya dengan berhati-hati. Semua alat ini mengukur sifat statistik teks, dan mekanisme asasnya menerangkan kedua-dua sebab pendekatan latihan baharu Pangram boleh mendahului dan sebab setiap satu daripadanya kekal bersifat kebarangkalian.
Penilaian yang jujur: Pangram pada masa ini ialah pengesan yang paling disokong dalam ujian bebas, dengan jurang yang sangat besar, berdasarkan bukti terkini. Bukti itu juga terhad. Dua kajian, satu telah disemak rakan sebaya, satu tidak, kedua-duanya dari tahun lalu, kebanyakannya dalam bahasa Inggeris, kebanyakannya teks akademik dan web bentuk panjang. Pengesanan ialah perlumbaan senjata terhadap model yang berubah setiap suku tahun, dan alat yang mendahului pada 2026 mengekalkan kedudukan itu hanya sehingga generasi teks seterusnya. Skor Pangram ialah anggaran yang ditentukur dengan lebih baik daripada yang dihasilkan oleh pesaingnya. Ia masih merupakan anggaran, bukan bukti tentang apa yang dilakukan oleh mana-mana individu tertentu.
Lihat Perbandingan Penuh
Pangram ialah satu alat dalam bidang yang sesak dan tidak seimbang. Untuk melihat bagaimana alat ini dibandingkan dengan Turnitin, GPTZero, Copyleaks, ZeroGPT, dan yang lain berdasarkan kriteria yang sama, lihat panduan lengkap pengesan AI dibandingkan.
Apa Yang Ditemui Penyelidikan Kami
Dalam kajian persetujuan pengesan TextPulse Research, sembilan pengesan AI komersial menilai 90 teks akademik yang sama. Salah satunya ialah teks hibrid 455 patah perkataan: pembukaan dan penutup tulisan manusia mengapit bahagian tengah 168 patah perkataan janaan AI. Pangram memberi teks ini skor 34% AI, manakala keputusan alat lain terhadap perkataan yang sama berjulat dari 0% hingga 95.7% AI. Kertas penuh, korpus dan matriks skor setiap alat tersedia terbuka di TextPulse Research.

Soalan Lazim
Tuntutan Pangram sendiri ialah ketepatan 99.98 peratus dan kadar positif palsu kira-kira 1 dalam 10,000, diukur pada penanda aras dalaman. Secara luar biasa bagi industri ini, kerja bebas terkini menunjukkan arah yang sama: satu kajian Vrije Universiteit Brussel Jun 2026 yang disemak rakan sebaya mendapati bahawa ia ialah satu-satunya alat daripada empat yang dapat mengesan dengan boleh dipercayai kertas peringkat sarjana yang sepenuhnya dijana AI dan dihumanisasikan, dan satu kertas kerja Chicago Booth mendapati kadar positif palsu hampir sifar pada korpusnya. Bukti bebas itu kukuh tetapi masih baharu dan terhad dari segi skop.
PhD in natural language processing, with years spent building NLP applications end to end. Moe works on text analysis: lexical and syntactic structure, and what separates machine-generated prose from human prose statistically. He has been experimenting with computational linguistics since the early days of NLTK, spaCy and WordNet, and still writes most of his tooling in Python.