AI Detection

GPTZero Nasıl Çalışır

GPTZero perplexity ve burstiness terimlerini ünlü yaptı, sonra ikisini de sessizce bıraktı. İşte sınıflandırıcısının şimdi neyi ölçtüğü, bir raporun gerçekte ne gösterdiği ve aracın kendi sınırlamalarını nerede belirttiği.

Güncellendiği tarih 5 min
Diagram showing how GPTZero works today: a sentence-level AI classifier replacing its original perplexity and burstiness method

"how gptzero works" ifadesini bir arama çubuğuna yazın, geri gelen sonuçların büyük kısmı hâlâ, kurucusunun ChatGPT'nin yayımlanmasının ardından ilk haftalarda meşhur ettiği iki istatistik olan perplexity ve burstiness'i anlatıyor. Bu açıklama Ocak 2023'te doğruydu. O yılın sonbaharından bu yana doğru değildir; GPTZero'nun kendi dokümantasyonu, şirketin bu yöntemi tamamen başka bir şeyle değiştirdiğini söylüyor. Aracın piyasaya sürüldüğünde ne yaptığı ile bugün ne yaptığı arasındaki fark, bugün hâlâ dolaşımda olan açıklamaların çoğunun artık var olmayan bir ürünü tarif edecek kadar geniş.

Bugün, GPTZero bir perplexity hesabı yapmak yerine, insan üretimi ve AI üretimi metinlerden oluşan büyük, karışık bir dernek üzerinde cümle cümle bir sınıflandırıcı çalıştırıyor. Bugünün GPTZero'su hâlâ tek bir manşet sayı sunuyor, ancak aritmetik farklı. Manşet sayı altındaki cümle düzeyindeki vurgulama da 2023'te olduğundan farklı bir anlama geliyor. Hikâyenin iki versiyonunu da bilmeye değer: terimleri meşhur eden versiyon ve bugün gerçekten çalışan versiyon.

GPTZero result screen highly confident a passage is AI generated: 100% AI probability with per-sentence highlighting and an AI vocabulary tab
AI tarafından yazılmış bir paragrafta GPTZero: belge düzeyinde bir hüküm, onu belirleyen cümlelerin cümle cümle vurgulanması ve bir AI-vokab listesi. Bu yazı, üç katmanın tamamını ele alıyor.

Tarihçe: Perplexity ve Burstiness GPTZero'yu Nasıl Meşhur Etti

2 Ocak 2023 tarihinde, o dönem Princeton öğrencisi Edward Tian, ChatGPT çıktıktan sadece birkaç hafta sonra GPTZero'nun kamuya açık bir demosunu yayımladı. Kendi orijinal açıklama sayfası, bir dil modelinin bir metin yazdığını ne zaman tespit ettiğini anlamak için dil modellemeden ödünç alınan iki istatistiği nasıl kullandığını anlatıyor. Perplexity, bir referans modelin metindeki kelime seçimleri karşısında ne kadar şaşırdığının bir puanıdır. Burstiness ise GPTZero'nun, bu şaşırmanın bir doküman boyunca ne kadar dalgalandığına verdiği isimdir. Bu açıklama sayfaları, iki kelimenin yapay zeka yazımı hakkında gündelik konuşmaya girmesinin de nedeni. Bugün perplexity veya burstiness tanımlayabilen çoğu kişi bu terimleri bir ders kitabından değil, GPTZero'dan öğrendi.

Tekniğin kendisini anlatmak ise basitti. Bir pasajı bir referans dil modelinden geçirin ve modelin çok yüksek düzeyde öngörülebilir bulduğu, düşük perplexity gösteren nesir, üretim eğilimi şaşırtıcı olan kelime yerine muhtemel bir sonraki kelimeyi tercih etmeye yöneldiği için makineye özgüymüş gibi okunur. GPTZero'nun emekliye ayrılmış kendi dokümantasyonu bile bir pratik kural yayımladı: 85'in üzerindeki bir perplexity puanı, makineye kıyasla insan olasılığının daha yüksek olduğunu gösterir. Bu eşik, tek bir satıcıdan, tek bir modelde, belirli bir zamanda gelmişti ve GPTZero'nun kendisi artık bunun arkasında durmuyor.

GPTZero Şimdi Nasıl Çalışır: Cümle Düzeyinde Bir Sınıflandırıcı

GPTZero'nun destek merkezi bunu açıkça söylüyor: "2023 sonbaharı itibarıyla, GPTZero yapay zeka tespiti için perplexity ve burstiness kullanmıyor, çünkü derin öğrenmeye dayalı bir mimariye geçtik." mevcut teknoloji sayfası ise geçişin tamamen yapıldığını doğruluyor. "Web'den, eğitimden ve çeşitli LLM'lerden üretilen yapay zekadan metin veri kümeleriyle eğitilmiş, uçtan uca bir derin öğrenme yaklaşımı" ve bu yaklaşım içinde "bir cümle cümle sınıflandırma modeli, bir metnin yapay zeka tarafından oluşturulmuş olma olasılığını ve güvenini belirler" şeklinde anlatıyor. Perplexity ve burstiness, bu sayfada hiçbir yerde geçmiyor.

O zamandan beri, tespit edilmekten kaçınmak için bir yeniden yazma aracı üzerinden geçirilmiş AI metnini yakalamak üzere tasarlanmış bir Paraphraser Shield, yani bir savunma katmanı daha eklendi. Metin yapıştırabilir, Word belgeleri, PDF'ler ve görsel dosyalar yükleyebilirsiniz ve aynı anda en fazla elli dosya işlenebilir. Bu altyapının hiçbiri, bir referans modelinin aynı kelimeyi ne kadar sıklıkla tahmin etmiş olacağını saymakla ilgili değildir.

GPTZero Raporu Tam Olarak Size Ne Gösterir

Bir GPTZero sonucu üç parçadan oluşur: AI, insan ya da karışık şeklinde bir sınıflandırma, belgenin AI tarafından yazılmış olma olasılığını ifade eden bir yüzde ve bu belirli tahminin ne kadar güvenilir olduğunu açıklayan bir güven etiketi. Etiket, göründüğünden daha önemlidir. GPTZero, "yüksek derecede güvenilir" ifadesini yüzde 2'nin altındaki bir hata oranına, "düşük güven" ifadesini ise yüzde 14 veya daha yüksek bir hata oranına bağlar. Bu, aynı manşet yüzdesinin bir rapordan diğerine çok farklı ağırlık taşıyabileceği kadar geniş bir aralıktır.

Ücretli taramalar cümle düzeyinde vurgulama ekler ve bunu doğru okumaya değer. GPTZero, vurgulanan cümleleri, genel skoru orantısız biçimde etkileyen cümleler olarak tanımlar, tek tek satırlara yönelik bir suçlama listesi olarak değil. Bir cümle vurgulanmadan kalabilir ve yine de sonucu şekillendirmiş olabilir, çünkü sınıflandırıcı metni tek tek cümleleri cümle cümle oylamak yerine bir bütün olarak okur.

Rapor öğesiSize ne söyler
SınıflandırmaTek bir etiket: AI, insan ya da karışık
AI olasılık skoruModelin belgeyi AI tarafından yazılmış olarak değerlendirmesinin ne kadar olası olduğunu yansıtan bir yüzde
Güven etiketiYüzde 2'nin altındaki hata oranıyla yüksek derecede güvenilir olandan, yüzde 14 veya daha yüksek hata oranıyla düşük güvene kadar uzanır
Cümle vurgulamaAdvanced Scan üzerinde skora en çok katkı sağlayan cümleleri işaretler, ona bağlı her cümleyi değil

perplexity ve burstiness açıklaması, GPTZero'nun kendisi hakkındaki kamuya açık açıklaması olduğu dönemde bu rapor öğelerinin hiçbiri mevcut değildi. Arayüz, yöntemle birlikte değişti.

Kendi makalenizi insanlaştırın

AI destekli metninizi dönüştürün ve önemli kelimelere ya da atıflara dokunmadan, insan tarafından yazılmış gibi duyulmasını sağlayın.

Ücretsiz başlayın

Perplexity ve Burstiness Açıklaması Neden Hâlâ Dolaşımda

GPTZero'nun orijinal açıklaması hâlâ çevrimiçi, hâlâ dizinlenmiş ve perplexity ile burstiness kavramlarının nasıl işlediğine dair daha anlaşılır genel açıklamalardan biri olmaya devam ediyor. Arama motorları ve diğer siteler onu hâlâ kaynak gösteriyor ve bazıları, aracın sınıflandırıcısına sessizce eşlik eden bir perplexity ve burstiness katmanını hâlâ çalıştırdığını iddia eden yaygın biçimde paylaşılan bir 2026 incelemesine işaret ediyor. GPTZero'nun kendi güncel sayfaları, teknoloji sayfası ve her iki destek makalesi ise bunun tersini söylüyor: terimler yalnızca perde arkasında gizlenmiş değil, emekliye ayrılmış. Soyut düzeyde bir kavramı anlatan bir sayfa, bu aracın günümüzdeki yöntemini anlatan bir sayfa ile aynı değildir ve ikisini birbirinin yerine kullanılabilir saymak, bu karışıklığın son kullanma tarihinden üç yıl sonrasına kadar sürmesinin en büyük nedenidir.

Bu durum sadece önemsiz ayrıntıların ötesinde önemlidir. GPTZero'yu yenmek için özellikle perplexity değerini düşürmesi ya da cümle uzunluğunu yayması söylenen bir öğrenci ya da meslektaşa, 2023 yılında çalışmayı durduran bir ürün sürümüne yönelik tavsiye verilmektedir. Bir cümle sınıflandırıcısının hareket etmesini sağlayan şey, ilgili ama farklı bir sorudur, tek başına herhangi bir istatistiğin ötesinde, AI dedektörleri gerçekte nasıl çalışır şeklindeki daha geniş anlatıma daha yakındır. GPTZero, kendi anlatımına göre onları ölçmeyi bırakmadı, mevcut modelin beslediği yedi göstergeden biri olarak aralarında yer alıyor; ancak yanıtı belirleyen şey olmaktan çıkmışlardır.

GPTZero'nun Yapamadığını Söylediği Şey

GPTZero'nun yayımladığı kıyaslamalar, bir satıcının kendi ürününe ilişkin olarak yayımlamayı muhtemel gördüğü ölçüde güçlüdür. Şirket, "insan yazımı ile karşılaştırıldığında AI tarafından üretilen metni tespit ederken yüzde 99 doğruluk oranı" bildirdiğini, "AI ile insan metnini değerlendirirken GPTZero'nun yanlış pozitif oranını yüzde 1'den fazla olmayacak şekilde tuttuğunu" söylediğini ve AI ile insan yazımını karıştıran başvurularda "yüzde 96,5 doğruluk oranı" kaydettiğini, ayrıca TOEFL denemelerinde yüzde 1,1 olduğunu, bunun da ana dili İngilizce olmayan yazım için yaygın bir ölçüt olduğunu belirtir. Bu sayılar, Ocak 2025'te yayımlanan GPTZero'nun kendi değerlendirmesinden gelir ve bunları bildiren sayfada, bunların bağımsız olarak yeniden üretildiğine dair bir atıf yoktur. Aynı sayfa, çoğu satıcının dayandığı iddiayı da geri çeker, "yüzde 100 garanti asla olmayacak" der ve aksi yönde iddia eden herkesin veri setinde ya da değerlendirme yönteminde muhtemelen bir kusur bulunduğunu belirtir.

GPTZero'nun kendi sınırlılıklar sayfası, pazarlama rakamlarından daha ayrıntılıdır. Şirket, daha fazla metin gönderildikçe doğruluğun arttığını ve tam belgeye kıyasla cümle ve paragraf düzeyinde düştüğünü belirtir. Eğitim verisinin büyük ölçüde yetişkin İngilizce düzyazıdan oluştuğunu, bu kalıptan ayrılan metnin ise güvenilir biçimde sınıflandırılmasının daha zor olduğunu söyler. Sınıflandırıcının, üretimden sonra yoğun biçimde değiştirilmiş AI metnini yakalamak üzere eğitilmediğini belirtir. Ayrıca, yalnızca sohbet botu çıktısı değil, diğer makine tarafından üretilmiş ya da yüksek ölçüde prosedürel yazımın da aynı şekilde işaretlenebileceğini açıkça ifade eder.

Bunların hiçbiri, GPTZero'nun sayısını sorgulanamaz kabul etmek için bir gerekçe değildir ve anlaşılması kendi başına değer taşıyan tek bir tespit aracı da değildir. Okuyucular, bu tür bir sınıflandırıcının gerçekte neye yanıt verdiğini merak ediyorsa, ücretsiz perplexity checker veya ücretsiz burstiness checker ile, kendileri için bu kalıbın bir sürümünü görebilirler. Bu, böyle bir raporun dayandığı diğer istatistiksel katmanları kapsayan daha kapsamlı ücretsiz araçlar koleksiyonu içindeki iki parçadır.

GPTZero'nun iki başlık istatistiğinin her birinin kendine ait sayfaları vardır: AI tespitinde perplexity'nin neyi ölçtüğü ve her iki sayıyı da üreten token probability aritmetiği.

Kendi kör noktalarını bu kadar kesin biçimde adlandırmaya istekli bir araç, hiçbiri olmadığını iddia eden bir araca kıyasla daha fazla güveni hak eder ve bir rapordaki bir sonraki açıklanmamış yüzde, bunu üreten araç türünün hangisi olduğunu sormaya başlamak için iyi bir yerdir.

Kendi Araştırmamız Ne Buldu

TextPulse Research'ün dedektör uyum çalışmasında dokuz ticari yapay zeka dedektörü aynı 90 akademik metni puanladı. Bunlardan biri 455 kelimelik bir hibrit metindi: insan yazımı bir giriş ve kapanış, ortada 168 kelimelik yapay zeka üretimi bir bölüm. GPTZero bu metne 41.2% yapay zeka puanı verdi; diğer araçların aynı kelimeler için verdikleri kararlar ise 0% ile 95.7% arasında dağıldı. Makalenin tamamı, derlem ve araç bazlı puan matrisi TextPulse Research adresinde açık erişimde.

Çalışma derlemindeki hibrit metinde GPTZero.
Çalışma derlemindeki hibrit metinde GPTZero.
XLinkedInFacebook

Sıkça Sorulan Sorular

Hayır. GPTZero'nun destek merkezi, şirketin 2023 sonbaharı itibarıyla tespitte perplexity ve burstiness kullanmayı bıraktığını, bunun yerine derin öğrenme tabanlı bir sınıflandırıcıya geçtiğini belirtir. Mevcut teknoloji sayfası, cümle cümle bir sınıflandırma modelini açıklar ve bu terimlerin hiçbirinden söz etmez. Bu açıklama hâlâ dolaşır, çünkü GPTZero'nun kendi 2023 açıklayıcısı, yöntem değişmeden önce her iki sözcüğü de popülerleştirmişti.

Moe

PhD in natural language processing, with years spent building NLP applications end to end. Moe works on text analysis: lexical and syntactic structure, and what separates machine-generated prose from human prose statistically. He has been experimenting with computational linguistics since the early days of NLTK, spaCy and WordNet, and still writes most of his tooling in Python.

AI insanlaştırma hakkında güncel kalın

Akademik yazım, AI tespiti ve insanlaştırma hakkında ipuçlarını gelen kutunuza alın.

Spam yok. İstediğiniz zaman abonelikten çıkabilirsiniz.