AI Detection

Jak funguje GPTZero

GPTZero proslavil perplexity a burstiness, a pak oba tiše opustil. Zde je, co jeho klasifikátor nyní měří, co vlastně ukazuje zpráva a kde nástroj uvádí svá vlastní omezení.

Aktualizováno dne 5 min
Diagram showing how GPTZero works today: a sentence-level AI classifier replacing its original perplexity and burstiness method

Zadejte do vyhledávacího pole „how gptzero works“ a většina toho, co se vrátí, stále popisuje perplexity a burstiness, dvě statistiky, které si sám zakladatel GPTZero proslavil v prvních týdnech po uvedení ChatGPT. Tento popis byl přesný v lednu 2023. Od té doby už přesný nebyl, na podzim téhož roku, kdy podle vlastních dokumentů GPTZero společnost nahradila tuto metodu něčím zcela jiným. Propast mezi tím, co nástroj dělal při uvedení, a tím, co dělá dnes, je natolik velká, že většina vysvětlení, která se dnes stále šíří, popisuje produkt, který už neexistuje.

Dnes GPTZero provádí klasifikaci věta po větě nad rozsáhlým smíšeným korpusem textů vytvořených lidmi a textů vytvořených umělou inteligencí, nikoli výpočet perplexity. Dnešní GPTZero stále poskytuje jedno číslo v titulku, ale matematika je jiná. Zvýrazňování na úrovni vět pod číslem v titulku má také jiný význam než v roce 2023. Obě verze příběhu stojí za to znát, tu, která proslavila tyto pojmy, i tu, která se skutečně používá dnes.

GPTZero výsledek, obrazovka s vysokou jistotou, že pasáž je vytvořená AI: 100% pravděpodobnost AI, s zvýrazněním po větách a záložkou AI slovní zásoby
GPTZero na odstavci napsaném AI: verdikt na úrovni dokumentu, zvýraznění po větách těch vět, které k němu vedou, a seznam AI slovní zásoby. Příspěvek prochází všechny tři vrstvy.

Historie: Jak Perplexity a Burstiness Učinily GPTZero Slavné

Dne 2. ledna 2023 tehdejší student Princetonu Edward Tian zveřejnil veřejnou ukázku GPTZero, jen několik týdnů poté, co vyšel ChatGPT. Jeho původní vysvětlující stránka popisuje, jak použil dvě statistiky převzaté z modelování jazyka k tomu, aby zjistil, kdy jazykový model napsal něco. Perplexity je skóre, které vyjadřuje, jak moc byl referenční model překvapen volbou slov v textu. Burstiness je název GPTZero pro to, jak výrazně se to překvapení v dokumentu měnilo. Právě tyto vysvětlující stránky jsou důvodem, proč se obě slova vůbec dostala do běžné konverzace o psaní pomocí AI. Většina lidí, kteří dnes dokážou definovat perplexity nebo burstiness, se tyto pojmy naučila z GPTZero, ne z učebnice.

Sám mechanismus bylo snadné popsat. Vložte pasáž do referenčního jazykového modelu a proza, kterou model shledá jako vysoce předvídatelnou, nízká perplexity, se čte jako strojově typická, protože generování má tendenci upřednostňovat pravděpodobné další slovo před tím překvapivým. Vlastní již ukončená dokumentace GPTZero dokonce zveřejnila pravidlo pro orientaci: skóre perplexity nad 85 se jevilo jako pravděpodobnější lidské než strojové. Toto prahové nastavení pocházelo od jednoho dodavatele, na jednom modelu, v jednom časovém okamžiku, a GPTZero se za něj už samo nadále nezaručuje.

Jak GPTZero funguje nyní: Klasifikátor na úrovni věty

Centrum podpory GPTZero to uvádí přímo: „Od podzimu 2023 GPTZero již nepoužívá perplexity a burstiness pro detekci AI, protože jsme přešli na architekturu založenou na hlubokém učení.“ Jeho současná technologická stránka potvrzuje, že přepnutí je kompletní. Popisuje „end-to-end přístup hlubokého učení, trénovaný na textových datových sadách z webu, vzdělávání a AI generovaných z řady LLM“, ve kterém „model klasifikace po větách určuje pravděpodobnost a míru jistoty, že byl text vytvořen pomocí AI“. Perplexity a burstiness se na této stránce nevyskytují nikde.

Od té doby byla přidána další obranná vrstva, Paraphraser Shield, navržená tak, aby zachytila texty AI, které byly spuštěny přes nástroj pro přepis, aby se obešlo odhalení. Můžete vložit text, nahrát Word dokumenty, PDF a obrazové soubory, a to až padesát souborů najednou. Žádná z této infrastruktury nemá nic společného s tím, jak často by referenční model uhodl stejné slovo.

Co vám skutečně ukazuje report GPTZero

Výsledek GPTZero obsahuje tři části: klasifikaci AI, člověk, nebo smíšené, procento vyjadřující pravděpodobnost modelu, že dokument byl napsán pomocí AI, a štítek důvěry, který popisuje, jak spolehlivé je toto konkrétní tvrzení. Štítek je důležitější, než by se mohlo zdát. GPTZero spojuje „vysoce důvěryhodné“ s chybovostí pod 2 procenta a „nízkou důvěrou“ s chybovostí 14 procent nebo vyšší, což je dostatečně široký rozsah na to, aby stejné procento v titulku mohlo nést velmi odlišnou váhu od jednoho reportu k druhému.

Placeny skeny přidávají zvýraznění na úrovni vět, a stojí za to číst je správně. GPTZero popisuje zvýrazněné věty jako ty, které nepoměrně ovlivňují celkové skóre, nikoli jako seznam obvinění proti jednotlivým řádkům. Věta může zůstat nezvýrazněná a přesto formovala výsledek, protože klasifikátor čte dokument jako celek, nikoli hlasuje větu po větě.

Prvky reportuCo vám říkají
KlasifikaceJeden jediný štítek: AI, člověk, nebo smíšené
Skóre pravděpodobnosti AIProcento odrážející, jak pravděpodobně model posuzuje, že dokument byl napsán pomocí AI
Štítek důvěryOd vysoce důvěryhodné, s chybovostí pod 2 procenta, po nízkou důvěru, 14 procent nebo vyšší
Zvýraznění větOznačuje věty, které přispívají nejvíce ke skóre v Advanced Scan, nikoli každou větu, která s ním souvisí

Žádný z těchto prvků reportu neexistoval v současné podobě v době, kdy byl vysvětlující text o perplexity a burstiness ještě veřejným popisem samotného GPTZero. Rozhraní se změnilo spolu s metodou.

Zlidštit vlastní práci

Proměňte svůj text s pomocí AI a nechte ho znít lidsky, aniž byste zasahovali do důležitých slov nebo citací.

Začít zdarma

Proč se popis Perplexity a Burstiness stále šíří dál

Původní vysvětlující text GPTZero je stále online, stále indexovaný a stále patří k srozumitelnějším obecným popisům toho, jak perplexity a burstiness fungují jako pojmy. Vyhledávače a další weby jej stále citují a někteří odkazují na široce sdílenou recenzi z roku 2026, která tvrdí, že nástroj stále tiše běží vrstvu perplexity a burstiness vedle svého klasifikátoru. Současné stránky GPTZero, technologická stránka a oba články podpory uvádějí opak: pojmy byly vyřazeny, nikoli pouze skryté v zákulisí. Stránka popisující pojem v abstraktní rovině není totéž co stránka popisující současnou metodu tohoto nástroje, a zacházet s oběma jako se vzájemně zaměnitelnými je nejspíš hlavní důvod, proč zmatek trvá tři roky po datu jejich vypršení.

To je důležité i mimo drobnosti. Studentovi nebo kolegovi, kterému se doporučí snížit perplexity nebo rozprostřít délku vět tak, aby se tím konkrétně porazilo GPTZero, se podává rada mířená na verzi produktu, která přestala běžet v roce 2023. Co posouvá klasifikátor vět, je související, ale odlišná otázka, blíže k širšímu popisu jak AI detektory skutečně fungují než k jakékoli statistice samotné. GPTZero je podle vlastního tvrzení nepřestalo měřit, podle vlastního účtu se tyto ukazatele nacházejí mezi sedmi indikátory, které napájí současný model, ale přestaly být tím, co rozhoduje o odpovědi.

Co GPTZero říká, že nedokáže

GPTZero's published benchmarks jsou zhruba stejně silné, jako by se prodejce pravděpodobně snažil zveřejnit vlastní benchmarky o svém vlastním produktu. Společnost uvádí „míru přesnosti 99 % při detekci textu generovaného AI oproti lidskému psaní“, říká „udržujeme míru falešně pozitivních výsledků u GPTZero na nejvýše 1 % při vyhodnocování AI oproti lidskému textu“ a zaznamenává „míru přesnosti 96,5 %“ u podání kombinujících AI a lidské psaní, spolu s 1,1 procenta u esejí pro TOEFL, což je běžná zástupná forma pro psaní ne rodilých mluvčích angličtiny. Tato čísla pocházejí z vlastního vyhodnocení GPTZero, zveřejněného v lednu 2025, přičemž na stránce, která je uvádí, není citována žádná nezávislá replikace. Stejná stránka zároveň snižuje tvrzení, na které se většina prodejců odvolává, a uvádí, že „nikdy nebude existovat žádná 100% záruka“ a že kdokoli, kdo tvrdí opak, pravděpodobně má chybu ve svých datech nebo ve své metodě vyhodnocování.

Vlastní stránka s omezeními GPTZero je konkrétnější než marketingové údaje. Společnost uvádí, že přesnost se zlepšuje s tím, jak je odesláno více textu, a klesá na úrovni věty a odstavce ve srovnání s celým dokumentem. Uvádí, že její trénovací data jsou z větší části dospělá anglická próza, takže text, který se od tohoto vzorce odchyluje, je obtížnější spolehlivě klasifikovat. Uvádí také, že klasifikátor není trénován tak, aby zachytával text generovaný AI, který byl po vygenerování výrazně upraven. A uvádí to přímo, že jiný strojově generovaný nebo vysoce procedurální text, nejen výstup chatbota, může být označen stejným způsobem.

Nic z toho není důvod považovat číslo GPTZero za něco, co je mimo jakoukoli pochybnost, a není to ani jediný detektor, který stojí za to pochopit ve vlastních podmínkách. Čtenáři, kteří se zajímají o to, na co takový klasifikátor ve skutečnosti reaguje, si mohou pro sebe prohlédnout verzi tohoto vzorce pomocí bezplatného perplexity checkeru nebo bezplatného burstiness checkeru, tedy dvou částí ucelenější sbírky bezplatných nástrojů, která pokrývá další statistické vrstvy, na nichž je založena zpráva tohoto typu.

Dvě hlavní statistiky GPTZero mají své vlastní stránky: co perplexity měří při detekci AI, a aritmetika tokenové pravděpodobnosti, která vytváří obě tato čísla.

Nástroj, který je ochoten pojmenovat své vlastní slepé skvrny takto přesně, si zaslouží větší důvěru než ten, který tvrdí, že žádné nemá, a další neobjasněné procento v reportu je dobré místo, kde začít se ptát, jaký typ nástroje jej vyprodukoval.

Co zjistil náš vlastní výzkum

Ve studii shody detektorů od TextPulse Research hodnotilo devět komerčních AI detektorů stejných 90 akademických textů. Jedním z nich byl hybridní text o 455 slovech: lidsky psaný začátek a závěr kolem AI generované střední části o 168 slovech. GPTZero ohodnotil tento text na 41.2% AI, zatímco verdikty ostatních nástrojů nad stejnými slovy sahaly od 0% do 95.7% AI. Celá studie, korpus i matice skóre všech nástrojů jsou volně dostupné na TextPulse Research.

GPTZero nad hybridním textem ze studijního korpusu.
GPTZero nad hybridním textem ze studijního korpusu.
XLinkedInFacebook

Často kladené otázky

Ne. Podpůrné centrum GPTZero uvádí, že společnost přestala používat perplexity a burstiness k detekci od podzimu 2023, poté co přešla na klasifikátor založený na hlubokém učení. Jeho současná stránka o technologii popisuje model klasifikace po jednotlivých větách a ani jeden z těchto termínů nezmiňuje. Toto označení stále koluje, protože vlastní vysvětlení GPTZero z roku 2023 zpopularizovalo obě slova ještě před změnou metody.

Moe

PhD in natural language processing, with years spent building NLP applications end to end. Moe works on text analysis: lexical and syntactic structure, and what separates machine-generated prose from human prose statistically. He has been experimenting with computational linguistics since the early days of NLTK, spaCy and WordNet, and still writes most of his tooling in Python.

Zůstaňte v obraze o humanizaci AI

Získejte tipy na akademické psaní, detekci AI a humanizaci doručené do vaší schránky.

Žádný spam. Kdykoli se můžete odhlásit.