AI Detection

Πώς λειτουργεί το GPTZero

Το GPTZero έκανε διάσημα τα perplexity και burstiness, και έπειτα τα απέσυρε αθόρυβα. Εδώ παρουσιάζεται τι μετρά τώρα ο ταξινομητής του, τι δείχνει στην πραγματικότητα μια αναφορά και πού δηλώνει το ίδιο το εργαλείο τα όριά του.

Ενημερώθηκε στις 5 min
Diagram showing how GPTZero works today: a sentence-level AI classifier replacing its original perplexity and burstiness method

Πληκτρολογήστε «how gptzero works» σε μια γραμμή αναζήτησης και το μεγαλύτερο μέρος όσων εμφανίζονται εξακολουθεί να περιγράφει την perplexity και τη burstiness, τις δύο στατιστικές που ο ίδιος ο ιδρυτής του έκανε διάσημες τις πρώτες εβδομάδες μετά την κυκλοφορία του ChatGPT. Η περιγραφή αυτή ήταν ακριβής τον Ιανουάριο του 2023. Δεν ήταν πλέον ακριβής από το φθινόπωρο εκείνης της χρονιάς, όταν η ίδια η τεκμηρίωση του GPTZero λέει ότι η εταιρεία αντικατέστησε εκείνη τη μέθοδο με κάτι εντελώς διαφορετικό. Το χάσμα ανάμεσα σε αυτό που έκανε το εργαλείο κατά την κυκλοφορία και σε αυτό που κάνει τώρα είναι αρκετά μεγάλο ώστε οι περισσότερες εξηγήσεις που κυκλοφορούν ακόμη σήμερα να περιγράφουν ένα προϊόν που δεν υπάρχει πια.

Σήμερα, το GPTZero εκτελεί έναν ταξινομητή ανά πρόταση σε ένα μεγάλο, μικτό σώμα κειμένων που παράγονται από ανθρώπους και από τεχνητή νοημοσύνη, αντί για έναν υπολογισμό perplexity. Το σημερινό GPTZero εξακολουθεί να παρέχει έναν ενιαίο αριθμό τίτλου, αλλά η αριθμητική είναι διαφορετική. Η επισήμανση σε επίπεδο πρότασης κάτω από τον αριθμό τίτλου έχει επίσης διαφορετικό νόημα από ό,τι είχε το 2023. Και οι δύο εκδοχές της ιστορίας αξίζει να είναι γνωστές, η εκδοχή που έκανε τους όρους διάσημους, και η εκδοχή που όντως εκτελείται σήμερα.

GPTZero result screen highly confident a passage is AI generated: 100% AI probability with per-sentence highlighting and an AI vocabulary tab
GPTZero σε μια παράγραφο γραμμένη από AI: μια τελική κρίση σε επίπεδο εγγράφου, επισήμανση ανά πρόταση των προτάσεων που την οδηγούν, και μια λίστα AI-vocab. Η ανάρτηση αναλύει και τις τρεις αυτές βαθμίδες.

Η Ιστορία: Πώς η Perplexity και η Burstiness Έκαναν το GPTZero Διάσημο

Στις 2 Ιανουαρίου 2023, ο τότε φοιτητής του Princeton Edward Tian κυκλοφόρησε μια δημόσια επίδειξη του GPTZero, μόλις λίγες εβδομάδες αφότου κυκλοφόρησε το ChatGPT. Η αρχική σελίδα επεξήγησής του περιγράφει πώς χρησιμοποίησε δύο στατιστικά που δανείστηκε από τη μοντελοποίηση γλώσσας για να ανιχνεύσει πότε ένα γλωσσικό μοντέλο έχει γράψει κάτι. Η Perplexity είναι ένας δείκτης για το πόσο έκπληκτο ήταν ένα μοντέλο αναφοράς από τις επιλογές λέξεων στο κείμενο. Η Burstiness είναι το όνομα του GPTZero για το πόσο αυτή η έκπληξη κυμαινόταν μέσα σε ένα έγγραφο. Αυτές οι σελίδες επεξήγησης είναι ο λόγος που και οι δύο λέξεις μπήκαν καθόλου στην καθημερινή συζήτηση για τη συγγραφή με AI. Οι περισσότεροι άνθρωποι που μπορούν να ορίσουν σήμερα την perplexity ή τη burstiness έμαθαν τους όρους από το GPTZero, όχι από ένα εγχειρίδιο.

Ο ίδιος ο μηχανισμός ήταν απλός ως προς την περιγραφή του. Δώστε ένα απόσπασμα σε ένα μοντέλο γλώσσας αναφοράς, και η πρόζα που το μοντέλο βρίσκει ιδιαίτερα προβλέψιμη, χαμηλή perplexity, διαβάζεται ως τυπική για μηχανή, καθώς η παραγωγή τείνει να ευνοεί την πιθανή επόμενη λέξη έναντι της εκπληκτικής. Η δική του αποσυρθείσα τεκμηρίωση του GPTZero δημοσίευσε μάλιστα έναν εμπειρικό κανόνα: μια βαθμολογία perplexity πάνω από 85 διαβάστηκε ως πιο πιθανό ανθρώπινο παρά μηχανικό. Αυτό το όριο προήλθε από έναν προμηθευτή, σε ένα μοντέλο, σε μια χρονική στιγμή, και το ίδιο το GPTZero δεν το υποστηρίζει πλέον.

Πώς λειτουργεί το GPTZero τώρα: Ένας ταξινομητής σε επίπεδο πρότασης

Το κέντρο υποστήριξης του GPTZero το δηλώνει ευθέως: "Από το φθινόπωρο του 2023, το GPTZero δεν χρησιμοποιεί πλέον perplexity και burstiness για την ανίχνευση AI, επειδή μεταβήκαμε σε αρχιτεκτονική βασισμένη σε βαθιά μάθηση." Η τρέχουσα σελίδα τεχνολογίας του, επιβεβαιώνει ότι η αλλαγή είναι πλήρης. Περιγράφει "μια προσέγγιση βαθιάς μάθησης από άκρο σε άκρο, εκπαιδευμένη σε σύνολα δεδομένων κειμένου από τον ιστό, την εκπαίδευση και την παραγωγή από AI από ένα εύρος LLMs", στην οποία "ένα μοντέλο ταξινόμησης πρόταση προς πρόταση καθορίζει την πιθανότητα και την εμπιστοσύνη ότι ένα κείμενο δημιουργήθηκε από AI". Η perplexity και η burstiness δεν εμφανίζονται πουθενά σε αυτή τη σελίδα.

Από τότε, έχει προστεθεί επίσης ένα επιπλέον επίπεδο άμυνας, ένα Paraphraser Shield, σχεδιασμένο για να εντοπίζει κείμενο τεχνητής νοημοσύνης που έχει περάσει από ένα εργαλείο αναδιατύπωσης με σκοπό την αποφυγή του εντοπισμού. Μπορείτε να επικολλήσετε κείμενο, να ανεβάσετε έγγραφα Word, PDF και αρχεία εικόνας, και έως πενήντα αρχεία κάθε φορά. Όλη αυτή η υποδομή δεν έχει καμία σχέση με το πόσο συχνά ένα μοντέλο αναφοράς θα είχε μαντέψει την ίδια λέξη.

Τι δείχνει πραγματικά μια αναφορά του GPTZero

Ένα αποτέλεσμα του GPTZero περιλαμβάνει τρία μέρη, μια ταξινόμηση τεχνητής νοημοσύνης, ανθρώπινο ή μικτό, ένα ποσοστό που εκφράζει την πιθανότητα του μοντέλου ότι το έγγραφο γράφτηκε από AI, και μια ετικέτα εμπιστοσύνης που περιγράφει πόσο αξιόπιστη είναι αυτή η συγκεκριμένη πρόβλεψη. Η ετικέτα έχει μεγαλύτερη σημασία από ό,τι μπορεί να φαίνεται. Το GPTZero συνδέει το "highly confident" με ποσοστό σφάλματος κάτω από 2 τοις εκατό και το "low confidence" με ποσοστό σφάλματος 14 τοις εκατό ή υψηλότερο, ένα αρκετά ευρύ εύρος ώστε το ίδιο ποσοστό τίτλου να έχει πολύ διαφορετικό βάρος από τη μία αναφορά στην άλλη.

Οι σαρώσεις επί πληρωμή προσθέτουν επισήμανση σε επίπεδο πρότασης, και αξίζει να διαβάζονται σωστά. Το GPTZero περιγράφει τις επισημασμένες προτάσεις ως εκείνες που επηρεάζουν δυσανάλογα τη συνολική βαθμολογία, όχι ως μια λίστα κατηγοριών εναντίον μεμονωμένων γραμμών. Μια πρόταση μπορεί να μην επισημανθεί και παρ' όλα αυτά να έχει διαμορφώσει το αποτέλεσμα, επειδή ο ταξινομητής διαβάζει το έγγραφο ως σύνολο, αντί να ψηφίζει πρόταση προς πρόταση.

Στοιχείο αναφοράςΤι σας λέει
ΤαξινόμησηΜια ενιαία ετικέτα, AI, ανθρώπινο ή μικτό
Βαθμολογία πιθανότητας AIΈνα ποσοστό που αντανακλά το πόσο πιθανό κρίνει το μοντέλο ότι το έγγραφο γράφτηκε από AI
Ετικέτα εμπιστοσύνηςΚυμαίνεται από highly confident, με ποσοστό σφάλματος κάτω από 2 τοις εκατό, έως low confidence, 14 τοις εκατό ή υψηλότερο
Επισήμανση προτάσεωνΕπισημαίνει τις προτάσεις που συμβάλλουν περισσότερο στη βαθμολογία στο Advanced Scan, όχι κάθε πρόταση που συνδέεται με αυτό

Κανένα από αυτά τα στοιχεία της αναφοράς δεν υπήρχε με τη σημερινή του μορφή, όταν ο εξηγητής για perplexity και burstiness ήταν ακόμη η δημόσια περιγραφή του ίδιου του GPTZero. Η διεπαφή άλλαξε μαζί με τη μέθοδο.

Ανθρωποποιήστε τη δική σας εργασία

Μετασχηματίστε το κείμενό σας με τη βοήθεια AI και κάντε το να ακούγεται ανθρώπινο, χωρίς να αγγίξετε σημαντικές λέξεις ή παραπομπές.

Ξεκινήστε δωρεάν

Γιατί η περιγραφή της Perplexity και της Burstiness εξακολουθεί να κυκλοφορεί

Το αρχικό επεξηγηματικό κείμενο του GPTZero παραμένει ακόμη online, παραμένει καταχωρισμένο, και παραμένει μία από τις πιο σαφείς γενικές περιγραφές του πώς λειτουργούν η perplexity και η burstiness ως έννοιες. Οι μηχανές αναζήτησης και άλλοι ιστότοποι εξακολουθούν να το παραπέμπουν, και ορισμένοι παραπέμπουν σε μια ευρέως διαδεδομένη ανασκόπηση του 2026 που ισχυρίζεται ότι το εργαλείο εξακολουθεί να εκτελεί αθόρυβα ένα επίπεδο perplexity και burstiness παράλληλα με τον ταξινομητή του. Οι ίδιες οι τρέχουσες σελίδες του GPTZero, η σελίδα τεχνολογίας και και τα δύο άρθρα υποστήριξης, λένε το αντίθετο: οι όροι αποσύρθηκαν, όχι απλώς κρύφτηκαν στο παρασκήνιο. Μια σελίδα που περιγράφει μια έννοια αφηρημένα δεν είναι το ίδιο με μια σελίδα που περιγράφει τη σημερινή μέθοδο αυτού του εργαλείου, και το να αντιμετωπίζονται τα δύο ως εναλλάξιμα είναι ο βασικότερος λόγος για τον οποίο η σύγχυση έχει διαρκέσει τρία χρόνια μετά την ημερομηνία λήξης της.

Αυτό έχει σημασία πέρα από τα περιττά. Ένας φοιτητής ή συνάδελφος στον οποίο λένε να μειώσει την perplexity ή να απλώσει το μήκος της πρότασης ειδικά για να νικήσει το GPTZero, του δίνεται συμβουλή που απευθύνεται σε μια εκδοχή του προϊόντος που σταμάτησε να λειτουργεί το 2023. Το τι μετακινεί έναν ταξινομητή προτάσεων είναι ένα σχετικό αλλά διαφορετικό ερώτημα, πιο κοντά στη συνολικότερη περιγραφή του πώς λειτουργούν πραγματικά οι ανιχνευτές AI παρά σε οποιαδήποτε από τις δύο στατιστικές από μόνο του. Το GPTZero δεν έχει σταματήσει να τις μετρά, και σύμφωνα με το ίδιο του το σκεπτικό βρίσκονται ανάμεσα σε επτά δείκτες που τροφοδοτούν το τρέχον μοντέλο, αλλά έπαψαν να είναι το στοιχείο που αποφασίζει την απάντηση.

Τι λέει το GPTZero ότι δεν μπορεί να κάνει

Τα δημοσιευμένα benchmarks του GPTZero είναι περίπου τόσο ισχυρά όσο είναι πιθανό να δημοσιεύσει ένας προμηθευτής για το ίδιο του το προϊόν. Η εταιρεία αναφέρει «ποσοστό ακρίβειας 99% κατά τον εντοπισμό κειμένου που δημιουργήθηκε από AI έναντι ανθρώπινης γραφής», λέει «διατηρούμε το ποσοστό ψευδώς θετικών του GPTZero σε όχι περισσότερο από 1% κατά την αξιολόγηση AI έναντι ανθρώπινου κειμένου» και καταγράφει «ποσοστό ακρίβειας 96,5%» σε υποβολές που αναμειγνύουν AI και ανθρώπινη γραφή, μαζί με 1,1 τοις εκατό σε δοκίμια TOEFL, ένα συνηθισμένο υποκατάστατο για γραφή στα Αγγλικά από μη φυσικούς ομιλητές. Αυτά τα στοιχεία προέρχονται από την ίδια αξιολόγηση του GPTZero, που δημοσιεύτηκε τον Ιανουάριο του 2025, χωρίς να παρατίθεται ανεξάρτητη αναπαραγωγή στη σελίδα που τα αναφέρει. Η ίδια σελίδα αποδυναμώνει επίσης τον ισχυρισμό που καταφεύγουν οι περισσότεροι προμηθευτές, δηλώνοντας ότι «δεν πρόκειται ποτέ να υπάρχει εγγύηση 100%» και ότι όποιος ισχυρίζεται το αντίθετο πιθανότατα έχει κάποιο σφάλμα στα δεδομένα του ή στη μέθοδο αξιολόγησής του.

Η σελίδα με τους περιορισμούς του GPTZero είναι πιο συγκεκριμένη από τα στοιχεία μάρκετινγκ. Η εταιρεία αναφέρει ότι η ακρίβεια βελτιώνεται όσο περισσότερο κείμενο υποβάλλεται και μειώνεται σε επίπεδο πρότασης και παραγράφου σε σύγκριση με ολόκληρο το έγγραφο. Δηλώνει ότι τα δεδομένα εκπαίδευσής της είναι κυρίως ενήλικη αγγλική πεζογραφία, άρα το κείμενο που αποκλίνει από αυτό το μοτίβο είναι πιο δύσκολο να ταξινομηθεί με αξιόπιστο τρόπο. Αναφέρει επίσης ότι ο ταξινομητής δεν έχει εκπαιδευτεί για να εντοπίζει κείμενο AI που έχει τροποποιηθεί σε μεγάλο βαθμό μετά τη δημιουργία. Και δηλώνει ευθέως ότι και άλλου τύπου γραφή που παράγεται από μηχανή ή είναι ιδιαίτερα διαδικαστική, όχι μόνο η έξοδος chatbot, μπορεί να επισημανθεί με τον ίδιο τρόπο.

Κανένα από τα παραπάνω δεν είναι λόγος να αντιμετωπίζεται ο αριθμός του GPTZero ως πέρα από κάθε αμφισβήτηση, και δεν είναι ο μόνος ανιχνευτής που αξίζει να κατανοηθεί με τους δικούς του όρους. Οι αναγνώστες που ενδιαφέρονται για το τι πραγματικά «απαντά» ένας ταξινομητής όπως αυτός μπορούν να δουν μια εκδοχή αυτού του μοτίβου οι ίδιοι με έναν δωρεάν έλεγχο perplexity ή έναν δωρεάν έλεγχο burstiness, δύο στοιχεία μιας πιο πλήρους συλλογής δωρεάν εργαλείων που καλύπτει τα υπόλοιπα στατιστικά επίπεδα στα οποία βασίζεται μια αναφορά όπως αυτή.

Οι δύο βασικές στατιστικές του GPTZero έχουν σελίδες αφιερωμένες σε αυτές: τι μετρά η perplexity στην ανίχνευση με AI, και η αριθμητική της πιθανότητας token που παράγει και τους δύο αριθμούς.

Ένα εργαλείο που είναι πρόθυμο να κατονομάσει τις δικές του τυφλές κηλίδες με αυτή την ακρίβεια αξίζει περισσότερη εμπιστοσύνη από ένα που ισχυρίζεται ότι δεν έχει καμία, και το επόμενο ανεξήγητο ποσοστό σε μια αναφορά είναι ένα καλό σημείο για να αρχίσετε να ρωτάτε ποιο είδος εργαλείου το παρήγαγε.

Τι έδειξε η δική μας έρευνα

Στη μελέτη συμφωνίας ανιχνευτών της TextPulse Research, εννέα εμπορικοί ανιχνευτές AI βαθμολόγησαν τα ίδια 90 ακαδημαϊκά κείμενα. Ένα από αυτά ήταν ένα υβριδικό κείμενο 455 λέξεων: ανθρώπινη αρχή και κατακλείδα γύρω από ένα μεσαίο τμήμα 168 λέξεων γραμμένο από AI. Το GPTZero βαθμολόγησε αυτό το κείμενο με 41.2% AI, ενώ οι ετυμηγορίες των υπόλοιπων εργαλείων για τις ίδιες λέξεις κυμάνθηκαν από 0% έως 95.7% AI. Η πλήρης εργασία, το σώμα κειμένων και ο πίνακας βαθμολογιών κάθε εργαλείου είναι ανοικτά διαθέσιμα στο TextPulse Research.

Το GPTZero στο υβριδικό κείμενο από το σώμα κειμένων της μελέτης.
Το GPTZero στο υβριδικό κείμενο από το σώμα κειμένων της μελέτης.
XLinkedInFacebook

Συχνές ερωτήσεις

Όχι. Το κέντρο υποστήριξης του GPTZero αναφέρει ότι η εταιρεία σταμάτησε να χρησιμοποιεί τα perplexity και burstiness για ανίχνευση από το φθινόπωρο του 2023, αφού πέρασε σε έναν ταξινομητή βαθιάς μάθησης. Η τρέχουσα σελίδα τεχνολογίας του περιγράφει ένα μοντέλο ταξινόμησης πρόταση προς πρόταση και δεν αναφέρει κανέναν από τους δύο όρους. Η περιγραφή εξακολουθεί να κυκλοφορεί επειδή ο ίδιος ο οδηγός του GPTZero το 2023 έκανε δημοφιλείς και τις δύο λέξεις πριν αλλάξει η μέθοδος.

Moe

PhD in natural language processing, with years spent building NLP applications end to end. Moe works on text analysis: lexical and syntactic structure, and what separates machine-generated prose from human prose statistically. He has been experimenting with computational linguistics since the early days of NLTK, spaCy and WordNet, and still writes most of his tooling in Python.

Μείνετε ενημερωμένοι για την εξανθρωποποίηση AI

Λάβετε συμβουλές για ακαδημαϊκή γραφή, ανίχνευση AI και εξανθρωποποίηση, απευθείας στο email σας.

Χωρίς ανεπιθύμητα μηνύματα. Κατάργηση εγγραφής οποιαδήποτε στιγμή.