AI Detection

Как работает GPTZero

GPTZero сделал perplexity и burstiness известными, а затем тихо отказался от обоих. Вот что его классификатор измеряет сейчас, что на самом деле показывает отчет и где сам инструмент указывает свои ограничения.

Обновлено 5 min
Diagram showing how GPTZero works today: a sentence-level AI classifier replacing its original perplexity and burstiness method

Введите в строку поиска запрос "how gptzero works", и в большинстве результатов по-прежнему описываются perplexity и burstiness, две статистики, которые собственный основатель GPTZero сделал знаменитыми в первые недели после выхода ChatGPT. Это описание было точным в январе 2023 года. С тех пор оно не было точным, начиная с осени того же года, когда в собственной документации GPTZero говорится, что компания заменила этот метод чем-то совершенно иным. Разрыв между тем, что инструмент делал при запуске, и тем, что он делает сейчас, настолько велик, что большинство объяснений, которые до сих пор распространяются сегодня, описывают продукт, которого больше не существует.

Сегодня GPTZero выполняет классификацию по предложениям на основе большого смешанного корпуса текстов, созданных людьми и сгенерированных ИИ, а не вычисляет perplexity. Сегодня GPTZero по-прежнему выдает одно итоговое число, но арифметика иная. Подсветка на уровне предложений под заголовочным числом также имеет другое значение, чем в 2023 году. Обе версии этой истории стоит знать: та, которая сделала термины знаменитыми, и та, которая действительно работает сегодня.

GPTZero результат: высокая уверенность в том, что фрагмент сгенерирован ИИ, 100% вероятность ИИ, с подсветкой по предложениям и вкладкой AI vocabulary
GPTZero на абзаце, написанном ИИ: вердикт на уровне документа, подсветка по предложениям тех фрагментов, которые на это повлияли, и список AI-vocab. В публикации последовательно рассматриваются все три уровня.

История: как perplexity и burstiness сделали GPTZero знаменитым

2 января 2023 года бывший студент Принстона Эдвард Тянь опубликовал публичную демонстрацию GPTZero, всего через несколько недель после выхода ChatGPT. Его оригинальная страница с объяснением описывает, как он использовал две статистики, заимствованные из моделирования языка, чтобы определить, когда языковая модель написала что-то. Perplexity это показатель того, насколько эталонная модель была удивлена выбором слов в тексте. Burstiness это название GPTZero для того, насколько это удивление колебалось по документу. Именно эти страницы с объяснениями стали причиной того, что оба слова вообще вошли в повседневные разговоры об ИИ-написании. Большинство людей, которые сегодня могут определить perplexity или burstiness, узнали эти термины из GPTZero, а не из учебника.

Сам же механизм было просто описать. Пропустите фрагмент через эталонную языковую модель, и проза, которую модель находит высоко предсказуемой, с низким perplexity, читается как типичная для машины, поскольку при генерации обычно выбирается наиболее вероятное следующее слово, а не то, которое вызывает удивление. Собственная вышедшая из употребления документация GPTZero даже опубликовала эмпирическое правило: показатель perplexity выше 85 означает, что текст более вероятно написан человеком, чем машиной. Этот порог был получен одним вендором, на одной модели, в один момент времени, и сам GPTZero больше не поддерживает его.

Как GPTZero Работает Сейчас: Классификатор на Уровне Предложения

Справочный центр GPTZero прямо заявляет: "Начиная с осени 2023 года GPTZero больше не использует perplexity и burstiness для обнаружения ИИ, потому что мы перешли на архитектуру, основанную на глубоком обучении." Его текущая страница о технологии, подтверждает, что переключение является полным. На ней описан "сквозной подход к глубокому обучению, обученный на текстовых наборах данных из веба, образования и ИИ, сгенерированного на основе различных LLM", в котором "модель классификации по предложениям определяет вероятность и уверенность в том, что текст был создан ИИ". Perplexity и burstiness на этой странице не встречаются.

С тех пор также добавили уровень защиты, Paraphraser Shield, созданный для выявления текста ИИ, который был пропущен через инструмент перефразирования, чтобы обойти обнаружение. Вы можете вставлять текст, загружать документы Word, PDF и файлы изображений, а также до пятидесяти файлов за один раз. Вся эта инфраструктура не имеет никакого отношения к подсчету того, как часто опорная модель могла бы угадать то же самое слово.

Что именно показывает отчет GPTZero

Результат GPTZero включает три компонента: классификацию ИИ, человека или смешанного варианта, процент, выражающий вероятность того, что документ был написан ИИ, и метку уверенности, описывающую, насколько надежным является это конкретное предположение. Эта метка важнее, чем может показаться. GPTZero связывает «высокую уверенность» с уровнем ошибки менее 2 процентов и «низкую уверенность» с уровнем ошибки 14 процентов или выше, это достаточно широкий диапазон, при котором один и тот же процент в заголовке может иметь очень разный вес от одного отчета к другому.

Платные сканирования добавляют подсветку на уровне предложений, и ее стоит читать правильно. GPTZero описывает подсвеченные предложения как те, которые непропорционально сильно влияют на общий балл, а не как список обвинений против отдельных строк. Предложение может не быть подсвечено и при этом все равно повлиять на результат, потому что классификатор читает документ целиком, а не «голосует» по предложениям по отдельности.

Элемент отчетаЧто он вам сообщает
КлассификацияОдна метка: ИИ, человек или смешанный вариант
Процент вероятности ИИПроцент, отражающий, насколько вероятно, что модель считает документ написанным ИИ
Метка уверенностиОт высокой уверенности, при уровне ошибки менее 2 процентов, до низкой уверенности, 14 процентов или выше
Подсветка предложенийОтмечает предложения, которые вносят наибольший вклад в балл в Advanced Scan, а не каждое предложение, связанное с ним

Ни один из этих элементов отчета не существовал в своей нынешней форме, когда объяснение perplexity-and-burstiness все еще было публичным описанием GPTZero о самом себе. Интерфейс изменился вместе с методикой.

Очеловечить свою работу

Преобразуйте текст, созданный с помощью AI, и сделайте его более естественным, не затрагивая важные слова или цитаты.

Начать бесплатно

Почему описание Perplexity и Burstiness по-прежнему продолжает распространяться

Оригинальное разъяснение GPTZero по-прежнему находится в сети, по-прежнему индексируется и по-прежнему является одним из более ясных общих описаний того, как perplexity и burstiness работают как понятия. Поисковые системы и другие сайты продолжают на него ссылаться, и некоторые указывают на широко распространенный обзор 2026 года, утверждающий, что инструмент по-прежнему незаметно запускает слой perplexity и burstiness наряду со своим классификатором. Текущие страницы GPTZero, страница о технологии и обе статьи поддержки говорят об обратном: эти термины были прекращены, а не просто скрыты за кулисами. Страница, описывающая концепт в абстрактном виде, не то же самое, что страница, описывающая текущий метод этого инструмента, и рассмотрение этих двух как взаимозаменяемых, это и есть главная причина того, почему путаница сохраняется уже три года после истечения срока.

Это важно не только для любопытства. Студенту или коллеге, которому советуют снизить perplexity или распределить длину предложений, чтобы именно обойти GPTZero, дают рекомендации, направленные на версию продукта, которая перестала работать в 2023 году. То, что изменяет работу классификатора предложений, это связанный, но иной вопрос, ближе к более общему описанию как AI detectors на самом деле работают, чем к любой из статистик по отдельности. Сам GPTZero не прекращал их измерять, по собственному утверждению они входят в число семи индикаторов, подающих данные в текущую модель, но они перестали быть тем, что определяет ответ.

Что GPTZero говорит, что оно не может делать

Опубликованные бенчмарки GPTZero по своей силе примерно так же сильны, как компания-продавец, вероятно, будет публиковать о собственном продукте. Компания сообщает «коэффициент точности 99% при выявлении текста, сгенерированного ИИ, по сравнению с человеческим письмом», заявляет «мы удерживаем уровень ложных срабатываний GPTZero не более чем 1% при оценке ИИ по сравнению с человеческим текстом» и фиксирует «коэффициент точности 96,5%» в заявках, где смешаны ИИ и человеческое письмо, наряду с 1,1 процента на эссе TOEFL, распространенной заменой для письма на английском языке как иностранном. Эти цифры получены из собственной оценки GPTZero, опубликованной в январе 2025 года, при этом на странице, где они приводятся, не указана независимая верификация. На той же странице, однако, отклоняется утверждение, к которому прибегает большинство вендоров, а именно, что «никогда не будет гарантии 100%», и что любой, кто утверждает обратное, вероятно, имеет ошибку в своих данных или в методе оценки.

Собственная страница ограничений GPTZero более конкретна, чем маркетинговые цифры. Компания утверждает, что точность улучшается по мере того, как подается больше текста, и снижается на уровне предложения и абзаца по сравнению с полным документом. Она указывает, что ее обучающие данные в основном представляют собой взрослую англоязычную прозу, поэтому текст, который отклоняется от этого шаблона, труднее классифицировать надежно. Она заявляет, что классификатор не обучен выявлять текст, сгенерированный ИИ, который был существенно изменен после генерации. И она прямо говорит, что другой машинно-сгенерированный или высоко процедурный текст, не только вывод чатбота, может отмечаться тем же образом.

Ни одно из этого не является причиной считать число GPTZero не подлежащим сомнению, и это не единственный детектор, который стоит понимать в собственных терминах. Читатели, которым интересно, на что именно реагирует классификатор такого рода, могут увидеть версию этого шаблона на себе с бесплатным perplexity checker или с бесплатным burstiness checker, двумя элементами более полного сборника бесплатных инструментов, который охватывает другие статистические слои, на которые опирается отчет такого рода.

У двух основных статистик GPTZero есть отдельные страницы: что такое perplexity и что она измеряет при обнаружении ИИ, и арифметика вероятности токена, которая приводит к обоим числам.

Инструмент, который готов называть свои собственные слепые зоны с такой точностью, заслуживает большего доверия, чем тот, который утверждает, что их нет, а следующая необъясненная процентная доля в отчете это хорошее место, чтобы начать спрашивать, какой тип инструмента ее произвел.

Что показало наше собственное исследование

В исследовании согласованности детекторов TextPulse Research девять коммерческих ИИ-детекторов оценили одни и те же 90 академических текстов. Один из них был гибридным текстом из 455 слов: написанные человеком начало и концовка вокруг сгенерированной ИИ средней части из 168 слов. GPTZero оценил этот текст в 41.2% ИИ, тогда как вердикты остальных инструментов по тем же словам разошлись от 0% до 95.7% ИИ. Полная статья, корпус и матрица оценок по каждому инструменту открыто доступны на TextPulse Research.

GPTZero на гибридном тексте из корпуса исследования.
GPTZero на гибридном тексте из корпуса исследования.
XLinkedInFacebook

Часто задаваемые вопросы

Нет. Центр поддержки GPTZero указывает, что компания прекратила использовать perplexity и burstiness для обнаружения с осени 2023 года, после перехода на классификатор глубокого обучения. На текущей странице о технологии описана модель классификации по предложениям, и ни один из этих терминов там не упоминается. Это описание продолжает циркулировать, потому что собственный разбор GPTZero за 2023 год популяризировал оба слова до изменения метода.

Moe

PhD in natural language processing, with years spent building NLP applications end to end. Moe works on text analysis: lexical and syntactic structure, and what separates machine-generated prose from human prose statistically. He has been experimenting with computational linguistics since the early days of NLTK, spaCy and WordNet, and still writes most of his tooling in Python.

Будьте в курсе новостей об очеловечивании AI

Получайте советы по академическому письму, обнаружению AI и очеловечиванию прямо на вашу почту.

Без спама. Отписаться можно в любой момент.