Может ли Turnitin обнаружить ChatGPT? Что он выявляет и что пропускает
Отчет Turnitin об AI-письме и отчет о заимствованиях, это разные продукты с разной аудиторией и разной точностью. Вот что на самом деле измеряет оценка AI, где независимое тестирование показывает ее сбои и почему ваш отчет может не совпадать с отчетом вашего соседа по комнате.
Да, но только для определённого вида использования AI, и внутри отчёта, который большинство студентов никогда не видят. Индикатор AI writing в Turnitin отмечает прозу, которая выглядит статистически типичной для языковой модели, и делает это на растущей доле проверяемых эссе: примерно 15 percent показали 80 percent или более AI-generated writing в период с October 2025 по February 2026, по сравнению с примерно 3 percent, когда инструмент был запущен в April 2023. Будет ли он отмечать именно вашу работу, зависит от деталей, которые большинство ответов на can Turnitin detect ChatGPT пропускают: чем AI report отличается от plagiarism report, кто именно видит этот показатель и как часто этот показатель оказывается неверным.
Этот пост рассматривает механику именно этого продукта, а не academic integrity в целом. В нём изложено, что измеряет AI writing report, что показали независимые тесты в отношении того, что он определяет верно и неверно, и почему два студента, сдающие идентичную работу, могут получить разные результаты в зависимости от того, в каком университете они учатся. Всё это не меняет того, что сказано в вашем собственном course handbook об допустимом использовании AI. Это заменяет догадку о black box описанием того, что на самом деле находится внутри него.
Can Turnitin Detect ChatGPT? Что на самом деле показывает отчёт
AI writing report в Turnitin является отдельным продуктом по отношению к similarity report, который проверяет наличие plagiarism. Они работают на разных моделях и отображаются на разных вкладках в одном и том же интерфейсе. Similarity score рассматривает вашу работу и сравнивает её с базой ранее опубликованных источников и других студенческих работ, чтобы выдать процент совпадения. AI score делает нечто совершенно иное: это classifier, который читает вашу прозу предложение за предложением, присваивая каждому предложению вероятность того, что оно сгенерировано AI, а затем сводит эти оценки на уровне предложений к единому проценту для всего документа. Поскольку они измеряют разные вещи, у работы может быть similarity score 2 percent и AI score 60 percent, или наоборот.
Этот процент на самом деле уже, чем звучит. Это доля допустимой прозаической части, которую модель прогнозирует как написанную AI, а не всего документа, потому что при расчёте оценки они исключают такие элементы, как блоки кода, маркированные списки, заголовки и краткую форму письма. Детектор можно применять только к документам, содержащим не менее 300 слов развёрнутой прозы, и на момент написания это относится только к текстам на английском, испанском и японском языках. Как и следовало ожидать, если сопоставить это с тем, как AI detectors в целом вычисляют эту оценку, картина здесь знакома, числовой показатель на уровне документа, который выглядит точным, строится на более узком фрагменте текста, чем подразумевает заголовочная цифра.
Что определяется как AI: ChatGPT и остальное
Turnitin утверждает, что его классификатор ищет не название бренда, а шаблон письма, и его охват неоднократно расширялся с момента первоначального запуска GPT-3.5 и GPT-4 в 2023 году. В текущих рекомендациях среди систем, против которых он обучен, названы серии GPT-5, Gemini и Claude, при этом новые выпуски моделей добавляются на постоянной основе. Это включает текст, который вообще не касался ChatGPT. Студент, который использовал вместо этого Gemini, Claude или DeepSeek, не обходит детектор просто за счёт выбора другой компании, собственное описание модели у Turnitin прямо указывает, что она не ориентируется на то, какой поставщик создал текст, а только на то, как этот текст читается.
Перефразированный AI-текст получает собственную категорию, а не автоматическое исключение. В документации Turnitin текст, который он считает только сгенерированным AI, отделён от текста, который он считает сгенерированным AI, а затем перефразированным AI, и в августе 2025 года компания добавила обнаружение, нацеленное специально на инструменты AI bypasser, созданные для переписывания машинного вывода так, чтобы он проходил мимо детектора. Это не означает, что перефразирование бесполезно или что каждый переписанный фрагмент будет обнаружен. Это означает, что предположение о том, будто перефразирование по умолчанию невидимо для Turnitin, уже давно устарело.
Насколько точна оценка AI у Turnitin?
Утверждение Turnitin о точности сводится к одному ключевому числу: компания заявляет, что поддерживает уровень ложноположительных срабатываний ниже 1 процента на документах, где помечено более 20 процентов текста. Компания также утверждает, что тестирует каждую новую версию своих моделей на 700,000 академических работах, написанных до появления ChatGPT, чтобы подтвердить эту точность. Это конкретное, поддающееся проверке утверждение о определённом наборе обстоятельств. Его и следует читать именно так. В 2023 году, вскоре после запуска, Turnitin сделала и другие заявления о точности. Главный директор по продукту компании публично признал, что лабораторные испытания не позволяли предсказать, сколько ложноположительных срабатываний появится при реальном использовании, особенно в коротких работах, и сказал, что доля ложноположительных срабатываний в реальных условиях была выше, чем в тестировании. Он сообщил, что уровень ложноположительных срабатываний на уровне предложений составляет около 4 процентов, и отметил, что в результате Turnitin увеличила минимальную длину работ, которые можно оценивать, с 150 до 300 слов. Текущий минимум по-прежнему составляет 300 слов.
Независимое тестирование добавляет детали, которых нет в показателях, заявленных поставщиком. Центр развития преподавания Университета Темпл провёл одно из наиболее тщательных доступных исследований, в том же духе, что и независимое тестирование AI detectors, которое снова и снова выявляет разрыв между лабораторными условиями и реальными работами. Исследователи представили 120 образцов письменных работ, поровну разделённых между полностью человеческим текстом, полностью сгенерированным AI текстом, сгенерированным AI текстом, пропущенным через инструмент для перефразирования, и гибридными текстами, сочетающими вклад человека и AI, и зафиксировали, что возвращала Turnitin для каждого из них. Инструмент правильно определил 93 процента образцов, полностью написанных человеком, и 77 процентов образцов, полностью сгенерированных AI.
В более сложных вопросах точность падала ещё сильнее. Turnitin правильно определил лишь 63 процента перефразированных образцов AI как сгенерированные AI и только 43 процента гибридных образцов как не полностью человеческие и не полностью AI, то есть как категории, наиболее близкие к тому, как на самом деле создаётся текст с помощью AI. Гибридный текст, в частности, представлял интерес для исследователей, потому что, по их мнению, в дальнейшем он, вероятно, будет составлять большую часть, возможно, большинство, реальных работ, поскольку всё больше курсов задают задания, в которых студентам предлагается использовать AI для части работы.
| Что тестировалось | Результат Turnitin |
|---|---|
| Образцы, написанные на 100% человеком | 93% правильно определены как человеческие |
| Образцы, сгенерированные на 100% AI | 77% правильно определены как AI |
| Текст AI, пропущенный через инструмент для перефразирования | 63% правильно определены как AI |
| Гибридные образцы, частично человеческие и частично AI | 43% правильно определены как ни 0%, ни 100% |
| Документы с более чем 20% отмеченного текста, по собственной оценке Turnitin | Уровень ложноположительных срабатываний ниже 1% |
Humanize your own paper
Transform your AI-assisted text and make it sound human, without touching important words or citations.
Где система даёт сбой, даже когда число выглядит верным
Оценка на уровне документа, это не единственное, что может видеть преподаватель, и другой режим просмотра менее надёжен. Некоторые интерфейсы позволяют преподавателю открыть отчёт с пометками, где конкретные предложения выделяются как вероятно написанные AI. Исследователи Temple сопоставили эти выделения с тем, какие предложения в их гибридных образцах действительно были написаны AI, и не обнаружили между ними никакой связи. Это важно, если профессор пересылает вам скриншот выделенного абзаца, а не сводный процент: общий показатель по документу работал значительно лучше, чем выделения на уровне предложений.
Низкие показатели обрабатываются иначе, и теперь к ним относятся осторожнее, чем раньше. С июля 2024 года Turnitin отображает звёздочку вместо числа всякий раз, когда его модель оценивает, что менее 20 процентов документа написано AI, потому что именно в этом диапазоне инструмент с наибольшей вероятностью ошибается в любую сторону. Небольшая правка с помощью AI, когда один абзац переписан с помощью, а остальной текст написан самостоятельно, часто вообще не даёт видимого процента, а не просто даёт маленький процент, и это важно знать, прежде чем считать отсутствие числа доказательством чего-либо.
Кто на самом деле видит число
По умолчанию показатель AI не входит в отчёт, который видит студент. Он находится на отдельной вкладке, доступной преподавателям и администраторам, а студент видит его только если преподаватель решает поделиться отчётом или показать его напрямую. Это реальное структурное отличие от показателя сходства, который студенты обычно могут просматривать сами в той же системе после обработки отправленной работы.
То же самое относится и к тому, существует ли эта функция вообще для конкретного курса, поскольку это институциональное решение, принимаемое отдельно от преподавателя. Администраторы на уровне учётной записи могут включать или отключать AI detection в Turnitin для всего учреждения. Один преподаватель может не иметь возможности включить её, если его университет отключил её, и наоборот. Студент из одного университета, который сдаёт похожую работу другому студенту из другого университета, может столкнуться с совершенно иным опытом использования этого инструмента по причинам, не имеющим никакого отношения к тому, что написал кто-либо из них.
Почему некоторые университеты отключили его
Университет Ватерлоо прекратил использование функции обнаружения AI в Turnitin в сентябре 2025, и его опубликованное обоснование необычно прямолинейно. Университет сослался на документально подтверждённую ненадёжность инструмента, его предвзятость против студентов, для которых английский не является родным языком, а также на собственное внутреннее тестирование, которое включало по меньшей мере один случай полностью написанного человеком текста, оценённого как на 100 percent сгенерированный AI. Сопоставив это с затратами на инструмент, университет пришёл к выводу, что издержки перевешивают преимущества, и вместо этого перенаправил усилия на пересмотр системы оценивания и обучение AI-грамотности.
Ватерлоо является одним из заметных примеров более широкого расхождения, а не исключением. Университеты, которые оставляют эту функцию включённой, как правило, добавляют предохранительные меры, а не рассматривают оценку как самостоятельный вердикт, требуя разговора со студентом до начала каких-либо формальных процедур и воспринимая число как повод начать этот разговор, а не завершить его. Ознакомление с тем, как университеты в более широком смысле подходят к политике в отношении AI, делает эту закономерность более ясной: попадёт ли оценка к вам вообще, зависит от решения, принятого значительно выше уровня вашей семинарской аудитории, а не от фиксированного свойства самой технологии.
Что доказывает и чего не доказывает высокий результат
Высокий показатель AI является свидетельством, а не вердиктом. Сам Turnitin представляет этот процент как один из данных для суждения преподавателя, а не как установление нарушения, и приведённые выше показатели точности объясняют, почему такая формулировка важна: даже оценка на уровне документа, которая работает достаточно хорошо, неверно интерпретирует значимую долю сильно отредактированного, перефразированного или гибридного письма, а выделения на уровне предложений заметно менее надёжны, чем сводный показатель. Всё это не гарантирует, что какой-либо отдельный результат неверен. Это означает, что один процент является поводом задать вопросы, а не выводом, который следует принимать на первый взгляд. Если вы хотите увидеть, где находится ваш собственный текст до того, как его оценит кто-либо ещё, те же шаблоны низкой вариативности и общих формулировок, на которые реагирует классификатор, можно проверить напрямую с помощью free perplexity checker.
AI humanizer for students от TextPulse AI humanizer for students работает на той же статистической основе, и то же самое делает его free burstiness checker для половины этого же измерения, связанной с ритмом предложений. Он даёт вам оценку Human Score, основанную на вашем собственном черновике, а не предсказание того, что скажет о нём Turnitin. Ни один инструмент не может добросовестно обещать это в отношении системы, которой он не управляет. Рассматривайте его как повторное прочтение вашего собственного текста, не более того.
Несколько из этих вопросов имеют собственные страницы. Может ли преподаватель понять, что вы использовали ChatGPT без какого-либо детектора вообще, и более прямой вариант этого вопроса, поймают ли меня, рассматриваются отдельно. То же самое относится к поведению Turnitin в отношении перефразированного текста и к тому, обнаруживает ли Turnitin вывод DeepSeek в частности. Для отдельных контекстов есть материалы о обнаружении AI в программах по сестринскому делу и о том, проводят ли приёмные комиссии колледжей эти проверки. Более широкая постановка вопроса изложена в отдельном материале об академической добросовестности и AI.
Вряд ли что-либо из этого окажется окончательной версией. Turnitin не раз пересматривал свои пороги, правила видимости и охват моделей с 2023 года, и август 2026 года тоже не будет последним словом. Постоянным остаётся полезная привычка, независимо от того, какой детектор использует тот или иной курс: писать с достаточным количеством конкретных, неоднородных, по-настоящему ваших деталей, чтобы то, что в данный момент думает классификатор, оказывалось несущественным.
Frequently Asked Questions
Индикатор AI-письма Turnitin существует именно для ответа на этот вопрос. Может ли Turnitin обнаружить ChatGPT? Обычно да, когда документ содержит значительный объем AI-письма: классификатор отмечает прозу, которая выглядит статистически типичной для языковой модели, и собственные данные Turnitin показывают, что около 15 процентов проверенных эссе теперь получают оценку как в значительной степени написанные AI. Он также регулярно пропускает текст, при этом независимое тестирование показало, что точность снизилась до 63 процентов на перефразированном AI-письме и до 43 процентов на гибридном тексте.
PhD in natural language processing, with years spent building NLP applications end to end. Moe works on text analysis: lexical and syntactic structure, and what separates machine-generated prose from human prose statistically. He has been experimenting with computational linguistics since the early days of NLTK, spaCy and WordNet, and still writes most of his tooling in Python.