AI Detection

Czy Turnitin wykrywa ChatGPT? Co wykrywa, a czego nie

Raport pisania AI Turnitin i raport podobieństwa to różne produkty, przeznaczone dla różnych odbiorców i o różnej skuteczności. Oto, co rzeczywiście mierzy wynik AI, gdzie niezależne testy pokazują jego ograniczenia i dlaczego Twój raport może nie wyglądać tak samo jak raport Twojego współlokatora.

8 min
Illustration answering can Turnitin detect ChatGPT, showing the AI writing report displayed separately from the similarity report

Tak, ale tylko w odniesieniu do określonego rodzaju użycia AI i w obrębie raportu, którego większość studentów nigdy nie widzi. Wskaźnik pisania AI w Turnitin oznacza prozę, która brzmi statystycznie typowo dla modelu językowego, i robi to w rosnącej części sprawdzanych esejów: około 15 procent wykazało 80 procent lub więcej tekstu wygenerowanego przez AI między październikiem 2025 a lutym 2026, wobec około 3 procent w momencie uruchomienia narzędzia w kwietniu 2023. To, czy oznaczy konkretną pracę, zależy od szczegółów, które większość odpowiedzi na pytanie can Turnitin detect ChatGPT pomija: czym raport AI różni się od raportu plagiatu, kto faktycznie widzi wynik i jak często ten wynik okazuje się błędny.

Ten wpis omawia mechanikę tego jednego produktu, a nie integralność akademicką w ogóle. Przedstawia, co mierzy raport pisania AI, co wykazały niezależne testy jako trafne i nietrafne, oraz dlaczego dwoje studentów oddających identyczną pracę może uzyskać różne wyniki w zależności od uczelni, do której uczęszcza. Nic z tego nie zmienia tego, co mówi własny podręcznik kursu o dopuszczalnym użyciu AI. Zastępuje domysł dotyczący czarnej skrzynki opisem tego, co rzeczywiście znajduje się w jej wnętrzu.

Czy Turnitin może wykryć ChatGPT? Co raport rzeczywiście pokazuje

Raport pisania AI w Turnitin jest odrębnym produktem od raportu podobieństwa, który sprawdza plagiat. Działają one na różnych modelach i są wyświetlane na różnych kartach w tym samym interfejsie. Wynik podobieństwa analizuje przesłaną pracę i porównuje ją z bazą wcześniej opublikowanych źródeł oraz innych prac studenckich, aby zwrócić procent zgodności. Wynik AI robi coś zupełnie innego: jest klasyfikatorem, który czyta prozę zdanie po zdaniu, przypisując każdemu zdaniu prawdopodobieństwo bycia wygenerowanym przez AI, a następnie agreguje te wyniki na poziomie zdań do jednego procentu dla całego dokumentu. Ponieważ mierzą różne rzeczy, praca może mieć wynik podobieństwa 2 procent i wynik AI 60 procent albo odwrotnie.

Ten procent jest w rzeczywistości węższy, niż brzmi. Jest to odsetek kwalifikującej się prozy, którą model przewiduje jako napisaną przez AI, a nie cały dokument, ponieważ przy obliczaniu wyniku usuwane są takie elementy jak bloki kodu, wypunktowania, nagłówki i tekst krótki. Detektor można zastosować wyłącznie do dokumentów zawierających co najmniej 300 słów prozy dłuższej formy, a w chwili pisania tego tekstu działa on tylko dla tekstów w języku angielskim, hiszpańskim i japońskim. Jak można się spodziewać, w zestawieniu z tym, jak detektory AI obliczają ten wynik ogólnie, wzorzec jest tu znajomy, liczba na poziomie dokumentu, która wygląda na precyzyjną, opiera się na węższym fragmencie tekstu, niż sugeruje to liczba w nagłówku.

Co jest wykrywane jako AI: ChatGPT i reszta

Turnitin twierdzi, że jego klasyfikator szuka wzorca pisania, a nie nazwy marki, a jego zakres był wielokrotnie rozszerzany od pierwotnego uruchomienia GPT-3.5 i GPT-4 w 2023 roku. Aktualne wytyczne wymieniają serie GPT-5, Gemini i Claude wśród systemów, wobec których jest trenowany, a nowe wersje modeli są dodawane na bieżąco. Obejmuje to tekst, który nigdy nie miał bezpośredniego kontaktu z ChatGPT. Student, który zamiast tego użył Gemini, Claude lub DeepSeek, nie omija detektora tylko dlatego, że wybrał inną firmę, własny opis modelu Turnitin wyraźnie stwierdza, że nie opiera się on na tym, który dostawca wygenerował tekst, lecz wyłącznie na tym, jak tekst brzmi.

Tekst AI po parafrazowaniu otrzymuje własną kategorię, a nie automatyczne przepuszczenie. Dokumentacja Turnitin rozróżnia tekst, który uznaje za wygenerowany przez AI, od tekstu, który uznaje za wygenerowany przez AI, a następnie sparafrazowany przez AI, a w sierpniu 2025 roku dodano wykrywanie ukierunkowane konkretnie na narzędzia omijające AI, zbudowane po to, by przepisywać wynik maszynowy tak, aby przeszedł przez detektor. Nie oznacza to, że parafrazowanie jest bezcelowe albo że każdy przeredagowany fragment zostaje wykryty. Oznacza to, że założenie, iż parafrazowanie jest domyślnie niewidoczne dla Turnitin, jest nieaktualne od pewnego czasu.

Jak dokładny jest wynik AI Turnitin?

Twierdzenie Turnitin dotyczące dokładności sprowadza się do jednej liczby nagłówkowej: firma podaje, że utrzymuje wskaźnik fałszywie dodatnich wyników poniżej 1 percent w dokumentach, w których ponad 20 percent tekstu zostaje oznaczone. Firma twierdzi również, że testuje każdą nową wersję swoich modeli na 700,000 pracach akademickich napisanych przed pojawieniem się ChatGPT, aby zweryfikować tę dokładność. Jest to konkretne, możliwe do sprawdzenia twierdzenie dotyczące określonego zestawu okoliczności. Warto odczytywać je dokładnie w ten sposób. Turnitin wysunęło inne twierdzenia dotyczące dokładności w 2023, krótko po swoim uruchomieniu. Główny dyrektor produktu firmy publicznie przyznał, że testy laboratoryjne nie przewidywały, ile fałszywie dodatnich wyników pojawi się w rzeczywistym użyciu, zwłaszcza w krótkich zgłoszeniach, i powiedział, że odsetek fałszywie dodatnich wyników był w praktyce wyższy niż w testach. Podał, że wskaźnik fałszywie dodatnich wyników na poziomie zdania wynosił około 4 percent, i zauważył, że Turnitin zwiększyło minimalną długość zgłoszeń, które mogą być oceniane, z 150 do 300 słów w rezultacie. Obecne minimum nadal wynosi 300 słów.

Niezależne testy dodają szczegóły, których nie podaje liczba przedstawiana przez dostawcę. Center for the Advancement of Teaching na Temple University przeprowadziło jedno z bardziej starannych dostępnych badań, w tym samym duchu co niezależne testowanie detektorów AI, które konsekwentnie ujawnia rozbieżności między warunkami laboratoryjnymi a rzeczywistymi zgłoszeniami. Badacze przesłali 120 próbek pisemnych, podzielonych równo między teksty całkowicie napisane przez człowieka, teksty całkowicie wygenerowane przez AI, teksty wygenerowane przez AI przepuszczone przez narzędzie parafrazujące oraz teksty hybrydowe łączące wkład człowieka i AI, a następnie odnotowali, co Turnitin zwróciło dla każdej z nich. Narzędzie poprawnie zidentyfikowało 93 percent próbek całkowicie ludzkich oraz 77 percent próbek całkowicie wygenerowanych przez AI.

W trudniejszych pytaniach dokładność spadła jeszcze bardziej. Turnitin poprawnie zidentyfikował jedynie 63 procent próbek AI po parafrazie jako wygenerowane przez AI oraz tylko 43 procent próbek hybrydowych jako ani całkowicie ludzkie, ani całkowicie AI, czyli jako kategorie najbliższe temu, jak w rzeczywistości powstaje tekst wspomagany przez AI. Tekst hybrydowy szczególnie interesował badaczy, ponieważ uważają oni, że prawdopodobnie będzie stanowił dużą część, być może większość, rzeczywistych zgłoszeń w przyszłości, gdy coraz więcej kursów będzie zlecać zadania wymagające od studentów użycia AI do części pracy.

Co testowanoWynik Turnitin
Próbki w 100% napisane przez człowieka93% poprawnie zidentyfikowane jako ludzkie
Próbki w 100% wygenerowane przez AI77% poprawnie zidentyfikowane jako AI
Tekst AI przepuszczony przez narzędzie do parafrazowania63% poprawnie zidentyfikowane jako AI
Próbki hybrydowe, częściowo ludzkie i częściowo AI43% poprawnie zidentyfikowane jako ani 0% ani 100%
Dokumenty z ponad 20% oznaczonych fragmentów (własna wartość Turnitin)Wskaźnik wyników fałszywie dodatnich poniżej 1%

Humanize your own paper

Transform your AI-assisted text and make it sound human, without touching important words or citations.

Get started free

Gdzie to się załamuje, nawet gdy liczba wygląda poprawnie

Wynik na poziomie dokumentu nie jest jedyną rzeczą, którą może zobaczyć prowadzący, a inny widok jest mniej wiarygodny. Niektóre interfejsy pozwalają prowadzącemu otworzyć raport z oznaczeniami, który podświetla konkretne zdania jako prawdopodobnie napisane przez AI. Badacze z Temple sprawdzili te podświetlenia, porównując je ze zdaniami w swoich próbkach hybrydowych, które faktycznie były napisane przez AI, i nie znaleźli żadnego związku między nimi. Ma to znaczenie, jeśli profesor prześle Ci zrzut ekranu z podświetlonym akapitem zamiast procentowego podsumowania, ogólny wynik dokumentu działał znacznie lepiej niż podświetlenia na poziomie zdań.

Niskie wyniki są obsługiwane inaczej, i z większą ostrożnością niż dawniej. Od lipca 2024 roku Turnitin wyświetla gwiazdkę zamiast liczby zawsze wtedy, gdy jego model szacuje, że mniej niż 20 procent dokumentu zostało napisane przez AI, ponieważ właśnie w tym zakresie narzędzie najczęściej myli się w jedną albo drugą stronę. Lekka edycja wspomagana przez AI, jeden akapit przepisany z pomocą, a reszta napisana samodzielnie, często nie daje w ogóle widocznego procentu, zamiast małego, co warto wiedzieć, zanim potraktuje się brak liczby jako dowód czegokolwiek.

Kto faktycznie widzi liczbę

Wynik AI nie jest domyślnie częścią raportu widocznego dla studenta. Znajduje się na osobnej karcie, widocznej dla prowadzących i administratorów, a student widzi go tylko wtedy, gdy prowadzący zdecyduje się udostępnić raport albo pokazać go bezpośrednio. To rzeczywista różnica strukturalna względem wyniku podobieństwa, który studenci zazwyczaj mogą sami zobaczyć w tym samym systemie po przetworzeniu zgłoszenia.

To samo dotyczy tego, czy dana funkcja w ogóle istnieje dla konkretnego kursu, co jest decyzją instytucjonalną, niezależną od prowadzącego. Administratorzy na poziomie konta mogą włączać lub wyłączać wykrywanie AI w Turnitin dla całej instytucji. Jeden wykładowca może nie mieć możliwości włączenia tej funkcji, jeśli jego uniwersytet ją wyłączył, i odwrotnie. Student z jednego uniwersytetu, który oddaje podobną pracę jak inny student z innego uniwersytetu, może mieć zupełnie inne doświadczenie korzystania z tego narzędzia, z powodów, które nie mają nic wspólnego z tym, co którykolwiek z nich napisał.

Dlaczego niektóre uniwersytety wyłączyły tę funkcję

Uniwersytet Waterloo zaprzestał korzystania z funkcji wykrywania AI w Turnitin we wrześniu 2025 roku, a podane przez niego uzasadnienie jest wyjątkowo bezpośrednie. Uniwersytet wskazał na udokumentowaną zawodność narzędzia, jego stronniczość wobec studentów, których pierwszym językiem nie jest angielski, oraz własne testy wewnętrzne, które obejmowały co najmniej jeden przypadek tekstu całkowicie napisanego przez człowieka, ocenionego jako w 100 procentach wygenerowany przez AI. Po zestawieniu tego z kosztem narzędzia uniwersytet uznał, że koszty przewyższają korzyści, i zamiast tego skierował wysiłki na przeprojektowanie oceniania oraz szkolenia z zakresu kompetencji w obszarze AI.

Waterloo jest jednym z widocznych przykładów szerszego podziału, a nie odstępstwem od normy. Uniwersytety, które pozostawiają tę funkcję włączoną, zazwyczaj dodają zabezpieczenia zamiast traktować wynik sam w sobie jako rozstrzygnięcie, wymagając rozmowy ze studentem, zanim rozpocznie się jakiekolwiek formalne postępowanie, i traktując liczbę jako powód do rozpoczęcia tej rozmowy, a nie do jej zamknięcia. Zapoznanie się z tym, jak uniwersytety szerzej podchodzą do polityki dotyczącej AI, wyraźniej pokazuje ten wzorzec: to, czy wynik w ogóle do Ciebie trafi, zależy od decyzji podjętej znacznie wyżej niż poziom Twojego seminarium, a nie od stałej właściwości samej technologii.

Co wysoki wynik dowodzi, a czego nie dowodzi

Wysoki wynik AI jest dowodem, a nie rozstrzygnięciem. Sam Turnitin przedstawia ten procent jako jeden z danych wejściowych do oceny prowadzącego, a nie jako stwierdzenie naruszenia, a podane wyżej wskaźniki trafności wyjaśniają, dlaczego takie ujęcie ma znaczenie: nawet wynik na poziomie całego dokumentu, który działa dość dobrze, błędnie odczytuje istotną część tekstów mocno redagowanych, parafrazowanych lub hybrydowych, a wyróżnienia na poziomie zdań są wyraźnie mniej wiarygodne niż liczba zbiorcza. Nic z tego nie gwarantuje, że jakikolwiek pojedynczy wynik jest błędny. Oznacza to, że jeden procent jest powodem do zadawania pytań, a nie ustaleniem, które należy przyjąć na pierwszy rzut oka. Jeśli chcesz sprawdzić, gdzie znajduje się Twój własny tekst, zanim ktokolwiek inny go oceni, te same wzorce niskiej zmienności i ogólnikowego sformułowania, na które reaguje klasyfikator, można sprawdzić bezpośrednio za pomocą darmowego narzędzia do sprawdzania perplexity.

Humanizator AI TextPulse dla studentów działa na tej samej podstawie statystycznej, podobnie jak jego bezpłatny sprawdzacz burstiness dla połowy tego samego pomiaru dotyczącej rytmu zdań. Daje on szacowany Human Score na podstawie własnego szkicu, a nie prognozę tego, co Turnitin o nim powie. Żadne narzędzie nie może odpowiedzialnie obiecywać czegoś takiego w odniesieniu do systemu, którego nie kontroluje. Traktuj to jako drugą lekturę własnego tekstu, nic więcej.

Kilka z tych pytań ma własne strony. Czy profesor może stwierdzić, że użyto ChatGPT bez żadnego detektora, oraz bardziej bezpośrednia wersja tego pytania, czy zostanę przyłapany, są omówione osobno. Tak samo jest z zachowaniem Turnitin wobec tekstu sparafrazowanego oraz z tym, czy Turnitin wykrywa wynik DeepSeek w szczególności. W odniesieniu do konkretnych kontekstów istnieją teksty o wykrywaniu AI w programach pielęgniarskich oraz o tym, czy biura rekrutacyjne na studia przeprowadzają te kontrole. Szersze ujęcie znajduje się w osobnym tekście o integralności akademickiej i AI.

Nic z tego prawdopodobnie nie będzie wersją ostateczną. Turnitin wielokrotnie od 2023 roku zmieniał swoje progi, zasady widoczności oraz zakres modeli, a sierpień 2026 nie będzie również ostatnim słowem. To, co pozostaje stałe, to nawyk wart zachowania niezależnie od tego, jakiego detektora używa dany kurs, pisz z wystarczającą ilością konkretnych, nierównych, naprawdę własnych szczegółów, tak aby to, co akurat uzna klasyfikator, stało się sprawą drugorzędną.

Frequently Asked Questions

Wskaźnik pisania AI Turnitin istnieje właśnie po to, by odpowiedzieć na to pytanie. Czy Turnitin wykrywa ChatGPT? Zwykle tak, gdy dokument zawiera znaczną ilość tekstu AI, klasyfikator oznacza prozę, która brzmi statystycznie typowo dla modelu językowego, a własne dane Turnitin pokazują, że około 15 procent skanowanych esejów otrzymuje obecnie wysoki wynik wskazujący na tekst napisany przez AI. System regularnie też pomija tekst, a niezależne testy wykazały, że skuteczność spadła do 63 procent w przypadku parafrazowanego tekstu AI i 43 procent w przypadku tekstu hybrydowego.

Moe

PhD in natural language processing, with years spent building NLP applications end to end. Moe works on text analysis: lexical and syntactic structure, and what separates machine-generated prose from human prose statistically. He has been experimenting with computational linguistics since the early days of NLTK, spaCy and WordNet, and still writes most of his tooling in Python.

Czy Turnitin wykrywa ChatGPT? Co naprawdę wykrywa | TextPulse.ai