Turnitin può rilevare ChatGPT? Cosa individua e cosa non vede
Il rapporto di scrittura AI di Turnitin e il suo rapporto di similarità sono prodotti diversi, con destinatari diversi e diversi livelli di accuratezza. Ecco che cosa misura davvero il punteggio AI, dove i test indipendenti mostrano che fallisce e perché il tuo rapporto potrebbe non assomigliare a quello del tuo coinquilino.
Sì, ma solo per un tipo specifico di uso dell'AI, e all'interno di un report che la maggior parte degli studenti non vede mai. L'indicatore di scrittura AI di Turnitin segnala una prosa che appare statisticamente tipica di un modello linguistico, e lo fa su una quota crescente dei saggi che analizza: circa il 15 percento mostrava l'80 percento o più di scrittura generata da AI tra ottobre 2025 e febbraio 2026, rispetto a circa il 3 percento quando lo strumento è stato lanciato nell'aprile 2023. Se segnali o meno il tuo invio specifico dipende da dettagli che la maggior parte delle risposte a can Turnitin detect ChatGPT tralascia: in che cosa il report AI differisce dal report di plagio, chi vede effettivamente il numero e con quale frequenza quel numero si rivela errato.
Questo post esamina la meccanica di quel singolo prodotto, non l'integrità accademica in generale. Spiega che cosa misura il report di scrittura AI, che cosa i test indipendenti hanno riscontrato che rileva correttamente e che cosa rileva in modo errato, e perché due studenti che presentano lo stesso elaborato potrebbero ottenere esiti diversi a seconda dell'università che frequentano. Nulla di ciò modifica quanto afferma il manuale del tuo corso sull'uso accettabile dell'AI. Sostituisce un'ipotesi su una scatola nera con una descrizione di ciò che vi è effettivamente all'interno.
Can Turnitin Detect ChatGPT? Che cosa mostra realmente il report
Il report di scrittura AI di Turnitin è un prodotto separato dal report di similarità che verifica il plagio. Funzionano su modelli diversi e sono visualizzati in schede diverse nella stessa interfaccia. Il punteggio di similarità esamina il tuo elaborato e lo confronta con un database di fonti pubblicate in precedenza e con altri elaborati di studenti per restituire la percentuale che corrisponde. Il punteggio AI fa tutt'altro: è un classificatore che legge la tua prosa frase per frase, assegnando a ciascuna frase una probabilità di essere generata da AI e poi aggregando quei punteggi a livello di frase in una singola percentuale del documento. Poiché misurano cose diverse, un elaborato può avere un punteggio di similarità del 2 percento e un punteggio AI del 60 percento, o viceversa.
Questa percentuale è in realtà più ristretta di quanto sembri. Si tratta della proporzione della prosa idonea che il modello prevede sia stata scritta da AI, non dell'intero documento, perché nel calcolo del punteggio vengono rimossi elementi come blocchi di codice, elenchi puntati, intestazioni e testi brevi. Il rilevatore può essere applicato solo a documenti che contengono almeno 300 parole di prosa estesa, e, al momento in cui scriviamo, è disponibile solo per testi in inglese, spagnolo e giapponese. Come ci si può aspettare, se si affianca a come i rilevatori di AI calcolano quel punteggio in generale, il quadro è familiare: un numero a livello di documento che appare preciso è costruito a partire da una porzione del testo più ristretta di quanto suggerisca la cifra principale.
Cosa viene segnalato come AI: ChatGPT e il resto
Turnitin afferma che il suo classificatore cerca un modello di scrittura piuttosto che un nome di marca, e la sua copertura si è ampliata ripetutamente dal lancio iniziale di GPT-3.5 e GPT-4 nel 2023. Le indicazioni attuali citano la serie GPT-5, Gemini e Claude tra i sistemi contro cui è stato addestrato, con nuove versioni dei modelli aggiunte in modo continuativo. Questo include testi che non hanno mai coinvolto specificamente ChatGPT. Uno studente che abbia usato Gemini, Claude o DeepSeek al posto di ChatGPT non sta aggirando il rilevatore semplicemente scegliendo un'azienda diversa, la descrizione stessa del modello da parte di Turnitin è esplicita nel dire che non si basa sul fornitore che ha prodotto il testo, ma solo su come il testo si presenta.
Il testo AI parafrasato riceve una categoria propria, non un via libera automatico. La documentazione di Turnitin distingue tra testo che giudica generato da AI soltanto e testo che giudica generato da AI e poi parafrasato da AI, e nell'agosto 2025 ha aggiunto un rilevamento mirato specificamente agli strumenti di aggiramento di AI costruiti per riscrivere l'output della macchina in modo da superare un rilevatore. Questo non significa che la parafrasi sia inutile o che ogni passaggio riscritto venga individuato. Significa che l'ipotesi secondo cui la parafrasi sarebbe invisibile a Turnitin per impostazione predefinita è superata da tempo.
Quanto è accurato il punteggio AI di Turnitin?
L'affermazione di accuratezza di Turnitin si riduce a un dato principale: l'azienda dichiara di mantenere un tasso di falsi positivi inferiore all'1 percento nei documenti in cui più del 20 percento del testo viene segnalato. L'azienda afferma inoltre di testare ogni nuova versione dei propri modelli su 700,000 articoli accademici scritti prima che ChatGPT esistesse, per verificare questa accuratezza. Si tratta di un'affermazione specifica, verificabile, relativa a un insieme particolare di circostanze. Vale la pena leggerla esattamente in questi termini. Turnitin ha formulato altre affermazioni sull'accuratezza nel 2023, poco dopo il suo lancio. Il chief product officer dell'azienda ha riconosciuto pubblicamente che i test di laboratorio non prevedevano quanti falsi positivi sarebbero emersi nell'uso reale, soprattutto nelle consegne brevi, e ha affermato che la percentuale di falsi positivi nel mondo reale era più alta che nei test. Ha indicato il tasso di falsi positivi a livello di frase come pari a circa il 4 percento e ha osservato che Turnitin ha aumentato la lunghezza minima delle consegne che possono essere valutate da 150 a 300 parole di conseguenza. La soglia minima attuale è ancora di 300 parole.
I test indipendenti aggiungono dettagli che il dato del fornitore non fornisce. Il Center for the Advancement of Teaching della Temple University ha condotto una delle analisi più accurate disponibili, nello stesso spirito dei test indipendenti dei rilevatori di AI che continuano a mettere in evidenza scarti tra le condizioni di laboratorio e le consegne reali. I ricercatori hanno presentato 120 campioni di scrittura, suddivisi equamente tra scrittura interamente umana, scrittura interamente generata da AI, scrittura generata da AI passata attraverso uno strumento di parafrasi e testi ibridi che combinavano contributi umani e di AI, e hanno registrato ciò che Turnitin restituiva per ciascuno. Lo strumento ha identificato correttamente il 93 percento dei campioni puramente umani e il 77 percento di quelli interamente generati da AI.
Nei quesiti più difficili, l'accuratezza è scesa ancora di più. Turnitin ha identificato correttamente solo il 63 percento dei campioni AI parafrasati come generati da AI e solo il 43 percento dei campioni ibridi come né completamente umani né completamente AI, che sono le categorie più vicine al modo in cui viene effettivamente prodotta la scrittura assistita da AI. Il testo ibrido, in particolare, interessava i ricercatori perché ritengono che probabilmente costituirà una parte importante, forse la maggioranza, delle consegne reali in futuro, man mano che più corsi assegnano compiti che chiedono agli studenti di usare AI per una parte del lavoro.
| Cosa è stato testato | Risultato di Turnitin |
|---|---|
| Campioni scritti al 100% da umani | 93% correttamente identificati come umani |
| Campioni generati al 100% da AI | 77% correttamente identificati come AI |
| Testo AI passato attraverso uno strumento di parafrasi | 63% correttamente identificati come AI |
| Campioni ibridi, in parte umani e in parte AI | 43% correttamente identificati come né 0% né 100% |
| Documenti con oltre il 20% segnalato (dato di Turnitin) | Tasso di falsi positivi inferiore all'1% |
Humanize your own paper
Transform your AI-assisted text and make it sound human, without touching important words or citations.
Dove si rompe anche quando il numero sembra corretto
Il punteggio a livello di documento non è l'unica cosa che un docente può vedere, e l'altra visualizzazione è meno affidabile. Alcune interfacce consentono a un docente di aprire un rapporto di segnalazione che evidenzia frasi specifiche come probabilmente scritte da AI. I ricercatori di Temple hanno confrontato tali evidenziazioni con le frasi dei loro campioni ibridi che erano effettivamente scritte da AI, e non hanno trovato alcuna relazione tra le due cose. Questo è rilevante se un professore ti inoltra uno screenshot di un paragrafo evidenziato invece della percentuale riassuntiva: il punteggio complessivo del documento ha funzionato in modo considerevolmente migliore rispetto alle evidenziazioni a livello di frase.
I punteggi bassi vengono gestiti di nuovo in modo diverso, e con maggiore cautela rispetto al passato. Da luglio 2024, Turnitin mostra un asterisco al posto di un numero ogni volta che il suo modello stima che meno del 20 percento di un documento sia scritto da AI, perché quell'intervallo è quello in cui lo strumento ha più probabilità di sbagliare in entrambe le direzioni. Una lieve revisione assistita da AI, un paragrafo riscritto con aiuto e il resto scritto senza assistenza, spesso non produce alcuna percentuale visibile, piuttosto che una piccola percentuale, ed è utile saperlo prima di considerare l'assenza di un numero come prova di qualcosa.
Chi vede davvero il numero
Il punteggio AI non fa parte, per impostazione predefinita, del report visibile agli studenti. Si trova in una scheda separata, visibile a docenti e amministratori, e uno studente lo vede solo se il docente sceglie di condividere il report o di mostrarlo direttamente. Questa è una reale differenza strutturale rispetto al punteggio di similarità, che gli studenti possono in genere visualizzare autonomamente all'interno dello stesso sistema una volta che un invio è stato elaborato.
Lo stesso vale per il fatto che la funzione esista o meno per un determinato corso, che è una decisione istituzionale oltre che del docente. Gli amministratori a livello di account possono attivare o disattivare il rilevamento AI di Turnitin per un'intera istituzione. Un docente potrebbe non essere in grado di attivarlo se la propria università lo ha disattivato, e viceversa. Uno studente di un'università che consegna un lavoro simile a quello di un altro studente di un'università diversa potrebbe avere un'esperienza molto diversa di questo strumento, per ragioni che non hanno nulla a che vedere con ciò che ha scritto ciascuno di loro.
Perché alcune università lo hanno disattivato
L'Università di Waterloo ha disattivato la funzione di rilevamento AI di Turnitin nel settembre 2025, e la motivazione pubblicata è insolitamente diretta. L'università ha citato l'inaffidabilità documentata dello strumento, il suo pregiudizio contro gli studenti la cui prima lingua non è l'inglese, e i propri test interni, che includevano almeno un caso di testo interamente scritto da esseri umani valutato come 100 percento generato da AI. Valutando questo insieme al costo dello strumento, l'università ha concluso che i costi superavano i benefici e ha invece reindirizzato l'impegno verso la riprogettazione della valutazione e la formazione all'alfabetizzazione sull'AI.
Waterloo è un esempio visibile di una frattura più ampia, non un caso isolato. Le università che mantengono attiva la funzione hanno in generale aggiunto misure di tutela invece di trattare il punteggio come un verdetto autonomo, richiedendo una conversazione con lo studente prima che inizi qualsiasi procedura formale e trattando il numero come un motivo per aprire quella conversazione, non per chiuderla. Approfondire come le università stanno gestendo la politica sull'AI in senso più ampio rende il quadro più chiaro: se un punteggio arriva fino a voi dipende da una decisione presa ben al di sopra della vostra aula seminariale, non da una proprietà fissa della tecnologia stessa.
Cosa dimostra, e cosa non dimostra, un punteggio elevato
Un punteggio AI elevato è una prova, non un verdetto. Lo stesso Turnitin presenta la percentuale come un dato tra altri per il giudizio di un docente, non come una constatazione di scorrettezza, e le cifre di accuratezza sopra spiegano perché questa impostazione conta: anche un punteggio a livello di documento che funziona in modo ragionevole interpreta in modo errato una quota significativa di testi fortemente modificati, parafrasati o ibridi, e le evidenziazioni a livello di frase sono nettamente meno affidabili del numero riassuntivo. Nulla di tutto ciò garantisce che un singolo punteggio sia sbagliato. Significa che una percentuale è un motivo per porre domande, non una constatazione da accettare a prima vista. Se volete vedere dove si colloca il vostro testo prima che qualcun altro lo valuti, gli stessi schemi a bassa variazione e di formulazione generica a cui reagisce un classificatore sono verificabili direttamente con un free perplexity checker.
Il AI humanizer for students di TextPulse funziona sulla stessa base statistica, e lo stesso vale per il suo free burstiness checker per la metà della misurazione relativa al ritmo delle frasi. Ti fornisce un Human Score stimato basato sulla tua bozza, non una previsione di ciò che dirà Turnitin. Nessuno strumento può promettere in modo responsabile una cosa del genere per un sistema che non controlla. Consideralo una seconda lettura della tua scrittura, niente di più.
Alcune di queste domande hanno pagine dedicate. Se un professore può capire che hai usato ChatGPT senza alcun detector, e la versione più diretta della stessa domanda, verrò scoperto, sono trattate separatamente. Lo stesso vale per il comportamento di Turnitin sul testo parafrasato, e per se Turnitin rileva l'output di DeepSeek in particolare. Per contesti specifici ci sono articoli su il rilevamento dell'AI nei programmi di infermieristica e su se gli uffici di ammissione universitaria eseguono questi controlli. L'inquadramento più ampio è trattato in un articolo separato su integrità accademica e AI.
Niente di tutto questo è probabilmente la versione finale. Turnitin ha riscritto più di una volta le sue soglie, le sue regole di visibilità e la copertura dei suoi modelli dal 2023, e anche agosto 2026 non avrà l'ultima parola. Ciò che resta costante è l'abitudine che vale la pena avere, indipendentemente dal detector usato da un dato corso: scrivere con abbastanza dettaglio specifico, irregolare, davvero tuo, da rendere secondario ciò che un classificatore possa pensare.
Frequently Asked Questions
L'indicatore di scrittura AI di Turnitin esiste proprio per rispondere a questa domanda. Turnitin può rilevare ChatGPT? Di solito sì, quando un documento contiene una quantità sostanziale di scrittura AI: il classificatore segnala una prosa che appare statisticamente tipica di un modello linguistico, e i dati di Turnitin mostrano che circa il 15 percento dei saggi scansionati ottiene ora un punteggio di forte scrittura AI. Inoltre, spesso non rileva il testo, e test indipendenti hanno riscontrato che l'accuratezza è scesa al 63 percento sulla scrittura AI parafrasata e al 43 percento sul testo ibrido.
PhD in natural language processing, with years spent building NLP applications end to end. Moe works on text analysis: lexical and syntactic structure, and what separates machine-generated prose from human prose statistically. He has been experimenting with computational linguistics since the early days of NLTK, spaCy and WordNet, and still writes most of his tooling in Python.