AI Detection

I migliori rilevatori di AI per la scrittura accademica nel 2026: 10 strumenti a confronto

Due di questi dieci rilevatori pubblicano la stessa cifra di accuratezza del 99.98% in evidenza. Uno indica i ricercatori dietro il dato e separa il proprio tasso di falsi positivi per genere. L'altro non nomina alcun test. Dieci strumenti collocati su quattro assi: chi li acquista, cosa dichiarano, quali prove sostengono la dichiarazione e che cosa mostra davvero il report, oltre al modello di tracciamento del processo che potrebbe sostituire del tutto la valutazione.

15 min
AI detectors compared by who each one is sold to and whether a named study sits behind its accuracy figure

Due degli dieci strumenti qui pubblicano lo stesso numero principale: 99.98% di accuratezza. Uno di essi indica i ricercatori e le università che stanno dietro a quel dato e scompone il proprio tasso di falsi positivi per genere di contenuto. L'altro non nomina alcun test. Quel contrasto è la cosa più utile in qualsiasi insieme di rilevatori di AI confrontati fianco a fianco, e continuerà a esserlo anche dopo che ogni prezzo in ciascuna di queste pagine sarà cambiato.

Questa guida confronta i migliori rilevatori di AI per la scrittura accademica nel 2026: Turnitin, GPTZero, Copyleaks, Originality.ai, Pangram, Winston AI, ZeroGPT, Scribbr, Sapling e Compilatio, i dieci che uno studente, un ricercatore, un correttore o un editor ha più probabilità di incontrare. Sono venduti a compratori diversi, hanno prezzi basati su modelli diversi e restituiscono informazioni diverse. Confrontarli solo in base all'accuratezza trascura quasi tutto ciò che decide quale di essi viene usato per il tuo testo e che cosa accade dopo.

Le quattro cose che differiscono davvero

Le pagine di marketing dei rilevatori convergono su un numero e divergono su tutto il resto. Quattro domande separano questi prodotti, e solo una è la percentuale nella homepage.

  • A chi è venduto. Uno strumento con licenza per le istituzioni e mostrato solo agli insegnanti si colloca in una posizione diversa rispetto a uno a cui chiunque può iscriversi in un browser, e la differenza decide chi vede mai un risultato che ti riguarda.
  • Quale dato pubblica. Ogni fornitore qui pubblica una qualche forma di affermazione, da una semplice percentuale a un tasso di falsi positivi citato con quattro cifre.
  • Se dietro quel dato c'è un test nominato. Questo è l'asse che separa in modo più netto i dieci, e quello che nessuna tabella comparativa dei fornitori usa.
  • Che cosa restituisce effettivamente il rapporto. Una percentuale a livello di documento, evidenziazioni a livello di frase, una vista di interpretabilità e un rapporto condivisibile sono quattro oggetti diversi, e un'accusa costruita su uno è una conversazione diversa da un'accusa costruita su un altro.

La terza domanda merita di essere considerata con attenzione. Una percentuale con un'istituzione nominata, un dataset nominato e un metodo dichiarato alle spalle può essere contestata, replicata o disputata. Una percentuale senza nulla alle spalle può solo essere creduta o ignorata, e la credenza non è una base per un'udienza per cattiva condotta. La perplexity, la proprietà statistica su cui si è basata con maggiore forza una generazione precedente di rilevatori, è abbastanza misurabile che un free perplexity checker vi mostrerà come appare nella vostra scrittura, anche se nessun fornitore qui sotto riporta il proprio verdetto come punteggio di perplexity.

La tabella di confronto: a chi è venduto ciascuno, e che cosa afferma

DetectorVenduto aCome si ottiene l'accessoAffermazione principaleTest nominato alla base dell'affermazione
TurnitinDocenti e amministratori presso istituzioni con licenzaSolo licenza istituzionaleTasso di falsi positivi dei documenti inferiore all'1% oltre la soglia del 20%Set di validazione interno di Turnitin, nessuno studio esterno nominato
GPTZeroInsegnanti, studenti, scrittori, reclutatori, editoriRegistrazione diretta, livello gratuito99% di accuratezza, 96.5% sui documenti mistiFa riferimento a RAID, un benchmark di terze parti, e a una partnership con Penn State
CopyleaksIstruzione e impresa, all'interno di Canvas, Blackboard e MoodleRegistrazione diretta e licenza LMSOltre il 99% di accuratezza con un tasso di falsi positivi dello 0.03%Esistono dati indipendenti, lo studio VUB del 2026 riportato sotto
Originality.aiScrittori, editori, marketer, agenzie, impreseRegistrazione diretta, basata su crediti99% di accuratezza sui modelli AI più recentiIl proprio studio di accuratezza più lavori sottoposti a peer review di terze parti
PangramUniversità, scuole e impreseRegistrazione diretta, piani istituzionali e API99.98% di accuratezza, tasso di falsi positivi di 1 su 10,000Uno studio che attribuisce a ricercatori di Chicago Booth e dell'University of Maryland
Winston AIIndividui, team, clienti della certificazione di siti webRegistrazione diretta, basata su crediti99.98% di accuratezza, indicato come l'unico detector a raggiungerlaNessuno nominato
ZeroGPTIndividui, il controllo preliminare senza registrazioneGratuito, 15,000 caratteri, senza accountOltre il 98% nelle valutazioni interneNessuno nominato, la cifra è propria del fornitore
ScribbrStudenti, checker gratuito più livello premiumGratuito nel browser78% dei testi di prova identificati correttamenteConfronto interno di Scribbr, eseguito da Scribbr stesso
SaplingSviluppatori e team di supporto, API-firstRegistrazione diretta, API pubblica, estensione del browserProbabilità AI per fraseNessuno nominato, le recensioni indipendenti non concordano nettamente tra loro
CompilatioIstituzioni europee e studenti, più forte nei sistemi di lingua franceseLicenza istituzionale, oppure acquisto diretto da parte dello studente a partire da 4.99 euroAffidabilità dal 94 al 99%, meno dell'1% di falsi positiviClassificato 2nd su 14 strumenti, Weber-Wulff et al. 2023

Una riga si comporta in modo diverso dalle altre. Turnitin non può essere acquistato dalla persona valutata, non può essere eseguito da lei prima dell’invio e restituisce i risultati a qualcun altro. Compilatio è concesso in licenza alle istituzioni nello stesso modo, ma vende anche agli studenti gli stessi controlli direttamente, quindi è l’unico rilevatore istituzionale che si può eseguire sulla propria bozza in anticipo. Tutti gli altri rilevatori qui sono prodotti che uno studente, un autore o un editor può aprire in un browser e applicare al proprio testo già oggi.

Le affermazioni sull’accuratezza, e quali hanno un test nominato alle spalle

Winston AI e Pangram pubblicano la stessa cifra. Winston afferma di essere "The only AI detector with a 99.98% accuracy rate". La homepage di Pangram afferma: "Detect AI-generated content with 99.98% accuracy. Trusted by universities, schools, and enterprises worldwide." I numeri sono identici. Le prove che li sostengono non lo sono affatto.

Pangram indica la propria fonte. Le sue pagine attribuiscono la statistica a uno studio comparativo di ricercatori della Booth School of Business dell’University of Chicago e della University of Maryland, e pubblicano una ripartizione dei falsi positivi per genere di contenuto. Le pagine di Winston non nominano alcuno studio: nessun dataset, nessuna dimensione del campione, nessun metodo per la cifra del 99.98%. Gli indicatori di credibilità lì sono i badge SOC 2 e GDPR e i loghi della stampa, che parlano della postura di sicurezza e della copertura mediatica, non delle prestazioni di rilevamento. L’analisi completa di ciascuna affermazione si trova nelle recensioni dedicate: Pangram reviewed e Winston AI reviewed.

I numeri più specifici dei dieci sono pubblicati da Turnitin e sono tassi di errore, non tassi di accuratezza: un tasso di falsi positivi del documento inferiore all’1% oltre la soglia del 20%, una probabilità di errore a livello di frase di circa il 4%, e una probabilità dichiarata di non rilevare il 15% del testo AI in un documento, un tasso di mancata rilevazione pubblicato che quasi nessuno cita. How Turnitin's detector works e what its false positive rate means in practice sono trattati separatamente.

GPTZero pubblica un'accuratezza del 99% e fa riferimento a RAID, un benchmark di terze parti, e a una collaborazione di ricerca con Penn State, il che la colloca un gradino sopra un numero nudo e un gradino sotto una citazione. Originality.ai pubblica il 99% sui modelli AI più recenti, citando il proprio studio e lavori di terze parti sottoposti a peer review, e pubblica anche la frase che dovrebbe governare l'intera sezione: "Any AI detector accuracy claim that is not transparently supported by methodology, benchmark data, and independent or reproducible analysis should be viewed skeptically." Applicato in modo uniforme, tale standard pone la stessa domanda a ogni cifra in questa pagina, comprese entrambe le affermazioni del 99.98%. La cifra di ZeroGPT, superiore al 98% nelle valutazioni interne, non ha nemmeno un test nominato alle spalle; la revisione dell'accuratezza di ZeroGPT ricostruisce da dove provenga quel numero. Il 78% di Scribbr è almeno onesto riguardo alla propria scala, anche se il test è dello stesso Scribbr.

Lo stesso standard deve applicarsi ai nostri numeri. TextPulse pubblica tassi di superamento misurati del 92.33% su Turnitin AI, dell'89.12% su Originality.ai e dell'87.91% su GPTZero per il suo humanizer AI accademico. Si tratta di cifre del fornitore ricavate da test del fornitore, esattamente come quelle di Winston e Pangram, e nessuno strumento su entrambi i lati di questo mercato può promettere ciò che un detector riporterà su un documento specifico.

I 10 migliori detector AI per la scrittura accademica

Ogni voce copre le stesse quattro cose: come funziona il motore, che cosa afferma il fornitore, che cosa mostra l'evidenza indipendente e chi usa effettivamente lo strumento. La recensione dedicata collegata da ciascuna sezione entra più nel dettaglio.

1. Turnitin: il valore predefinito istituzionale

Turnitin homepage positioning AI writing detection inside its authentic learning and similarity workflow
Turnitin vende all'istituzione, non allo scrittore: il rilevamento AI arriva integrato nel flusso di lavoro di similarità che i docenti già usano.

L'indicatore di scrittura AI di Turnitin è un classificatore basato su deep learning addestrato su prosa accademica. Suddivide un elaborato in segmenti sovrapposti di poche centinaia di parole, assegna a ciascun segmento un punteggio in base ai modelli statistici del testo generato da un modello e aggrega i risultati nella percentuale del documento che i docenti vedono. Conta come testo qualificante solo la prosa estesa, mentre gli elenchi puntati, le citazioni e i riferimenti sono esclusi.

Turnitin pubblica tassi di errore anziché un tasso di accuratezza: un tasso di falsi positivi del documento inferiore all'1% per gli elaborati sopra la sua soglia del 20%, una probabilità di errore di circa il 4% su una singola frase evidenziata e una probabilità dichiarata di non rilevare il 15% del testo AI in un documento. Lo studio VUB del 2026 è stato più severo dei numeri dello stesso fornitore: Turnitin ha riportato 0% di AI in ciascuna delle 40 tesi interamente generate da AI nel set di test. Rimane l'impostazione predefinita perché è integrato nel flusso di lavoro antiplagio che oltre 16,000 istituzioni già licenziano, secondo il conteggio dello stesso Turnitin, e solo i docenti e gli amministratori vedono il punteggio. È anche lo strumento più ridimensionato in questa pagina: diverse grandi università lo hanno disattivato per timori di falsi positivi, documentati in universities that stopped using Turnitin. How Turnitin detects AI e similarity versus AI score illustrano il funzionamento.

2. GPTZero: il marchio più noto tra gli studenti

GPTZero homepage: AI detector made to preserve what's human, claiming 99% accuracy with 17 million users and 1 million educators
La scala di GPTZero sul lato degli studenti: un livello gratuito, milioni di utenti e una dichiarazione di accuratezza del 99% che rimanda a benchmark di terze parti.

GPTZero è stato lanciato nel gennaio 2023 come un controllore di perplexity e burstiness e da allora ha ricostruito il proprio motore in un classificatore multilivello. Una scansione restituisce un verdetto sul documento, una suddivisione di probabilità tra AI, umano e misto, un evidenziamento per frase dei passaggi che determinano il risultato e un elenco di vocaboli AI. La sua homepage afferma una precisione del 99%, 17 milioni di utenti e 1 milione di educatori; il livello gratuito accetta circa 10,000 caratteri per scansione, e l'azienda pubblica una calibrazione ESL intesa a ridurre i falsi segnali nella scrittura in inglese di non madrelingua.

Sulle prove si colloca a metà campo. Fa riferimento al benchmark RAID di terze parti e a una partnership di ricerca con Penn State, un passo oltre una semplice affermazione, ma nello studio VUB il suo punteggio mediano su tesi generate interamente da AI è rimasto sotto il 20%, con ampie oscillazioni tra i singoli elaborati. È lo strumento che gli studenti usano più spesso per precontrollare le proprie bozze prima della consegna. How GPTZero works illustra il rapporto strato per strato; GPTZero versus Turnitin spiega perché i due non concordano sullo stesso testo.

3. Copyleaks: il rilevatore dentro il tuo LMS

Copyleaks homepage: content integrity and AI detection platform for enterprises and universities
Copyleaks si colloca a monte dell'aula: una piattaforma di integrità per le imprese che raggiunge gli studenti attraverso le integrazioni LMS.

Copyleaks vende il rilevamento AI e il controllo del plagio come un unico prodotto aziendale, integrato in Canvas, Blackboard e Moodle, con la copertura linguistica più ampia tra i dieci: il fornitore elenca più di 30 lingue con modelli di rilevamento per lingua. Una scansione restituisce una percentuale del documento con i passaggi evidenziati. Il fornitore dichiara una precisione superiore al 99% con un tasso di falsi positivi dello 0.03%, e lo scanner gratuito accetta circa 25,000 caratteri.

Il record indipendente è la metà debole del discorso. Nello studio VUB, Copyleaks non ha classificato come interamente scritto da AI nemmeno uno dei 40 elaborati completamente generati da AI, ne ha segnalati solo 10 su 40 anche solo in parte, e ha mantenuto una mediana della quota di AI riportata sotto il 20% su testi che erano generati al 100% da macchina. Ha però riconosciuto correttamente tutti i 40 testi scritti da esseri umani, ciascuno da parte di uno studente non madrelingua inglese, il che costituisce una prova reale a suo favore per quanto riguarda i falsi positivi. La recensione di Copyleaks presenta il quadro completo.

4. Originality.ai: costruito per gli editori, non per le aule

Pagina del rilevatore AI gratuito di Originality.ai con il cursore regolabile per la tolleranza all'AI e tre scansioni gratuite al giorno
La calibrazione di Originality.ai è regolabile per progettazione: un cursore per la tolleranza all'AI, pensato per redattori che controllano testi piuttosto che per commissioni disciplinari.

Originality.ai serve editori, agenzie SEO e team di contenuti che controllano testi freelance, e ogni scelta progettuale deriva da questo acquirente: prezzi basati su crediti, con un credito ogni 100 parole, un'API, un'estensione per Chrome, componenti aggiuntivi per il plagio e il fact-checking, e un cursore regolabile per la tolleranza all'AI che consente a un redattore di stabilire quanta parte di testo assistito da AI sia accettabile. Riaddestra i propri modelli di rilevamento per ogni nuova generazione di modelli linguistici e dichiara un'accuratezza del 99% sui più recenti, citando un proprio studio e lavori sottoposti a peer review di terzi.

Si comporta in modo rispettabile nei test indipendenti, tra gli strumenti commerciali più forti nel benchmark RAID, e la sua calibrazione è deliberatamente aggressiva: preferisce segnalare eccessivamente piuttosto che non segnalare abbastanza. Questo è il compromesso giusto per un editore e quello sbagliato per una commissione disciplinare, ed è la cosa singola più importante da capire quando il suo punteggio di pre-controllo non coincide con ciò che mostra in seguito uno strumento universitario. Originality.ai versus Turnitin mappa questo divario.

5. Pangram: quello che gli studi indipendenti continuano a favorire

Homepage di Pangram: un rilevatore di AI che funziona davvero, con una dichiarazione di accuratezza del 99.98% attribuita a ricercatori dell'University of Maryland e della University of Chicago
Pangram si distingue per ciò che alla maggior parte dei fornitori manca: una verifica di terze parti attribuita a ricercatori universitari nominati.

Pangram è lo strumento più recente qui e quello che i ricercatori continuano a convalidare. Il suo classificatore è stato addestrato specificamente per mantenere i falsi positivi prossimi allo zero, e il suo report include una vista di interpretabilità che mostra quali frasi hanno determinato il verdetto. Le funzionalità coprono più di 20 lingue, il caricamento di file con OCR, un'estensione del browser e un'integrazione con Google Docs, il livello gratuito analizza fino a 2,000 parole al giorno. Il fornitore dichiara un'accuratezza del 99.98% e un tasso di falsi positivi di 1 su 10,000, pubblicati con una ripartizione per genere.

In modo insolito, le prove indipendenti indicano la stessa direzione del marketing. Lo studio VUB del 2026 ha rilevato che era l'unico strumento dei quattro testati il cui punteggio mediano su tesi generate interamente da AI si avvicinava al valore reale, ed era il più vicino all'allineamento su elaborati ibridi e umanizzati. Il working paper NBER di ricercatori di Chicago Booth e Maryland ha rilevato che era l'unico rilevatore capace di mantenere i falsi positivi a o sotto lo 0.5% restando forte sul testo riscritto. Entrambi gli studi sono recenti e limitati per ambito, ma nessun altro strumento in questa pagina ha così tante prove attuali a suo favore. La recensione di Pangram esamina entrambi gli studi in dettaglio.

6. Winston AI: la dichiarazione più grande, le prove minori

Homepage di Winston AI: il rilevatore di AI più affidabile, con un badge di accuratezza del 99.98% e 10 million utenti
Il badge del 99.98% di Winston compare nella homepage, ma non vi è alcuno studio esterno nominato a sostenerlo.

Winston AI è un rilevatore basato su crediti, rivolto a docenti e team di contenuti. Il suo insieme di funzioni è pratico: una mappa di calore per frase, OCR che legge pagine fotografate e manoscritte, un componente aggiuntivo per il plagio e un'integrazione con Google Classroom. La homepage afferma un'accuratezza del 99.98% e più di 10 million users; il dato sull'accuratezza deriva da test interni, e sul sito non è pubblicata alcuna metodologia, alcun dataset né alcuna dimensione del campione.

Il miglior punto di riferimento indipendente è il benchmark RAID (ACL 2024), dove Winston ha rilevato complessivamente il 71% di testo AI a un tasso fisso di falsi positivi del 5%: eccellente sull'output in stile ChatGPT al 99.6%, molto più debole sui modelli più vecchi e open-source, e fino al 52.6% sul testo parafrasato. Uno strumento competente con un titolo gonfiato. La recensione di Winston AI esamina il claim in dettaglio.

7. ZeroGPT: il pre-controllo gratuito

Rilevatore della homepage di ZeroGPT con un input gratuito di 15,000 caratteri e nessuna registrazione richiesta
La proposta di ZeroGPT è un volume senza attriti: 15,000 caratteri, nessun account e il record di evidenze più debole tra i dieci.

ZeroGPT è il pre-controllo gratuito con il traffico più alto: incolla fino a 15,000 caratteri senza account e ottieni subito una percentuale più frasi evidenziate da quella che definisce tecnologia DeepAnalyse. Il fornitore afferma un'accuratezza superiore al 98% nelle valutazioni interne e non cita alcun test esterno. I confronti indipendenti lo collocano costantemente vicino al fondo del settore commerciale, e il suo punteggio sullo stesso testo può oscillare tra una prova e l'altra. Come prima lettura approssimativa è innocuo, come verdetto è lo strumento meno difendibile di questa pagina. La recensione sull'accuratezza di ZeroGPT rintraccia le sue affermazioni fino alle fonti.

8. Scribbr: il marchio affidabile con un motore in licenza

Scribbr free AI detector scoring an academic paragraph 100% AI-generated, with the QuillBot engine version visible in the result panel
Il checker di Scribbr in azione, il tag della versione QuillBot nel pannello dei risultati è il dettaglio della famiglia aziendale che il marketing non mette in primo piano.

Il checker AI di Scribbr è il motore di rilevamento QuillBot sotto il marchio Scribbr: il pannello dei risultati mostra la versione del motore, e la pagina about di Scribbr colloca entrambe le aziende nella famiglia Learneo. Il livello gratuito analizza circa 1,200 parole nel browser senza registrazione e riporta una suddivisione in tre parti tra AI-generated, AI-refined e human-written. Nella comparazione di luglio 2026 di Scribbr, il checker gratuito ha identificato il 78% dei testi di prova e la versione premium l'84%, con zero falsi positivi in quel campione.

Questi sono i migliori numeri pubblicati nel livello gratuito, e provengono da un test che Scribbr ha progettato, eseguito e valutato autonomamente, in cui il proprio consociato aziendale è arrivato a pari merito al primo posto. Gli studenti si fidano del checker perché le guide di Scribbr sulle citazioni e sulla tesi hanno guadagnato quella fiducia, e il detector la eredita. La recensione di Scribbr illustra che cosa misurano davvero il gratuito e il premium.

9. Sapling: lo strumento per sviluppatori

Sapling AI detector output highlighting AI sentences in red with a fake probability of 73.6%
La vista di Sapling per frase, con evidenziazione in rosso e una probabilità del documento, pensata per il triage nei flussi di lavoro industriali.

Il detector di Sapling proviene da un'azienda NLP il cui principale business è l'assistenza alla scrittura per i team di customer-support, e questo si vede: l'API più accessibile del gruppo, punteggi di probabilità per frase con una vista di perplexity, e un'estensione del browser che analizza il testo dentro Google Docs, Gmail, Zendesk e Salesforce. I controlli gratuiti hanno un limite di 2,000 caratteri, i piani a pagamento aumentano il limite a 100,000.

Il suo record indipendente è il più volatile dei dieci: 68% con zero falsi positivi nel confronto di Scribbr, quasi fallimenti totali in un benchmark arXiv del 2023, e almeno una recensione pratica che lo ha visto segnalare tutto come falso. I punteggi di una singola recensione si generalizzano male per ogni detector, e Sapling ne è la dimostrazione più chiara. La recensione di Sapling spiega perché.

10. Compilatio: la controparte istituzionale europea

Homepage di Compilatio: rilevare contenuti AI con Compilatio, controllo antiplagio e detector AI per istituzioni europee
La proposta di Compilatio rispecchia quella di Turnitin, rivolta a docenti e istituzioni nei sistemi francesi e, più in generale, europei.

Compilatio è la suite per plagio e AI che le istituzioni europee licenziano laddove le rassegne centrate sugli Stati Uniti danno per scontato Turnitin: la più forte nei sistemi francofoni, con il rilevamento AI integrato nello stesso flusso di lavoro rivolto ai docenti del controllo di similarità, e una versione per studenti che vende gli stessi controlli a credito. Dichiara un tasso di affidabilità del 94 to 99% e meno dell'1% di falsi positivi, ed è l'unico strumento qui, oltre a Turnitin, a collocarsi vicino alla vetta di un test sottoposto a peer review, secondo su quattordici in Weber-Wulff e colleghe. Se studi nell'UE, il detector che legge la tua tesi potrebbe benissimo essere questo. La recensione di Compilatio illustra che cosa tale posizionamento stabilisce e che cosa non stabilisce.

Umanizza il tuo articolo

Trasforma il tuo testo assistito dall'AI e fallo suonare umano, senza toccare parole importanti o citazioni.

Inizia gratis

iThenticate: il detector sulla scrivania dell'editore

Un altro prodotto Turnitin merita una sezione qui, perché la maggior parte dei ricercatori lo incontra senza mai vederlo. iThenticate è lo strumento di screening di Turnitin per editori, riviste e istituzioni di ricerca, pensato per controllare i manoscritti prima della pubblicazione piuttosto che per valutare i compiti accademici. La sua proposta è pubblicare con fiducia: sottoporre a screening un documento ad alto rischio per individuare un possibile illecito prima che venga diffuso. Migliaia di riviste accademiche fanno passare le sottomissioni attraverso questo strumento tramite il servizio Similarity Check di Crossref, quindi, se hai inviato un manoscritto a una rivista peer-reviewed, è probabile che il tuo manoscritto sia passato attraverso iThenticate, indipendentemente dal fatto che qualcuno te lo abbia detto o meno.

iThenticate homepage for publishers and researchers: publish with confidence by screening high-stakes documents for potential misconduct before publication, with log in and buy credits buttons
iThenticate vende lo screening pre-pubblicazione con crediti acquistati per documento, l'unico strumento della famiglia Turnitin che un autore può usare senza un'istituzione.

Due aspetti lo distinguono dalla riga Turnitin sopra. È orientato al documento piuttosto che al corso: niente classi, niente compiti, un solo report per manoscritto. E, a differenza di Turnitin, può essere acquistato dalla persona che viene valutata. I crediti sono venduti direttamente sul sito, con prezzo per documento, il che lo rende l'unico strumento della famiglia Turnitin che un autore può eseguire sul proprio manoscritto prima che lo faccia una rivista. Il report è anzitutto un similarity report, che confronta il testo con la letteratura pubblicata e con il web, e Turnitin elenca iThenticate tra i prodotti che includono il suo rilevamento della scrittura AI per i clienti idonei.

Per uno scrittore accademico, l’uso pratico è ristretto e concreto: un controllo di originalità prima dell’invio sul manoscritto finale, eseguito dalla stessa azienda i cui strumenti è probabile che la rivista utilizzi. Ciò che il rapporto non fa è correggere nulla. Segnala sovrapposizioni e probabile scrittura AI, e la revisione della prosa segnalata resta comunque compito tuo, che è la metà della checklist di invio per cui è stato progettato un academic AI humanizer.

Cosa dice la ricerca indipendente sulla categoria

I dati dei fornitori si concentrano intorno al 99%. La ricerca pubblicata no. Weber-Wulff e colleghi hanno testato 14 sistemi nell’International Journal for Educational Integrity nel 2023, tra cui Turnitin, e Liang e colleghi hanno rilevato in Patterns nello stesso anno che 89 dei 91 saggi TOEFL di parlanti non nativi di inglese, il 97.8% di essi, sono stati segnalati come AI da almeno uno di sette rilevatori, con 18 segnalati da tutti e sette.

Il test accademico più diretto degli strumenti sopra è lo studio VUB del 2026, pubblicato ad accesso aperto nell’International Journal for Educational Integrity: tesi di master reali, quattro rilevatori commerciali e mediane inferiori al 20% su elaborati interamente generati da AI per tre dei quattro. Jabarian e Imas, nel working paper NBER w34223, hanno costruito un corpus di 1,992 testi umani pre-2020 e 1,992 testi AI da quattro modelli frontier e hanno sottoposto a stress test Pangram, GPTZero, Originality.ai e una baseline open-source: i rilevatori commerciali hanno superato la baseline, e solo uno strumento ha mantenuto un tasso di falsi positivi pari o inferiore allo 0.5% restando solido anche sul testo riscritto. La baseline open-source ha segnalato tra il 30% e il 69% del testo umano, motivo per cui i rilevatori gratuiti su GitHub non compaiono nella tabella sopra.

OpenAI ha ritirato il proprio AI Text Classifier il 20 luglio 2023, dichiarando che "non era più disponibile a causa del suo basso tasso di accuratezza". Giray, Roe ed Espiritu, pubblicando su English Teaching: Practice & Critique nel marzo 2026, hanno formulato chiaramente il problema dell'equità: "Questi strumenti segnalano in modo sproporzionato la scrittura autentica degli studenti multilingui, creando un effetto raggelante che, paradossalmente, incoraggia l'uso dell'AI per evitare accuse false." Il modello alla base di questo risultato è documentato in come i detector trattano la scrittura in inglese di parlanti non nativi.

Le istituzioni hanno agito in risposta al record di falsi positivi. Vanderbilt ha disattivato il detector AI di Turnitin nell'agosto 2023, ritenendo che, rispetto ai 75,000 elaborati da essa presentati nel 2022, un tasso di falsi positivi dell'1% implichi circa 750 elaborati etichettati in modo errato. La documentazione di Michigan State afferma che gli strumenti di rilevazione dell'AI non dovrebbero essere l'unica base per un'azione sfavorevole nei confronti di uno studente, e la University of Texas at Austin non approva affatto i software di rilevazione dell'AI. Quanto siano accurati in realtà i detector AI, come categoria, è una questione distinta da quale di essi la vostra istituzione conceda in licenza.

Il modello che aggira la valutazione: il tracciamento del processo

Una risposta diversa al problema dei falsi positivi sta suscitando interesse istituzionale: smettere di valutare il testo finito e registrare invece come il documento è stato scritto. La funzione Authorship di Grammarly e la piattaforma di valutazione Cadmus funzionano entrambe in questo modo, acquisendo il processo di scrittura, la digitazione, l'incolla, la cronologia delle revisioni, mentre avvengono. Un registro del processo non può produrre un falso positivo su un saggio che è stato effettivamente digitato, ed è proprio questa la modalità di errore che ha spinto le università a disattivare i detector. I compromessi sono diversi, le questioni di sorveglianza sostituiscono le questioni statistiche, ma se la vostra istituzione adotta uno di questi strumenti, il dibattito sui detector sopra diventa in gran parte irrilevante per voi: la prova è il registro del processo, non un punteggio di probabilità.

Come leggere un punteggio di detector che vi è stato consegnato

Un numero arriva quasi sempre senza il suo contesto. Quattro domande ne restituiscono abbastanza per avere una conversazione sensata.

  • Quale strumento, e quale cifra. Una percentuale a livello di documento e un evidenziatore a livello di frase comportano tassi di errore pubblicati diversi dallo stesso fornitore, e quelli di Turnitin sono rispettivamente dell'1% e di circa il 4%.
  • Che cosa il fornitore ha pubblicato sugli errori. Uno strumento che indica un tasso di mancato rilevamento e un tasso di falsi positivi vi ha detto dove sono i suoi limiti. Uno strumento che pubblica solo una percentuale di accuratezza non lo ha fatto.
  • Se il punteggio è una prova o un invito all'azione. La formulazione di Michigan State, secondo cui questi strumenti non dovrebbero essere l'unica base per un'azione sfavorevole, è una posizione istituzionale comune e vale la pena citarla in un ricorso. La guida alla lettera di ricorso mostra come.
  • Che cosa dice davvero la politica del vostro ateneo. Se un rilevatore è concesso in licenza, se il suo output può essere usato in un procedimento disciplinare e che cosa uno studente può richiedere sono scritti da qualche parte, e variano ampiamente tra le università.

Che cosa fa Turnitin con il testo umanizzato è trattato separatamente, insieme a un'indagine più ampia sulle alternative di humanizer.

I fornitori di rilevatori continueranno a pubblicare cifre tonde, e la maggior parte continuerà a rifiutarsi di dire da dove provengano i numeri. Quali di questi dieci il vostro lavoro soddisfi è deciso da chi lo legge, quindi la preparazione utile consiste nel sapere che cosa quello strumento pubblica sui propri tassi di errore prima che qualcuno vi citi una percentuale. I prezzi attuali di TextPulse si trovano in una pagina a parte, aggiornata lì e non in una panoramica.

Cosa ha trovato la nostra ricerca

Nello studio sull'accordo tra rilevatori di TextPulse Research, nove rilevatori commerciali di IA hanno valutato gli stessi 90 testi accademici. Uno era un testo ibrido di 455 parole: apertura e chiusura scritte da un umano attorno a una parte centrale di 168 parole generata dall'IA. Copyleaks ha assegnato a questo testo 0% di IA, mentre i verdetti degli altri strumenti sulle stesse parole andavano da 0% a 95.7% di IA. L'articolo completo, il corpus e la matrice dei punteggi per strumento sono ad accesso aperto su TextPulse Research.

Copyleaks sul testo ibrido del corpus dello studio.
Copyleaks sul testo ibrido del corpus dello studio.
Sapling sul testo ibrido del corpus dello studio.
Sapling sul testo ibrido del corpus dello studio.

Domande frequenti

Nessuna affermazione del fornitore risolve la questione, ma le prove indipendenti più recenti favoriscono Pangram: uno studio del 2026 della Vrije Universiteit Brussel pubblicato nell'International Journal for Educational Integrity ha rilevato che era l'unico strumento il cui punteggio mediano su articoli accademici interamente generati da AI si avvicinava al valore reale, mentre GPTZero, Copyleaks e Turnitin restituivano mediane inferiori al 20%, e un working paper dell'NBER ha rilevato che era l'unico rilevatore a mantenere i falsi positivi pari o inferiori allo 0.5%. Entrambi gli studi sono recenti e limitati nell'ambito, e l'output di nessun rilevatore costituisce da solo una prova.

Mark

Content strategist at TextPulse, here since the company started. Mark writes the product and technical coverage: how the humanizer works under the hood, what changes in each release, and what a specification actually means for your writing. His reviews of writing software come from using them on real documents rather than reading a feature list.

Rimani aggiornato sulla humanization con AI

Ricevi nella tua casella di posta consigli su scrittura accademica, rilevamento AI e humanization.

Niente spam. Annulla l'iscrizione in qualsiasi momento.