O Turnitin consegue detectar ChatGPT? O que ele identifica e o que não identifica
O relatório de escrita por IA do Turnitin e seu relatório de similaridade são produtos diferentes, com públicos diferentes e históricos de precisão diferentes. Aqui está o que a pontuação de IA realmente mede, onde testes independentes mostram que ela falha e por que seu relatório pode não parecer com o do seu colega de quarto.
Sim, mas apenas para um tipo específico de uso de IA, e dentro de um relatório que a maioria dos estudantes nunca vê. O indicador de escrita por IA do Turnitin sinaliza prosa que, estatisticamente, se parece típica de um modelo de linguagem, e faz isso em uma parcela crescente dos textos que analisa: cerca de 15 por cento apresentaram 80 por cento ou mais de escrita gerada por IA entre outubro de 2025 e fevereiro de 2026, ante cerca de 3 por cento quando a ferramenta foi lançada em abril de 2023. Se ele sinaliza sua submissão específica depende de detalhes que a maioria das respostas para can Turnitin detect ChatGPT ignora: como o relatório de IA difere do relatório de plágio, quem de fato vê o número e com que frequência esse número acaba estando errado.
Este post trata da mecânica desse único produto, e não da integridade acadêmica em geral. Ele expõe o que o relatório de escrita por IA mede, o que testes independentes constataram que ele acerta e erra, e por que dois estudantes que enviam trabalhos idênticos podem obter resultados diferentes dependendo da universidade que frequentam. Nada disso altera o que o manual do seu curso diz sobre o uso aceitável de IA. Ele substitui um palpite sobre uma caixa-preta por uma descrição do que realmente há dentro dela.
Can Turnitin Detect ChatGPT? O que o Relatório Realmente Mostra
O relatório de escrita por IA do Turnitin é um produto separado do relatório de similaridade, que verifica plágio. Eles funcionam em modelos diferentes e são exibidos em abas diferentes na mesma interface. A pontuação de similaridade analisa sua submissão e a compara com um banco de dados de fontes publicadas anteriormente e outros trabalhos de estudantes para retornar a porcentagem que corresponde. A pontuação de IA faz algo totalmente diferente: é um classificador que lê sua prosa frase por frase, atribuindo a cada frase uma probabilidade de ter sido gerada por IA e, em seguida, agregando essas pontuações por frase em uma única porcentagem do documento. Como medem coisas diferentes, uma submissão pode ter uma pontuação de similaridade de 2 por cento e uma pontuação de IA de 60 por cento, ou vice-versa.
Essa porcentagem é, na verdade, mais restrita do que parece. Trata-se da proporção da prosa elegível que o modelo prevê ter sido escrita por AI, e não do documento inteiro, porque são removidos itens como blocos de código, listas com marcadores, títulos e escrita em formato curto ao calcular a pontuação. O detector só pode ser aplicado a documentos que tenham pelo menos 300 palavras de prosa em formato longo e, até o momento desta redação, ele é apenas para textos em inglês, espanhol e japonês. Como seria de esperar, quando colocado ao lado de como os detectores de AI calculam essa pontuação em termos gerais, o padrão aqui é familiar: um número em nível de documento que parece preciso é construído a partir de uma fatia mais estreita do texto do que a cifra principal sugere.
O que Aparece como AI: ChatGPT e o Resto
Turnitin afirma que seu classificador procura um padrão de escrita, e não um nome de marca, e sua cobertura foi ampliada repetidas vezes desde o lançamento original de GPT-3.5 e GPT-4 em 2023. A orientação atual menciona a série GPT-5, Gemini e Claude entre os sistemas contra os quais ele é treinado, com novos lançamentos de modelos sendo adicionados de forma contínua. Isso inclui texto que nunca passou especificamente por ChatGPT. Um estudante que usou Gemini, Claude ou DeepSeek em vez disso não está contornando o detector simplesmente por escolher uma empresa diferente, a própria descrição do modelo feita por Turnitin é explícita ao dizer que ele não se baseia em qual fornecedor produziu o texto, apenas em como o texto se apresenta.
Texto de AI parafraseado recebe sua própria categoria, em vez de uma isenção automática. A documentação de Turnitin separa o texto que julga ser gerado por AI apenas do texto que julga ser gerado por AI e depois parafraseado por AI, e em agosto de 2025 acrescentou detecção voltada especificamente para ferramentas de contorno de AI construídas para reescrever a saída da máquina e fazê-la passar por um detector. Isso não significa que parafrasear seja inútil ou que toda passagem reescrita seja detectada. Significa que a suposição de que a paráfrase é invisível para Turnitin por padrão está desatualizada há algum tempo.
Quão Precisa é a Pontuação de AI de Turnitin?
A alegação de precisão do Turnitin se resume a um número principal: a empresa afirma manter uma taxa de falso positivo abaixo de 1 por cento em documentos nos quais mais de 20 percent do texto é sinalizado. A empresa também afirma testar cada nova versão de seus modelos contra 700,000 artigos acadêmicos escritos antes de ChatGPT existir para verificar essa precisão. Trata-se de uma alegação específica, testável, sobre um conjunto particular de circunstâncias. Vale a pena lê-la exatamente assim. O Turnitin fez outras alegações sobre precisão em 2023, logo após seu lançamento. O diretor de produto da empresa reconheceu publicamente que os testes de laboratório não previam quantos falsos positivos apareceriam no uso no mundo real, especialmente em envios curtos, e disse que a porcentagem de falsos positivos era maior no uso real do que nos testes. Ele informou a taxa de falso positivo no nível da frase como em torno de 4 percent e observou que o Turnitin aumentou, como resultado, o comprimento mínimo dos envios que podem ser pontuados de 150 para 300 palavras. O mínimo atual ainda é 300 palavras.
Testes independentes acrescentam detalhes que o número do fornecedor não fornece. O Center for the Advancement of Teaching da Temple University realizou uma das análises mais cuidadosas disponíveis, no mesmo espírito dos testes independentes de detectores de IA que continuam revelando lacunas entre as condições de laboratório e os envios reais. Os pesquisadores submeteram 120 amostras de escrita, divididas igualmente entre escrita totalmente humana, escrita totalmente gerada por IA, escrita gerada por IA passada por uma ferramenta de paráfrase e textos híbridos que combinavam contribuições humanas e de IA, e registraram o que o Turnitin retornou para cada uma. A ferramenta identificou corretamente 93 percent das amostras puramente humanas e 77 percent das puramente geradas por IA.
Nas questões mais difíceis, a precisão caiu ainda mais. O Turnitin identificou corretamente apenas 63 por cento das amostras de IA parafraseadas como geradas por IA e apenas 43 por cento das amostras híbridas como nem totalmente humanas nem totalmente IA, que são as categorias mais próximas de como a escrita auxiliada por IA realmente é produzida. O texto híbrido, em particular, interessou aos pesquisadores porque eles acreditam que ele provavelmente responderá por uma grande parte, possivelmente pela maioria, das submissões reais daqui em diante, à medida que mais cursos atribuem tarefas que pedem aos estudantes que usem IA em parte do trabalho.
| O que foi testado | Resultado do Turnitin |
|---|---|
| Amostras 100% escritas por humanos | 93% corretamente identificadas como humanas |
| Amostras 100% geradas por IA | 77% corretamente identificadas como IA |
| Texto de IA processado por uma ferramenta de paráfrase | 63% corretamente identificadas como IA |
| Amostras híbridas, parte humana e parte IA | 43% corretamente identificadas como nem 0% nem 100% |
| Documentos com mais de 20% sinalizados, número do próprio Turnitin | Taxa de falso positivo inferior a 1% |
Humanize your own paper
Transform your AI-assisted text and make it sound human, without touching important words or citations.
Onde isso se rompe, mesmo quando o número parece correto
A pontuação no nível do documento não é a única coisa que um instrutor pode ver, e a outra visão é menos confiável. Algumas interfaces permitem que um instrutor abra um relatório de sinalização que destaca frases específicas como provavelmente escritas por IA. Os pesquisadores de Temple verificaram esses destaques em relação às frases de suas amostras híbridas que de fato haviam sido escritas por IA, e não encontraram relação entre os dois. Isso importa se um professor lhe encaminha uma captura de tela de um parágrafo destacado em vez da porcentagem resumida: a pontuação geral do documento teve desempenho consideravelmente melhor do que os destaques no nível da frase.
As pontuações baixas são tratadas de modo diferente novamente, e com mais cautela do que antes. Desde julho de 2024, Turnitin passou a exibir um asterisco no lugar de um número sempre que seu modelo estima que menos de 20 percent do documento foi escrito por AI, porque essa faixa é a em que a ferramenta tem maior probabilidade de errar em qualquer direção. Uma edição leve com assistência de AI, um parágrafo reescrito com ajuda e o restante escrito sem auxílio, muitas vezes não produzirá nenhuma porcentagem visível, em vez de uma pequena, o que vale a pena saber antes de tratar a ausência de um número como prova de qualquer coisa.
Quem De Fato Vê o Número
A pontuação de AI não faz parte, por padrão, do relatório voltado ao estudante. Ela fica em sua própria aba, visível para docentes e administradores, e o estudante só a vê se o docente optar por compartilhar o relatório ou exibi-la diretamente. Trata-se de uma diferença estrutural real em relação à pontuação de similaridade, que os estudantes normalmente podem visualizar por conta própria no mesmo sistema, depois que uma submissão foi processada.
O mesmo se aplica ao fato de o recurso existir ou não para um curso específico, o que é uma decisão institucional acima e além do docente. Administradores em nível de conta podem ativar ou desativar a detecção de AI do Turnitin para toda a instituição. Um docente pode não conseguir ativá-la se a universidade a tiver desativado, e vice-versa. Um estudante de uma universidade que envia um trabalho semelhante ao de outro estudante de uma universidade diferente pode ter uma experiência muito distinta com essa ferramenta, por razões que não têm relação com o que qualquer um deles escreveu.
Por Que Algumas Universidades Desativaram Isso
A University of Waterloo descontinuou o recurso de detecção de IA do Turnitin em setembro de 2025, e a justificativa publicada é incomumente direta. A universidade citou a falta de confiabilidade documentada da ferramenta, seu viés contra estudantes cuja primeira língua não é o inglês e seus próprios testes internos, que incluíram pelo menos um caso de texto inteiramente escrito por humanos classificado como 100 percent AI-generated. Em comparação com o custo da ferramenta, a universidade concluiu que os custos superavam os benefícios e redirecionou o esforço para o redesenho da avaliação e para a formação em letramento em IA.
Waterloo é um exemplo visível de uma divisão mais ampla, e não uma exceção. As universidades que mantêm o recurso ativado, em geral, acrescentaram salvaguardas em vez de tratar a pontuação como um veredito por si só, exigindo uma conversa com o estudante antes de qualquer procedimento formal começar e tratando o número como motivo para iniciar essa conversa, e não para encerrá-la. Ler sobre como as universidades estão lidando com a política de IA de forma mais ampla torna o padrão mais claro: se uma pontuação chega até você, isso depende de uma decisão tomada muito acima da sua sala de seminário, e não de uma propriedade fixa da própria tecnologia.
O que uma Pontuação Alta Prova, e o que Não Prova
Uma pontuação alta de IA é evidência, não um veredito. O próprio Turnitin apresenta a porcentagem como um dado entre outros para o julgamento do docente, e não como uma constatação de má conduta, e os índices de precisão acima explicam por que essa formulação importa: mesmo uma pontuação em nível de documento que tenha desempenho razoável interpreta de forma equivocada uma parcela significativa de textos muito editados, parafraseados ou híbridos, e os destaques em nível de sentença são consideravelmente menos confiáveis do que o número resumido. Nada disso garante que qualquer pontuação individual esteja errada. Significa que uma porcentagem é motivo para fazer perguntas, e não uma constatação a ser aceita de imediato. Se você quiser ver onde sua própria escrita se situa antes que outra pessoa a pontue, os mesmos padrões de baixa variação e formulação genérica aos quais um classificador reage podem ser verificados diretamente com um free perplexity checker.
O humanizador de IA da TextPulse para estudantes AI humanizer for students funciona com a mesma base estatística, e o mesmo vale para o seu free burstiness checker para a metade da medida que diz respeito ao ritmo das frases. Ele fornece a você um Human Score estimado com base no seu próprio rascunho, não uma previsão do que Turnitin dirá sobre ele. Nenhuma ferramenta pode prometer isso de forma responsável sobre um sistema que não controla. Trate isso como uma segunda leitura do seu próprio texto, nada mais.
Várias dessas questões têm páginas próprias. Se um professor pode perceber que você usou ChatGPT sem qualquer detector, e a versão mais direta da mesma pergunta, will I get caught, são respondidas separadamente. O mesmo vale para o comportamento do Turnitin em relação a texto parafraseado, e para se o Turnitin detecta a saída do DeepSeek especificamente. Para configurações particulares, há textos sobre detecção de IA em programas de enfermagem e sobre se os escritórios de admissão universitária realizam essas verificações. O enquadramento mais amplo está em um texto separado sobre integridade acadêmica e IA.
Nada disso provavelmente será a versão final. O Turnitin reescreveu seus limiares, suas regras de visibilidade e sua cobertura de modelos mais de uma vez desde 2023, e agosto de 2026 também não será a palavra final. O que permanece constante é o hábito que vale a pena cultivar, independentemente de qual detector um dado curso use: escrever com detalhes suficientemente específicos, irregulares e genuinamente seus, de modo que o que quer que um classificador pense se torne irrelevante.
Frequently Asked Questions
O indicador de escrita por IA do Turnitin existe para responder exatamente a isso. O Turnitin consegue detectar ChatGPT? Em geral, sim, quando um documento contém escrita por IA substancial: o classificador sinaliza prosa que parece estatisticamente típica de um modelo de linguagem, e os próprios dados do Turnitin mostram que cerca de 15 percent dos ensaios analisados agora recebem pontuação de escrita fortemente por IA. Ele também deixa de identificar textos com frequência, e testes independentes constataram que a precisão caiu para 63 percent em escrita por IA parafraseada e 43 percent em texto híbrido.
PhD in natural language processing, with years spent building NLP applications end to end. Moe works on text analysis: lexical and syntactic structure, and what separates machine-generated prose from human prose statistically. He has been experimenting with computational linguistics since the early days of NLTK, spaCy and WordNet, and still writes most of his tooling in Python.