AI Detection

¿Puede Turnitin detectar ChatGPT? Qué detecta y qué no

El informe de escritura con IA de Turnitin y su informe de similitud son productos distintos, con públicos distintos y registros de precisión distintos. Aquí se explica qué mide realmente la puntuación de IA, dónde las pruebas independientes muestran que falla y por qué su informe puede no parecerse al de su compañero de piso.

8 min
Illustration answering can Turnitin detect ChatGPT, showing the AI writing report displayed separately from the similarity report

Sí, pero solo para un tipo específico de uso de AI, y dentro de un informe que la mayoría de los estudiantes nunca ve. El indicador de escritura con AI de Turnitin señala la prosa que, desde un punto de vista estadístico, se parece a la de un modelo de lenguaje, y lo hace en una proporción cada vez mayor de los ensayos que analiza: alrededor del 15 por ciento mostró un 80 por ciento o más de escritura generada por AI entre octubre de 2025 y febrero de 2026, frente a aproximadamente el 3 por ciento cuando la herramienta se lanzó en abril de 2023. Que señale tu entrega concreta depende de detalles que la mayoría de las respuestas a can Turnitin detect ChatGPT pasan por alto: en qué se diferencia el informe de AI del informe de plagio, quién ve realmente el número y con qué frecuencia ese número resulta ser incorrecto.

Esta publicación aborda la mecánica de ese producto concreto, no la integridad académica en general. Expone qué mide el informe de escritura con AI, qué han encontrado las pruebas independientes sobre lo que acierta y lo que falla, y por qué dos estudiantes que entregan un trabajo idéntico podrían obtener resultados distintos según la universidad a la que asistan. Nada de eso cambia lo que diga el manual de tu asignatura sobre el uso aceptable de AI. Sustituye una conjetura sobre una caja negra por una descripción de lo que realmente hay dentro.

Can Turnitin Detect ChatGPT? Qué muestra realmente el informe

El informe de escritura con AI de Turnitin es un producto distinto del informe de similitud que comprueba el plagio. Funcionan con modelos diferentes y se muestran en pestañas distintas dentro de la misma interfaz. La puntuación de similitud examina tu entrega y la compara con una base de datos de fuentes publicadas previamente y otros trabajos de estudiantes para devolver el porcentaje que coincide. La puntuación de AI hace algo completamente distinto, es un clasificador que lee tu prosa frase por frase, asignando a cada frase una probabilidad de haber sido generada por AI y luego agregando esas puntuaciones a nivel de frase en un único porcentaje del documento. Como miden cosas distintas, una entrega puede tener una puntuación de similitud del 2 por ciento y una puntuación de AI del 60 por ciento, o viceversa.

Este porcentaje en realidad es más estrecho de lo que parece. Se trata de la proporción de prosa elegible que el modelo predice que fue escrita por IA, no del documento completo, porque eliminan cosas como bloques de código, viñetas, encabezados y escritura breve al calcular la puntuación. El detector solo puede aplicarse a documentos que tengan al menos 300 palabras de prosa extensa, y, en el momento de escribir esto, solo funciona para texto en inglés, español y japonés. Como cabría esperar, si se compara con cómo los detectores de IA calculan esa puntuación en general, el patrón aquí es familiar, un número a nivel de documento que parece preciso se construye a partir de una porción más estrecha del texto de lo que sugiere la cifra principal.

Qué aparece como IA: ChatGPT y el resto

Turnitin afirma que su clasificador busca un patrón de escritura más que un nombre de marca, y su cobertura se ha ampliado repetidamente desde el lanzamiento original de GPT-3.5 y GPT-4 en 2023. La orientación actual menciona la serie GPT-5, Gemini y Claude entre los sistemas contra los que se entrena, y se añaden nuevos lanzamientos de modelos de forma continua. Eso incluye texto que nunca pasó específicamente por ChatGPT. Un estudiante que usó Gemini, Claude o DeepSeek en su lugar no está eludiendo el detector simplemente por elegir una empresa distinta, la propia descripción del modelo de Turnitin es explícita al señalar que no se fija en qué proveedor produjo el texto, sino solo en cómo se lee el texto.

El texto de IA parafraseado recibe su propia categoría en lugar de un pase libre. La documentación de Turnitin separa el texto que juzga como generado por IA únicamente del texto que juzga como generado por IA y luego parafraseado por IA, y en agosto de 2025 añadió una detección dirigida específicamente a herramientas de evasión de IA construidas para reescribir la salida de la máquina y pasar por un detector. Eso no significa que parafrasear sea inútil ni que todo pasaje reescrito sea detectado. Significa que la suposición de que la paráfrasis es invisible para Turnitin por defecto lleva ya algún tiempo desactualizada.

¿Qué precisión tiene la puntuación de IA de Turnitin?

La afirmación de precisión de Turnitin se reduce a una cifra principal: sostiene que mantiene una tasa de falsos positivos inferior al 1 por ciento en documentos en los que se marca más del 20 percent del texto. La empresa también afirma que prueba cada nueva versión de sus modelos frente a 700,000 artículos académicos escritos antes de que existiera ChatGPT para verificar esta precisión. Se trata de una afirmación específica y comprobable sobre un conjunto particular de circunstancias. Conviene leerla exactamente así. Turnitin ha hecho otras afirmaciones sobre la precisión en 2023, poco después de su lanzamiento. El director de producto de la empresa reconoció públicamente que las pruebas de laboratorio no predecían cuántos falsos positivos aparecerían en el uso real, especialmente en envíos breves, y dijo que el porcentaje de falsos positivos era más alto en condiciones reales que en las pruebas. Informó de que la tasa de falsos positivos a nivel de oración era de alrededor del 4 percent y señaló que Turnitin aumentó, como resultado, la longitud mínima de los envíos que pueden puntuarse de 150 a 300 words. El mínimo actual sigue siendo 300 words.

Las pruebas independientes añaden detalles que la cifra del proveedor no ofrece. El Center for the Advancement of Teaching de Temple University realizó uno de los exámenes más cuidadosos disponibles, en el mismo espíritu que las pruebas independientes de detectores de IA, que siguen mostrando diferencias entre las condiciones de laboratorio y los envíos reales. Los investigadores presentaron 120 muestras de escritura, divididas por igual entre escritura totalmente humana, escritura totalmente generada por IA, escritura generada por IA pasada por una herramienta de paráfrasis y textos híbridos que combinaban aportaciones humanas y de IA, y registraron lo que Turnitin devolvía en cada caso. La herramienta identificó correctamente el 93 percent de las muestras puramente humanas y el 77 percent de las puramente generadas por IA.

En las preguntas más difíciles, la precisión cayó aún más. Turnitin identificó correctamente solo el 63 por ciento de las muestras de IA parafraseadas como generadas por IA y solo el 43 por ciento de las muestras híbridas como ni totalmente humanas ni totalmente de IA, que son las categorías más cercanas a cómo se produce realmente la escritura asistida por IA. El texto híbrido, en particular, interesó a los investigadores porque creen que probablemente representará una gran parte, posiblemente la mayoría, de las entregas reales en adelante, a medida que más cursos asignen tareas que pidan a los estudiantes usar IA para una parte del trabajo.

Qué se evaluóResultado de Turnitin
Muestras 100% escritas por humanos93% identificadas correctamente como humanas
Muestras 100% generadas por IA77% identificadas correctamente como IA
Texto de IA pasado por una herramienta de paráfrasis63% identificado correctamente como IA
Muestras híbridas, parte humana y parte IA43% identificadas correctamente como ni 0% ni 100%
Documentos con más del 20% marcado (la propia cifra de Turnitin)Tasa de falsos positivos inferior al 1%

Humanize your own paper

Transform your AI-assisted text and make it sound human, without touching important words or citations.

Get started free

Donde se descompone incluso cuando el número parece correcto

La puntuación a nivel de documento no es lo único que un instructor puede ver, y la otra vista es menos fiable. Algunas interfaces permiten que un instructor abra un informe de marcas que resalta frases específicas como probablemente escritas por IA. Los investigadores de Temple comprobaron esos resaltados frente a qué frases de sus muestras híbridas estaban realmente escritas por IA, y no encontraron relación entre ambas cosas. Esto importa si un profesor le reenvía una captura de pantalla de un párrafo resaltado en lugar del porcentaje resumido: la puntuación global del documento funcionó considerablemente mejor que los resaltados a nivel de frase.

Las puntuaciones bajas se tratan de nuevo de forma diferente, y con más cautela que antes. Desde julio de 2024, Turnitin ha mostrado un asterisco en lugar de un número siempre que su modelo estima que menos del 20 percent de un documento está escrito por AI, porque ese intervalo es donde es más probable que la herramienta se equivoque en cualquiera de las dos direcciones. Una edición ligera asistida por AI, un párrafo reescrito con ayuda y el resto escrito sin asistencia, a menudo no producirá ningún porcentaje visible en absoluto, en lugar de uno pequeño, lo cual conviene saber antes de tomar la ausencia de un número como prueba de algo.

Quién ve realmente el número

La puntuación de AI no forma parte del informe visible para el estudiante por defecto. Se encuentra en su propia pestaña, visible para docentes y administradores, y un estudiante solo la ve si el docente decide compartir el informe o mostrarla directamente. Esta es una diferencia estructural real respecto de la puntuación de similitud, que los estudiantes normalmente pueden ver por sí mismos dentro del mismo sistema una vez que se ha procesado una entrega.

Lo mismo se aplica a si la función existe o no para un curso concreto, lo cual es una decisión institucional por encima y más allá del docente. Los administradores a nivel de cuenta pueden activar o desactivar la detección de AI de Turnitin para toda una institución. Puede que un profesor no pueda activarla si su universidad la ha desactivado, y viceversa. Un estudiante de una universidad que entrega un trabajo similar al de otro estudiante de una universidad distinta puede tener una experiencia muy diferente de esta herramienta, por razones que no tienen nada que ver con lo que cualquiera de ellos escribió.

Por qué algunas universidades la han desactivado

La University of Waterloo descontinuó la función de detección de IA de Turnitin en septiembre de 2025, y su justificación publicada es inusualmente directa. La universidad citó la falta de fiabilidad documentada de la herramienta, su sesgo contra los estudiantes cuya primera lengua no es el inglés, y sus propias pruebas internas, que incluyeron al menos un caso de texto escrito íntegramente por humanos calificado como 100 percent generado por IA. En comparación con el coste de la herramienta, la universidad concluyó que los costes superaban los beneficios y redirigió el esfuerzo hacia el rediseño de la evaluación y la formación en alfabetización en IA.

Waterloo es un ejemplo visible de una división más amplia, no una excepción. Las universidades que mantienen activada la función, por lo general, han añadido salvaguardas en lugar de tratar la puntuación como un veredicto por sí sola, exigiendo una conversación con el estudiante antes de que comience cualquier proceso formal y tratando el número como un motivo para abrir esa conversación, no para cerrarla. Leer sobre cómo las universidades están gestionando la política de IA de manera más amplia hace más claro el patrón: que una puntuación llegue o no a usted depende de una decisión tomada mucho por encima de su aula de seminario, no de una propiedad fija de la tecnología en sí.

Qué demuestra, y qué no demuestra, una puntuación alta

Una puntuación alta de IA es una prueba, no un veredicto. El propio Turnitin presenta el porcentaje como un dato más para el juicio de un docente, no como una constatación de mala conducta, y las cifras de precisión anteriores explican por qué ese encuadre importa: incluso una puntuación a nivel de documento que funciona razonablemente bien interpreta mal una proporción significativa de la escritura muy editada, parafraseada o híbrida, y los resaltados a nivel de oración son notablemente menos fiables que la cifra resumida. Nada de eso garantiza que una puntuación individual sea incorrecta. Significa que un porcentaje es un motivo para hacer preguntas, no una constatación que deba aceptarse a simple vista. Si quiere ver dónde se sitúa su propia escritura antes de que otra persona la puntúe, los mismos patrones de baja variación y formulación genérica a los que reacciona un clasificador pueden comprobarse directamente con un free perplexity checker.

El humanizador de IA para estudiantes de TextPulse funciona sobre esa misma base estadística, y también lo hace su comprobador gratuito de burstiness para la mitad del ritmo de la oración de la misma medición. Te ofrece un Human Score estimado basado en tu propio borrador, no una predicción de lo que Turnitin dirá sobre él. Ninguna herramienta puede prometer responsablemente eso sobre un sistema que no controla. Trátalo como una segunda lectura de tu propia escritura, nada más.

Varias de estas preguntas tienen páginas propias. Si un profesor puede saber que usaste ChatGPT sin ningún detector en absoluto, y la versión más directa de ello, si me descubrirán, se responden por separado. Lo mismo ocurre con el comportamiento de Turnitin ante texto parafraseado, y con si Turnitin detecta la salida de DeepSeek específicamente. Para contextos concretos hay textos sobre la detección de IA en programas de enfermería y sobre si las oficinas de admisión universitaria realizan estas comprobaciones. El encuadre más amplio aparece en un texto aparte sobre integridad académica e IA.

Nada de esto es probable que sea la versión final. Turnitin ha reescrito sus umbrales, sus reglas de visibilidad y la cobertura de sus modelos más de una vez desde 2023, y agosto de 2026 tampoco será la última palabra. Lo que permanece constante es el hábito que merece la pena tener, independientemente del detector que use un curso dado: escribir con suficiente detalle específico, irregular y genuinamente propio, de modo que lo que un clasificador piense por casualidad pase a ser irrelevante.

Frequently Asked Questions

El indicador de escritura con IA de Turnitin existe precisamente para responder a esto. ¿Puede Turnitin detectar ChatGPT? Por lo general, sí, cuando un documento contiene una cantidad sustancial de escritura con IA: el clasificador marca una prosa que parece estadísticamente típica de un modelo de lenguaje, y los propios datos de Turnitin muestran que alrededor del 15 percent de los ensayos escaneados ahora obtienen una puntuación de escritura con IA elevada. También omite texto con regularidad, y las pruebas independientes encontraron que la precisión cayó al 63 percent en escritura con IA parafraseada y al 43 percent en texto híbrido.

Moe

PhD in natural language processing, with years spent building NLP applications end to end. Moe works on text analysis: lexical and syntactic structure, and what separates machine-generated prose from human prose statistically. He has been experimenting with computational linguistics since the early days of NLTK, spaCy and WordNet, and still writes most of his tooling in Python.