AI Detection

¿Qué es una buena puntuación de Turnitin?

Turnitin no publica ningún porcentaje de similitud aceptable, y las instituciones establecen su propia orientación. Esta entrada explica qué impulsa realmente una puntuación alta o baja, por qué el material citado y las listas de referencias la inflan sin que haya nada incorrecto, y cómo leer el desglose de coincidencias detrás del número en lugar del número mismo.

6 min
What is a good Turnitin score? A similarity report broken into matched sources rather than one number.

Un estudiante recibe de un supervisor la indicación de que cualquier cosa por debajo del quince por ciento está bien. Otro estudiante, también en el mismo departamento, ve cómo su trabajo es señalado en el pasillo con un doce por ciento porque tres de esos puntos corresponden a un único párrafo continuo, sin comillas cerca. Ambos interpretan correctamente la puntuación de similitud de Turnitin. La herramienta nunca fue diseñada para asignar, desde el principio, un único número de aprobado o suspenso.

Entonces, ¿qué es una buena puntuación de Turnitin? No existe tal número. Turnitin no publica un porcentaje aceptable, no califica una entrega y afirma claramente que la cifra no es, por sí sola, una medida de plagio. Cada institución establece su propia orientación y, a menudo, cada supervisor dentro de ella también, por lo que el mismo informe puede parecer poco llamativo en una oficina y preocupante en la siguiente. El número que merece la pena aprender es cómo leer lo que hay detrás de él.

¿Qué es una buena puntuación de Turnitin?

Turnitin nunca ha publicado un número que cuente como bueno, seguro o aceptable, y por una razón concreta: la puntuación de similitud mide cuánto texto de una entrega coincide con texto ya presente en las bases de datos de Turnitin, no si esa coincidencia se utilizó de manera indebida. Una puntuación alta puede proceder por completo de material citado y referenciado correctamente. Una puntuación baja puede situarse por encima de un trabajo que parafrasea una fuente con suficiente cercanía como para preocupar a un examinador, sin activar en absoluto el motor de coincidencias. Leer el número como si fuera una calificación invierte el sentido de la herramienta.

Una cifra como del diez al veinte por ciento circula ampliamente como una regla práctica informal, repetida en foros y guías de estudio hasta que empieza a sonar oficial. No lo es. Turnitin no establece tal cifra, y una regla práctica que ignore la longitud del documento, la densidad de las citas y la convención del campo se desmorona en cuanto se enfrenta a un trabajo real. Una revisión bibliográfica construida a partir de treinta fuentes citadas correctamente puede superar el veinte por ciento solo en citas textuales. Un único párrafo parafraseado con mucha cercanía y sin comillas puede situarse por debajo del cinco por ciento y seguir siendo el problema más grave.

¿Qué mide realmente la puntuación de similitud?

Turnitin describe su propia herramienta en términos casi exactamente iguales. La orientación de Boise State University, basada en el propio lenguaje de Turnitin, explica que la puntuación de similitud es un porcentaje del contenido de un trabajo que coincide con material ya presente en las bases de datos de Turnitin, y que el porcentaje en sí mismo no es una evaluación de si el trabajo contiene material plagiado. La distinción cumple una función real: la coincidencia es mecánica, una cadena de palabras que se alinea con otra cadena de palabras en algún otro lugar, y juzgar si esa superposición fue debidamente atribuida requiere a una persona, no a un algoritmo.

Las bases de datos detrás de la coincidencia son amplias a propósito: entregas estudiantiles actuales y archivadas, la web abierta y un amplio cuerpo de publicaciones académicas. Ninguno de esos contenidos se lee por su significado. El sistema encuentra cadenas de palabras superpuestas e informa de cuánto de una entrega abarcan, por eso una frase citada y una copiada en silencio pueden producir una coincidencia idéntica. Solo la vista detallada del informe muestra cuál es cuál.

Por qué una puntuación alta puede ser completamente legítima

Dos rasgos ordinarios de la escritura académica explican la mayor parte de ello. Los pasajes citados coinciden por diseño, ya que las palabras se copian a propósito y se marcan en la página como pertenecientes a otra persona. Las listas de referencias coinciden con la misma fiabilidad, porque los nombres de autores, los títulos de revistas y los formatos de cita se repiten en miles de otros trabajos que citan las mismas fuentes. Ambos son el aspecto que se supone que debe tener una escritura académica correcta.

Puestos uno al lado del otro, una puntuación inflada y un problema real se ven distintos a simple vista.

Qué coincidióPor qué ocurrió¿Merece una revisión más detenida?
Un pasaje citado con comillas y una citaLas palabras fueron copiadas a propósito y acreditadas en la páginaNo, así es como se ve una cita correcta
Una lista de referencias o bibliografíaLos nombres de autores, los títulos de revistas y los formatos de cita se repiten en muchos otros trabajosNo, salvo que no se haya aplicado el ajuste de exclusión
Métodos estándar o formulación procedimentalEl vocabulario compartido de un campo describe el mismo proceso de la misma manera en distintos trabajosRara vez, salvo que se haya copiado toda la sección en lugar de redactarla de nuevo
Un párrafo largo e ininterrumpido sin comillas, que coincide con una sola fuenteLa redacción sigue de cerca la frase de otro autor, lo bastante para que el motor de coincidencias la detecteSí, este es el patrón que conviene abrir la fuente para comprobar

Humanice su propio artículo

Transforme su texto asistido por IA y hágalo sonar humano, sin tocar palabras importantes ni citas.

Empezar gratis

Por qué una puntuación baja todavía puede ocultar un problema

Un número bajo responde a una pregunta más limitada de lo que parece, si poco texto coincide palabra por palabra con las bases de datos de Turnitin, nada más. Una paráfrasis que cambia suficiente redacción mientras mantiene intacta la estructura y el argumento de otro autor puede obtener una puntuación cercana a cero y seguir siendo un problema grave de integridad, ya que el motor funciona con cadenas de palabras, no con ideas prestadas. El contenido traducido, o el material procedente de bases de datos indexadas por Turnitin, se comporta de la misma manera, nada con lo que coincidir, nada que se marque.

Las fuentes fabricadas crean el mismo punto ciego desde otra dirección. Una referencia que no existe no puede coincidir con nada, porque no hay en ninguna parte con qué coincidir, y una puntuación de similitud no tiene forma de señalar una cita que nunca fue real en primer lugar. El comprobador gratuito de citas de IA de TextPulse existe precisamente para esa laguna, resuelve cada entrada de una lista de referencias frente a los registros reales en los que esas fuentes deberían aparecer, antes de que un lector tenga que encontrar la laguna por las malas.

Una distinción más merece hacerse antes de pasar por completo del número. Una entrega con una puntuación de similitud baja todavía puede llevar el indicador separado de escritura con IA de Turnitin, una medición distinta diseñada para detectar un tipo distinto de problema, tratado en la guía de este sitio sobre si Turnitin puede detectar realmente ChatGPT. Los dos porcentajes no se calculan del mismo modo, y este texto trata solo de la puntuación de similitud.

Cómo leer el informe en lugar del número

No reaccione al total antes de abrir el desglose de coincidencias. Turnitin ordenará las fuentes, que componen una puntuación, según su contribución a ella. Un total del veintidós por ciento compuesto por once fuentes que aportan dos por ciento cada una no se lee igual que un total compuesto por una sola fuente. El primer patrón suele reflejar solapamiento en muchas frases comunes. El segundo merece una revisión directa de lo que esa fuente dice realmente.

Turnitin también clasifica el mismo porcentaje en una banda de color, reproducida en la propia orientación de Loughborough College para estudiantes: azul para ningún texto coincidente, verde de una palabra al veinticuatro por ciento, amarillo del veinticinco al cuarenta y nueve, naranja del cincuenta al setenta y cuatro, rojo del setenta y cinco en adelante. La propia orientación del college es directa sobre lo que los colores no son: las comprobaciones de similitud no significan que una entrega contenga material plagiado. El color clasifica un informe para llamar la atención, no para emitir un veredicto.

También conviene comprobar si los ajustes propios de una institución excluyen las citas y la bibliografía del recuento, ya que la misma entrega puede producir dos números distintos según cómo esté configurado ese interruptor. Nada de esto es complicado una vez que es visible. Solo es invisible si nadie abre el informe más allá de su primera página.

Qué hacer si su puntuación le sorprende

Vuelva a abrir cada fuente marcada de forma individual, en lugar de reaccionar al total combinado. Confirme si la versión que se está evaluando tiene excluidas las citas textuales y la bibliografía, ya que el número que ve un estudiante mientras redacta no siempre está configurado de la misma manera que el número que ve un instructor al entregar el trabajo. Cuando aparezca una coincidencia genuina sin atribución, corrija la cita directamente en lugar de reformular las frases para eludir el motor de coincidencias, que trata el síntoma y deja el problema en su sitio.

Si el número sigue pareciendo desajustado respecto de lo que espera un supervisor, pregunte directamente cuál es la convención propia de ese departamento. Las secciones anteriores ya muestran que no existe una única cifra que alcanzar, así que la respuesta depende de alguien con autoridad local sobre la tarea, no de un porcentaje que cualquiera podría haber consultado de antemano. La colección de herramientas gratuitas de TextPulse cubre las comprobaciones de citación y redacción que conviene ejecutar antes de que un informe llegue al buzón de otra persona.

Las puntuaciones de distintas herramientas no son intercambiables, y cómo funciona GPTZero se expone en su propia página, junto con la estadística de perplexity que se sitúa debajo de ambas.

La puntuación se comporta como lo hace debido a la forma en que se ejecuta la coincidencia por debajo de ella, y el número más reciente que ahora aparece junto a ella en el mismo informe funciona con un mecanismo distinto, el que la guía de este sitio sobre cómo funcionan realmente los detectores de AI expone por completo. Leer cualquiera de los dos números como un veredicto omite la única parte del informe que merece leerse.

XLinkedInFacebook

Preguntas frecuentes

¿Qué es una buena puntuación de Turnitin? No existe tal cifra. Turnitin no publica un porcentaje aceptable, y la puntuación de similitud mide cuánto texto coincide con sus bases de datos, no cuánto se ha plagiado. Una revisión bibliográfica correctamente citada puede superar el veinte por ciento solo por las citas, mientras que una sola paráfrasis sin atribución puede situarse por debajo del cinco. Lea las fuentes coincidentes, no la cifra principal.

Moe

PhD in natural language processing, with years spent building NLP applications end to end. Moe works on text analysis: lexical and syntactic structure, and what separates machine-generated prose from human prose statistically. He has been experimenting with computational linguistics since the early days of NLTK, spaCy and WordNet, and still writes most of his tooling in Python.

Mantente al día sobre la humanización con AI

Recibe en tu correo consejos sobre redacción académica, detección de AI y humanización.

Sin spam. Cancela la suscripción en cualquier momento.