Los mejores detectores de IA para la escritura académica en 2026: 10 herramientas comparadas
Dos de estos diez detectores publican la misma cifra de precisión del 99.98% en el titular. Uno nombra a los investigadores detrás de ella y desglosa su tasa de falsos positivos por género. El otro no nombra ninguna prueba. Diez herramientas situadas en cuatro ejes, quién las compra, qué afirman, qué evidencia respalda la afirmación y qué muestra realmente el informe, además del modelo de seguimiento del proceso que puede sustituir por completo la puntuación.
Dos de las diez herramientas aquí publican la misma cifra principal: 99.98% de precisión. Una de ellas nombra a los investigadores y a las universidades detrás de esa cifra y desglosa su tasa de falsos positivos por género de contenido. La otra no nombra ninguna prueba en absoluto. Ese contraste es lo más útil en cualquier conjunto de detectores de IA comparados lado a lado, y seguirá siendo útil después de que cambie cada precio en cada una de estas páginas.
Esta guía compara los mejores detectores de IA para la escritura académica en 2026: Turnitin, GPTZero, Copyleaks, Originality.ai, Pangram, Winston AI, ZeroGPT, Scribbr, Sapling y Compilatio, los diez que es más probable que encuentre un estudiante, un investigador, un corrector o un editor. Se venden a distintos compradores, se fijan con distintos modelos de precio y devuelven información distinta. Compararlos solo por la precisión pasa por alto casi todo lo que determina cuál de ellos se usa para pasar su texto, y qué ocurre después de que se usa.
Las cuatro cosas que realmente difieren
Las páginas de marketing de los detectores convergen en una cifra y divergen en todo lo demás. Cuatro preguntas separan estos productos, y solo una es el porcentaje de la página principal.
- A quién se vende. Una herramienta licenciada a instituciones y mostrada solo a los docentes ocupa una posición distinta de otra a la que cualquiera puede registrarse en un navegador, y la diferencia decide quién llega a ver algún resultado sobre usted.
- Qué cifra publica. Cada proveedor aquí publica algún tipo de afirmación, desde un porcentaje sin más hasta una tasa de falsos positivos citada con cuatro cifras.
- Si detrás de esa cifra hay una prueba nombrada. Este es el eje que separa con mayor claridad a los diez, y el que ninguna tabla comparativa de proveedores utiliza.
- Qué devuelve realmente el informe. Un porcentaje a nivel de documento, resaltados a nivel de oración, una vista de interpretabilidad y un informe compartible son cuatro objetos distintos, y una acusación construida sobre uno es una conversación distinta de una acusación construida sobre otro.
La tercera pregunta merece ser considerada con detenimiento. Un porcentaje con una institución nombrada, un conjunto de datos nombrado y un método declarado detrás puede ser objeto de discusión, replicado o impugnado. Un porcentaje sin nada detrás solo puede creerse o ignorarse, y la creencia no es una base para una audiencia por mala conducta. La perplejidad, la propiedad estadística en la que se apoyó con más fuerza una generación anterior de detectores, es lo bastante medible como para que un comprobador gratuito de perplejidad le muestre cómo se ve en su propia escritura, aunque ningún proveedor de los que aparecen abajo informa su veredicto como una puntuación de perplejidad.
La tabla comparativa: a quién se vende cada uno y qué afirma
| Detector | Vendido a | Cómo se obtiene acceso | Afirmación principal | Prueba nombrada detrás de la afirmación |
|---|---|---|---|---|
| Turnitin | Educadores y administradores en instituciones con licencia | Solo licencia institucional | Tasa de falsos positivos del documento inferior al 1% por encima del umbral del 20% | Conjunto de validación propio de Turnitin, no se nombra ningún estudio externo |
| GPTZero | Profesores, estudiantes, escritores, reclutadores, editores | Registro directo, nivel gratuito | 99% de precisión, 96.5% en documentos mixtos | Remite a RAID, un punto de referencia de terceros, y a una colaboración con Penn State |
| Copyleaks | Educación y empresa, dentro de Canvas, Blackboard y Moodle | Registro directo y licencia LMS | Más del 99% de precisión con una tasa de falsos positivos del 0.03% | Existen datos independientes, el estudio de VUB de 2026 que aparece abajo |
| Originality.ai | Escritores, editores, especialistas en marketing, agencias, empresa | Registro directo, basado en créditos | 99% de precisión en los modelos de IA más recientes | Su propio estudio de precisión más trabajo revisado por pares de terceros |
| Pangram | Universidades, escuelas y empresas | Registro directo, planes institucionales y API | 99.98% de precisión, tasa de falsos positivos de 1 en 10,000 | Un estudio que atribuye a investigadores de Chicago Booth y de la University of Maryland |
| Winston AI | Particulares, equipos, clientes de certificación de sitios web | Registro directo, basado en créditos | 99.98% de precisión, indicado como el único detector que la alcanza | Ninguna nombrada |
| ZeroGPT | Particulares, la comprobación previa sin registro | Gratis, 15,000 caracteres, sin cuenta | Por encima del 98% en evaluaciones internas | Ninguna nombrada, la cifra es propia del proveedor |
| Scribbr | Estudiantes, comprobador gratuito más nivel premium | Gratis en el navegador | El 78% de los textos de prueba se identificó correctamente | La propia comparación de Scribbr, realizada por el propio Scribbr |
| Sapling | Desarrolladores y equipos de soporte, orientado primero a la API | Registro directo, API pública, extensión del navegador | Probabilidades de IA por oración | Ninguna nombrada, las reseñas independientes discrepan mucho entre sí |
| Compilatio | Instituciones europeas y estudiantes, con mayor fortaleza en sistemas francófonos | Licencia institucional, o compra directa por estudiantes desde 4.99 euros | 94 a 99% de fiabilidad, menos del 1% de falsos positivos | Clasificado en 2.º lugar de 14 herramientas, Weber-Wulff et al. 2023 |
Una fila se comporta de manera distinta al resto. Turnitin no puede ser comprado por la persona evaluada, no puede ser ejecutado por ella antes de la entrega, y devuelve sus resultados a otra persona. Compilatio está licenciado por las instituciones del mismo modo, pero además vende a los estudiantes esas mismas comprobaciones directamente, así que es el único detector institucional que usted puede ejecutar primero sobre su propio borrador. Todos los demás detectores aquí son productos que un estudiante, un escritor o un editor puede abrir en un navegador y aplicar a su propio texto esta misma tarde.
Las afirmaciones de precisión, y cuáles tienen una prueba identificada detrás de ellas
Winston AI y Pangram publican la misma cifra. Winston afirma que es "The only AI detector with a 99.98% accuracy rate". La página principal de Pangram afirma: "Detect AI-generated content with 99.98% accuracy. Trusted by universities, schools, and enterprises worldwide." Las cifras son idénticas. La evidencia que las respalda está muy lejos de serlo.
Pangram nombra su fuente. Sus propias páginas atribuyen la estadística a un estudio comparativo de investigadores de la Booth School of Business de la University of Chicago y de la University of Maryland, y publican un desglose de falsos positivos por género de contenido. Las páginas de Winston no nombran ningún estudio: no hay conjunto de datos, ni tamaño de muestra, ni método para la cifra de 99.98%. Los marcadores de credibilidad allí son insignias de SOC 2 y GDPR y logotipos de prensa, que hablan de la postura de seguridad y de la cobertura mediática, no del rendimiento de detección. El análisis completo de cada afirmación está en las reseñas dedicadas: Pangram revisado y Winston AI revisado.
Las cifras más específicas de las diez las publica Turnitin y son tasas de error, no tasas de precisión: una tasa de falsos positivos a nivel de documento inferior al 1% por encima de su umbral del 20%, una probabilidad de error a nivel de oración de aproximadamente el 4%, y una probabilidad declarada de pasar por alto el 15% del texto generado por IA en un documento, una tasa de omisión publicada que casi nadie cita de vuelta. Cómo funciona el detector de Turnitin y qué significa en la práctica su tasa de falsos positivos se tratan por separado.
GPTZero publica una precisión del 99% y señala RAID, un benchmark de terceros, y una colaboración de investigación con Penn State, lo que lo sitúa un paso por encima de una cifra aislada y un paso por debajo de una cita. Originality.ai publica un 99% en los modelos de IA más recientes, citando su propio estudio y trabajos revisados por pares de terceros, y también publica la frase que debería regir toda esta sección: "Any AI detector accuracy claim that is not transparently supported by methodology, benchmark data, and independent or reproducible analysis should be viewed skeptically." Aplicado de manera uniforme, ese criterio plantea la misma pregunta sobre cada cifra de esta página, incluidas ambas afirmaciones del 99.98%. La cifra de ZeroGPT, por encima del 98% en evaluaciones internas, tampoco tiene una prueba identificada detrás; la revisión de precisión de ZeroGPT rastrea de dónde procede ese número. El 78% de Scribbr es al menos honesto respecto de su escala, aunque la prueba es propia de Scribbr.
El mismo criterio tiene que aplicarse a nuestras propias cifras. TextPulse publica tasas de aprobación medidas del 92.33% en Turnitin AI, 89.12% en Originality.ai y 87.91% en GPTZero para su humanizador académico de IA. Esas son cifras del proveedor a partir de pruebas del proveedor, exactamente como las de Winston y Pangram, y ninguna herramienta de ninguno de los dos lados de este mercado puede prometer lo que un detector informará sobre un documento específico.
Los 10 mejores detectores de IA para la escritura académica
Cada entrada aborda las mismas cuatro cosas: cómo funciona el motor, qué afirma el proveedor, qué muestra la evidencia independiente y quién usa realmente la herramienta. La reseña específica enlazada desde cada sección profundiza más.
1. Turnitin: el valor predeterminado institucional

El indicador de escritura con IA de Turnitin es un clasificador de aprendizaje profundo entrenado con prosa académica. Divide una entrega en segmentos superpuestos de unos pocos cientos de palabras, asigna a cada segmento una puntuación según los patrones estadísticos del texto generado por modelos y agrega los resultados en el porcentaje del documento que ven los instructores. Solo la prosa de formato largo cuenta como texto que cumple los requisitos, las listas con viñetas, las citas y las referencias quedan excluidas.
Turnitin publica tasas de error en lugar de una tasa de precisión: una tasa de falsos positivos del documento inferior al 1% para trabajos por encima de su umbral del 20%, una probabilidad de error de aproximadamente 4% en cualquier oración resaltada individual y una probabilidad declarada de pasar por alto el 15% del texto de IA en un documento. El estudio de la VUB de 2026 fue más severo que las cifras del propio proveedor: Turnitin informó 0% de IA en cada una de las 40 tesis totalmente generadas por IA del conjunto de prueba. Sigue siendo la opción predeterminada porque se integra en el flujo de trabajo de plagio que ya tienen licenciado más de 16,000 instituciones, según el propio recuento de Turnitin, y solo los instructores y administradores ven la puntuación. También es la herramienta más desautorizada de esta página: varias universidades importantes la han desactivado por preocupaciones sobre falsos positivos, recogidas en universities that stopped using Turnitin. How Turnitin detects AI y similarity versus AI score explican la mecánica.
2. GPTZero: la marca más grande del lado del estudiante

GPTZero se lanzó en enero de 2023 como un verificador de perplejidad y variabilidad, y desde entonces ha reconstruido su motor en un clasificador multicapa. Un análisis devuelve un veredicto del documento, una probabilidad dividida entre IA, humano y mixto, un resaltado por oración de los pasajes que impulsan el resultado y una lista de vocabulario de IA. Su página principal afirma 99% de precisión, 17 million usuarios y 1 million educadores; el nivel gratuito acepta aproximadamente 10,000 caracteres por análisis, y la empresa publica una calibración para ESL destinada a reducir las alertas falsas en la escritura en inglés de hablantes no nativos.
Según la evidencia, se sitúa en la zona media. Remite al punto de referencia RAID de terceros y a una colaboración de investigación con Penn State, un paso por encima de una mera afirmación, pero en el estudio de VUB su puntuación mediana en tesis generadas por completo por IA se mantuvo por debajo de 20%, con amplias oscilaciones entre documentos individuales. Es la herramienta que los estudiantes usan con mayor frecuencia para precomprobar sus propios borradores antes de la entrega. Cómo funciona GPTZero recorre el informe capa por capa; GPTZero versus Turnitin explica por qué ambos discrepan sobre el mismo texto.
3. Copyleaks: el detector dentro de tu LMS

Copyleaks vende la detección de IA y la comprobación de plagio como un único producto empresarial, integrado en Canvas, Blackboard y Moodle, con la cobertura lingüística más amplia de las diez: el proveedor enumera más de 30 idiomas con modelos de detección específicos por idioma. Un análisis devuelve un porcentaje del documento con pasajes resaltados. El proveedor afirma más de 99% de precisión con una tasa de falsos positivos de 0.03%, y el escáner gratuito acepta aproximadamente 25,000 caracteres.
El registro independiente es la mitad débil de la propuesta. En el estudio de la VUB, Copyleaks no clasificó ni una sola de las 40 tesis totalmente generadas por IA como escritas totalmente por IA, señaló solo 10 de las 40 siquiera de forma parcial, y mantuvo una mediana de la proporción de IA informada por debajo del 20% en trabajos que eran 100% generados por máquina. Sí aprobó las 40 tesis escritas por humanos, todas de un hablante no nativo de inglés, lo que constituye una prueba genuina a su favor en cuanto a falsos positivos. La reseña de Copyleaks presenta el panorama completo.
4. Originality.ai: diseñado para editores, no para aulas

Originality.ai presta servicio a editores, agencias de SEO y equipos de contenido que revisan textos de autónomos, y cada decisión de diseño se deriva de ese comprador: precios basados en créditos, con un crédito por cada 100 palabras, una API, una extensión de Chrome, complementos de plagio y verificación de hechos, y un control deslizante ajustable de tolerancia de IA que permite a un editor fijar cuánta cantidad de texto asistido por IA es aceptable. Reentrena sus modelos de detección para cada nueva generación de modelos de lenguaje y afirma una precisión del 99% en los más recientes, citando su propio estudio y trabajos revisados por pares de terceros.
Rinde de manera respetable en pruebas independientes, entre las herramientas comerciales más sólidas en el benchmark RAID, y su calibración es deliberadamente agresiva: prefiere señalar en exceso antes que quedarse corta. Ese es el intercambio adecuado para un editor y el incorrecto para un comité de mala conducta, y es lo más importante que hay que entender cuando su puntuación de preanálisis discrepa con lo que después muestra una herramienta universitaria. Originality.ai frente a Turnitin traza ese desfase.
5. Pangram: la única que los estudios independientes siguen favoreciendo

Pangram es la herramienta más reciente aquí y la que los investigadores siguen validando. Su clasificador fue entrenado específicamente para mantener los falsos positivos cerca de cero, y su informe incluye una vista de interpretabilidad que muestra qué frases impulsaron el veredicto. Sus funciones abarcan más de 20 idiomas, carga de archivos con OCR, una extensión del navegador y una integración con Google Docs, y el nivel gratuito analiza hasta 2,000 palabras al día. El proveedor afirma una precisión de 99.98% y una tasa de falsos positivos de 1 en 10,000, publicada con un desglose por género.
De manera inusual, la evidencia independiente apunta en la misma dirección que el marketing. El estudio de VUB de 2026 lo encontró como la única herramienta de las cuatro probadas cuyo puntaje mediano en tesis generadas completamente por IA se acercaba al valor real, y la que mejor se alineaba en trabajos híbridos y humanizados. El documento de trabajo del NBER de investigadores de Chicago Booth y Maryland encontró que era el único detector que mantenía los falsos positivos en 0.5% o por debajo, al tiempo que seguía siendo sólido en texto reescrito. Ambos estudios son recientes y de alcance limitado, pero ninguna otra herramienta en esta página tiene tanta evidencia actual a su favor. La reseña de Pangram examina ambos estudios con detenimiento.
6. Winston AI: la mayor afirmación, la menor evidencia

Winston AI es un detector basado en créditos dirigido a educadores y equipos de contenido. Su conjunto de funciones es práctico: un mapa de calor por oración, OCR que lee páginas fotografiadas y manuscritas, un complemento de plagio y una integración con Google Classroom. La página principal afirma una precisión del 99.98% y más de 10 million usuarios, la cifra de precisión procede de pruebas internas, y no se publica en ninguna parte del sitio ninguna metodología, conjunto de datos ni tamaño de muestra.
El mejor punto de referencia independiente es el benchmark RAID (ACL 2024), donde Winston detectó el 71% del texto de IA en conjunto con una tasa fija de falsos positivos del 5%: excelente en salida al estilo de ChatGPT con 99.6%, mucho más débil en modelos antiguos y de código abierto, y hasta 52.6% en texto parafraseado. Una herramienta competente con un titular inflado. La reseña de Winston AI examina la afirmación en detalle.
7. ZeroGPT: la precomprobación gratuita

ZeroGPT es la precomprobación gratuita con más tráfico: pegue hasta 15,000 caracteres sin cuenta y obtenga un porcentaje instantáneo junto con oraciones resaltadas de lo que denomina tecnología DeepAnalyse. El proveedor afirma una precisión superior al 98% en evaluaciones internas y no nombra ninguna prueba externa. Las comparaciones independientes lo sitúan de forma constante cerca del final del campo comercial, y su puntuación sobre el mismo texto puede variar entre ejecuciones. Como primera mirada aproximada no hace daño; como veredicto, es la herramienta menos defendible de esta página. La reseña de la precisión de ZeroGPT sigue sus afirmaciones hasta sus fuentes.
8. Scribbr: la marca de confianza con un motor con licencia

El comprobador de IA de Scribbr es el motor de detección de QuillBot bajo la marca Scribbr, el panel de resultados muestra la versión del motor, y la página de información de Scribbr sitúa a ambas empresas en la familia Learneo. El nivel gratuito analiza unas 1,200 palabras en el navegador, sin registro, y ofrece un desglose en tres partes entre generado por IA, refinado por IA y escrito por humanos. En la comparación de julio de 2026 de Scribbr, el comprobador gratuito identificó el 78% de los textos de prueba y la versión premium el 84%, con cero falsos positivos en esa muestra.
Esas son las mejores cifras publicadas en el nivel gratuito, y proceden de una prueba que Scribbr diseñó, ejecutó y puntuó por sí misma, en la que su propia empresa hermana quedó empatada en primer lugar. Los estudiantes confían en el comprobador porque las guías de citas y tesis de Scribbr se ganaron esa confianza, y el detector la hereda. La reseña de Scribbr explica qué miden realmente las versiones gratuita y premium.
9. Sapling: la herramienta para desarrolladores

El detector de Sapling procede de una empresa de NLP cuyo negocio principal es la asistencia de escritura para equipos de atención al cliente, y eso se nota, la API más accesible del grupo, puntuaciones de probabilidad por oración con una vista de perplexity, y una extensión del navegador que analiza texto dentro de Google Docs, Gmail, Zendesk y Salesforce. Las comprobaciones gratuitas tienen un límite de 2,000 caracteres, los planes de pago elevan el límite a 100,000.
Su historial independiente es el más volátil de los diez: 68% con cero falsos positivos en la comparación de Scribbr, fallos casi totales en un benchmark de arXiv de 2023, y al menos una revisión práctica que lo vio marcar todo como falso. Las puntuaciones de una sola revisión se generalizan mal para cualquier detector, y Sapling es la demostración más clara. La revisión de Sapling examina por qué.
10. Compilatio: el equivalente institucional de Europa

Compilatio es la suite de plagio y IA que las instituciones europeas licencian allí donde los resúmenes centrados en Estados Unidos dan por supuesto Turnitin: la más sólida en los sistemas francófonos, con la detección de IA integrada en el mismo flujo de trabajo orientado al docente que su comprobación de similitud, y una edición para estudiantes que vende las mismas comprobaciones por crédito. Afirma una tasa de fiabilidad del 94 al 99% y menos del 1% de falsos positivos, y es la única herramienta aquí, aparte de Turnitin, que se sitúa cerca de la cima en una prueba revisada por pares, segunda de catorce en Weber-Wulff y colegas. Si estudia en la UE, el detector que lea su tesis puede muy bien ser este. La revisión de Compilatio explica qué establece y qué no establece esa clasificación.
Humanice su propio artículo
Transforme su texto asistido por IA y hágalo sonar humano, sin tocar palabras importantes ni citas.
iThenticate: el detector sobre el escritorio del editor
Un producto más de Turnitin merece una sección aquí, porque la mayoría de los investigadores lo conocen sin llegar a verlo. iThenticate es la herramienta de revisión de Turnitin para editores, revistas e instituciones de investigación, diseñada para comprobar manuscritos antes de la publicación, en lugar de calificar trabajos académicos. Su propuesta es publicar con confianza: revisar un documento de alto riesgo para detectar una posible mala conducta antes de que se envíe. Miles de revistas académicas procesan las propuestas a través de él mediante el servicio Similarity Check de Crossref, así que, si ha enviado un manuscrito a una revista revisada por pares, es probable que su manuscrito haya pasado por iThenticate, tanto si alguien se lo dijo como si no.

Dos cosas lo distinguen de la fila de Turnitin anterior. Está centrado primero en el documento y no en el curso: no hay clases, no hay tareas, un informe por manuscrito. Y, a diferencia de Turnitin, puede ser comprado por la persona evaluada. Los créditos se venden directamente en el sitio, con precio por documento, lo que lo convierte en la única herramienta de la familia Turnitin que un autor puede usar por su cuenta sobre su propio manuscrito antes de que lo haga una revista. El informe es, ante todo, un informe de similitud, con comparación frente a la literatura publicada y la web, y Turnitin incluye iThenticate entre los productos que incorporan su detección de escritura con IA para los clientes que cumplen los requisitos.
Para un escritor académico, el uso práctico es limitado y real: una comprobación de originalidad previa al envío del manuscrito final, realizada por la misma empresa cuyas herramientas es probable que use la revista. Lo que el informe no hace es corregir nada. Señala solapamientos y probable escritura por IA, y revisar la prosa señalada sigue siendo su tarea, que es precisamente la mitad de la lista de comprobación del envío para la que se ha creado un humanizador académico de IA.
Qué dice la investigación independiente sobre la categoría
Las cifras de los proveedores se agrupan cerca del 99%. La investigación publicada no. Weber-Wulff y sus colegas probaron 14 sistemas en el International Journal for Educational Integrity en 2023, entre ellos Turnitin, y Liang y sus colegas encontraron en Patterns ese mismo año que 89 de 91 ensayos TOEFL de hablantes no nativos de inglés, el 97.8% de ellos, fueron señalados como IA por al menos uno de siete detectores, con 18 señalados por los siete.
La prueba académica más directa de las herramientas anteriores es el estudio de VUB de 2026, publicado en acceso abierto en el International Journal for Educational Integrity: tesis de máster reales, cuatro detectores comerciales y medianas por debajo del 20% en trabajos generados íntegramente por IA para tres de los cuatro. Jabarian e Imas, en el documento de trabajo w34223 del NBER, construyeron un corpus de 1,992 textos humanos anteriores a 2020 y 1,992 textos de IA de cuatro modelos de frontera, y sometieron a pruebas de estrés a Pangram, GPTZero, Originality.ai y una línea base de código abierto: los detectores comerciales superaron a la línea base, y solo una herramienta mantuvo una tasa de falsos positivos igual o inferior al 0.5% al tiempo que seguía siendo sólida en textos reescritos. La línea base de código abierto señaló entre el 30% y el 69% del texto humano, razón por la cual los detectores gratuitos de GitHub no aparecen en la tabla anterior.
OpenAI retiró su propio AI Text Classifier el 20 de julio de 2023, afirmando que "ya no está disponible debido a su baja tasa de precisión". Giray, Roe y Espiritu, publicando en English Teaching: Practice & Critique en marzo de 2026, plantearon con claridad el problema de la equidad: "Estas herramientas señalan de manera desproporcionada la escritura auténtica de estudiantes multilingües, creando un efecto disuasorio que, paradójicamente, fomenta el uso de AI para evitar acusaciones falsas." El patrón que subyace a ese hallazgo está documentado en cómo los detectores tratan la escritura en inglés de hablantes no nativos.
Las instituciones han actuado a partir del historial de falsos positivos. Vanderbilt desactivó el detector de AI de Turnitin en agosto de 2023, razonando que, frente a los 75,000 trabajos que presentó en 2022, una tasa de falsos positivos del 1% implica alrededor de 750 trabajos etiquetados incorrectamente. La documentación de Michigan State afirma que las herramientas de detección de AI no deben ser la única base para adoptar medidas adversas contra un estudiante, y la University of Texas at Austin no respalda en absoluto el software de detección de AI. Qué tan precisos son realmente los detectores de AI, como categoría, es una cuestión distinta de cuál licencia su institución.
El modelo que elude la puntuación, seguimiento del proceso
Una respuesta distinta al problema de los falsos positivos está ganando interés institucional: dejar de puntuar el texto final y registrar, en cambio, cómo se escribió el documento. La función Authorship de Grammarly y la plataforma de evaluación Cadmus funcionan de este modo, capturando el proceso de escritura, la mecanografía, el pegado y el historial de revisiones, a medida que ocurren. Un registro del proceso no puede producir un falso positivo en un ensayo que realmente fue tecleado, que es precisamente el modo de fallo que llevó a las universidades a desactivar los detectores. Las compensaciones son distintas, las cuestiones de vigilancia sustituyen a las cuestiones estadísticas, pero si su institución adopta una de estas opciones, el debate anterior sobre los detectores pasa a ser en gran medida irrelevante para usted: la evidencia es el registro del proceso, no una puntuación de probabilidad.
Cómo leer una puntuación de detector que le hayan entregado
Un número llega casi siempre sin su contexto. Cuatro preguntas bastan para recuperarlo y mantener una conversación sensata.
- Qué herramienta, y qué cifra. Un porcentaje a nivel de documento y un resaltado a nivel de oración conllevan tasas de error publicadas distintas del mismo proveedor, y las de Turnitin son 1% y alrededor de 4% respectivamente.
- Qué publicó el proveedor sobre sus errores. Una herramienta que declara una tasa de omisión y una tasa de falsos positivos le ha indicado dónde están sus límites. Una herramienta que publica solo un porcentaje de exactitud no lo ha hecho.
- Si la puntuación es prueba o un indicio. La formulación de Michigan State, que estas herramientas no deben ser la única base para una medida adversa, es una posición institucional habitual y merece citarse en una apelación. La guía de la carta de apelación muestra cómo.
- Qué dice realmente la política de su institución. Si un detector está licenciado, si su salida puede usarse en un proceso de mala conducta y qué puede solicitar un estudiante, todo eso está escrito en alguna parte, y varía mucho entre universidades.
Qué hace Turnitin con el texto humanizado se responde por separado, junto con un estudio más amplio de alternativas de humanizer.
Los proveedores de detectores seguirán publicando cifras redondas, y la mayoría seguirá negándose a decir de dónde proceden esas cifras. Cuál de estas diez cumple su trabajo lo decide quien lo lee, así que la preparación útil consiste en saber qué publica esa herramienta sobre sus propias tasas de error antes de que alguien le cite un porcentaje. Los precios actuales de TextPulse están en su propia página, actualizados allí y no en un resumen.
Lo que encontró nuestra propia investigación
En el estudio de concordancia entre detectores de TextPulse Research, nueve detectores comerciales de IA calificaron los mismos 90 textos académicos. Uno era un texto híbrido de 455 palabras: una apertura y un cierre escritos por humanos alrededor de una parte central de 168 palabras generada por IA. Copyleaks puntuó este texto con 0% de IA, mientras que los veredictos de las demás herramientas sobre las mismas palabras fueron de 0% a 95.7% de IA. El artículo completo, el corpus y la matriz de puntuaciones por herramienta están en acceso abierto en TextPulse Research.


Preguntas frecuentes
Ninguna afirmación de un proveedor lo resuelve, pero la evidencia independiente más reciente favorece a Pangram: un estudio de 2026 de la Vrije Universiteit Brussel en el International Journal for Educational Integrity encontró que era la única herramienta cuya mediana de puntuación en artículos académicos generados por IA se acercaba al valor real, mientras que GPTZero, Copyleaks y Turnitin arrojaron medianas por debajo del 20%, y un documento de trabajo del NBER encontró que era el único detector que mantenía los falsos positivos en 0.5% o por debajo. Ambos estudios son recientes y limitados en alcance, y la salida de ningún detector es prueba por sí sola.
Content strategist at TextPulse, here since the company started. Mark writes the product and technical coverage: how the humanizer works under the hood, what changes in each release, and what a specification actually means for your writing. His reviews of writing software come from using them on real documents rather than reading a feature list.