AI Detection

La marca de agua de Claude: dónde reside y qué prueba

Anthropic comenzó a marcar la salida de texto de Claude el 11 de agosto de 2026. Casi toda explicación posterior ha descrito mal el mecanismo. La marca no es un carácter oculto en la página, sino un sesgo estadístico en las palabras que el modelo eligió, y esa diferencia lo decide todo: qué la conserva, qué la elimina y cuánto establece realmente un resultado positivo sobre quién escribió un documento.

10 min
Diagram contrasting a hidden-character watermark with a sampling watermark carried in the model's word choices

La mayor parte de lo que se ha escrito sobre la marca de agua de Claude desde agosto describe un mecanismo que no es el que Anthropic lanzó. La explicación habitual habla de un carácter invisible oculto entre las palabras, un espacio de ancho cero o un glifo Unicode parecido, a la espera de que un detector lo encuentre. Esa sería una conjetura razonable. También es incorrecta, y el error no es académico: es la razón por la que toda una categoría de herramientas gratuitas comercializadas como eliminadores de marcas de agua no tiene ningún efecto sobre esta marca en particular.

La marca de Anthropic reside en la elección de las propias palabras. No se inserta nada en el texto. Una vez que esto queda claro, las preguntas prácticas se responden por sí solas de una manera en que no pueden hacerlo mientras siga vigente la idea del carácter oculto, incluidas cuáles operaciones transmiten la marca, cuáles la eliminan y qué está diciendo realmente un detector cuando informa de una coincidencia.

Lo que sigue se extrae de la propia documentación de Anthropic y no de la cobertura que la rodea, y es deliberadamente específico respecto de los límites que la propia empresa establece.

Anthropic's Claude support article on how Claude marks AI-generated content: embedded watermarks in text and signed provenance metadata under the EU AI Act code of practice
La propia documentación de Anthropic sobre el plan de marcado: marcas de agua incrustadas en el texto más metadatos de procedencia firmados, con los nuevos modelos marcando desde el primer día conforme al calendario del EU AI Act.

Qué activó Anthropic, y cuándo

Anthropic comenzó a marcar la salida de Claude el 11 de agosto de 2026. Su artículo del centro de ayuda sobre el tema describe la marca de texto como "an imperceptible watermark directly into the text itself", y afirma que un lector "won't see it, and it doesn't change the meaning, quality, or readability".

La cobertura es amplia. Los modelos lanzados a partir del 2 de agosto de 2026 llevan marcado desde su publicación, y Anthropic enumera las superficies como la Claude Platform API, Claude, Claude Code, Claude Cowork y Claude Tag, incluido Claude al que se accede a través de AWS, Google Cloud y Microsoft Foundry. Se aplica a escala global. Considerar que cualquier texto redactado antes de agosto está automáticamente exento no es prudente, ya que la empresa ha descrito la incorporación de modelos anteriores durante un período de transición.

El impulso regulatorio que lo sustenta es el Artículo 50 de la EU AI Act, cuyas obligaciones de transparencia exigen que los proveedores de sistemas generativos marquen la salida legible por máquina. Anthropic firmó el Código de Práctica del Artículo 50(2). Conviene señalar que la regulación rige los sistemas utilizados dentro de la Unión Europea y no contiene nada que obligue a una aplicación mundial. Anthropic aplicó la marca en todas partes de todos modos, lo cual es una decisión de política y no un requisito legal, y por eso un investigador en Kuala Lumpur o Chicago queda cubierto por una norma europea.

La marca es un patrón de elecciones de palabras, no un carácter oculto

En cada paso de la generación de texto, un modelo de lenguaje elige entre varias continuaciones que, según sus propias estadísticas, son casi equivalentes. Cuando una palabra es tan buena como otra, algo tiene que desempatar. Un watermark de muestreo desempata esas opciones según una clave que posee el proveedor, de modo que, a lo largo de una secuencia razonable de texto, las elecciones acumuladas forman un patrón que un detector con la misma clave puede medir.

No se añade nada a la página. No hay ningún carácter que encontrar, ningún campo de metadatos en el texto, ningún artefacto de formato. Las palabras que está leyendo son el watermark, en el sentido específico de que la marca es el registro de qué palabras fueron seleccionadas entre las alternativas. Por eso Anthropic puede afirmar que la marca no cuesta nada en significado ni en legibilidad: nunca tuvo que distorsionar la prosa, solo preferir repetidamente una formulación aceptable frente a otra formulación aceptable.

También explica la durabilidad. Anthropic dice que la marca "will travel with the text when it's copied and pasted elsewhere", y la razón es estructural más que ingeniosa. Copiar preserva tus palabras. Reformatear preserva tus palabras. Cambiar la fuente, exportar a PDF, pegar en otro editor, convertir a texto sin formato: todo ello preserva la secuencia de palabras, y la secuencia de palabras es lo que se mide.

Por qué los limpiadores de caracteres invisibles no tienen efecto sobre ella

Un gran número de herramientas gratuitas ahora se anuncian como eliminadores de marcas de agua de IA. Casi todas hacen una sola tarea: buscar Unicode de ancho cero, espaciado invisible y glifos de apariencia similar, y luego borrar lo que encuentran. Esa era una respuesta sensata a un problema real, ya que algunos sistemas incorporan de verdad la procedencia en los caracteres, y es la herramienta correcta para eliminar artefactos de formato residuales del texto pegado.

Frente a una marca de agua por muestreo no consigue absolutamente nada. Pasa un fragmento de Claude por un limpiador de caracteres y todo carácter invisible desaparece, mientras que el fragmento se mide exactamente igual que antes, porque no cambió ni una sola palabra. La herramienta está buscando en un lugar donde la marca nunca ha estado. Este es el malentendido más importante que circula, y cualquiera que dependa de un eliminador de caracteres para este fin obtiene un resultado que parece una acción y no lo es.

El punto general se sitúa junto a la cuestión más amplia de cómo funcionan realmente los detectores de IA, aunque una marca de agua con clave es un animal distinto de un clasificador estadístico. Un clasificador adivina a partir de la forma de la escritura. Una marca de agua lee una señal que fue plantada deliberadamente, lo que la hace mucho más precisa respecto de lo que detecta y no mejor en absoluto para decirte quién escribió el documento.

El segundo mecanismo, que se aplica a archivos y no a texto

Anthropic ejecuta dos sistemas, y la cobertura los ha fundido en gran medida en uno solo. Junto con la marca de agua textual, los archivos producidos por Claude pueden llevar "signed provenance metadata" conforme al estándar abierto de la Coalition for Content Provenance and Authenticity (C2PA).

Esta mitad funciona de manera opuesta a la primera. Los metadatos C2PA se adjuntan al archivo en lugar de entretejerse en la prosa, por lo que es relativamente fácil perderlos: si se copia el texto fuera del archivo, los metadatos se quedan atrás, ya que nunca estuvieron en las palabras. Los dos sistemas tienen fortalezas invertidas. La marca textual sobrevive a los cambios de ubicación y resiste la edición casual. La firma del archivo es precisa y verificable, pero no sobrevive al acto ordinario de seleccionar un pasaje y pegarlo en un documento propio.

Humanice su propio artículo

Transforme su texto asistido por IA y hágalo sonar humano, sin tocar palabras importantes ni citas.

Empezar gratis

Qué establece en realidad una detección positiva

Mucho menos de lo que implica la palabra "detección", y Anthropic es inusualmente directa al respecto. Su documentación afirma que "detecting a Claude mark tells you that the content may have been processed by Claude" y que "does not, on its own, confirm the full provenance".

Léase esto con atención, porque cumple una función precisa. Procesado, no escrito. Un resultado positivo es compatible con un documento que Claude redactó desde cero. También es compatible con un documento que usted escribió y pidió a Claude que afinara. La señal no tiene forma de separar esos casos, porque en ambos Claude generó los tokens que acabaron en la página.

Las limitaciones también operan en la otra dirección. Anthropic señala que las marcas pueden no sobrevivir a una edición intensa, a la conversión de formato o a pasajes muy breves, y que la ausencia de una marca no indica que el contenido no haya sido generado por IA. Así pues, un resultado negativo no establece casi nada: el texto puede haber procedido de otro modelo, de un Claude anterior o de Claude tras una revisión suficiente como para eliminar la señal. La detección está prevista a través de la propia interfaz de Anthropic, en lugar de exponerse a terceros, por lo que los detectores de IA de propósito general no leen esta señal y no cabe esperar que lo hagan.

OperaciónEfecto sobre la marca de agua del textoPor qué
Copiar y pegarSe mantieneSus palabras se preservan exactamente
Reformatear, cambiar la fuente, exportar a PDFSe mantieneCambian la presentación, no la secuencia de palabras
Eliminar caracteres invisiblesSin efectoLa marca nunca se almacenó en un carácter
Edición ligera de copiaPor lo general se mantieneSobreviven la mayoría de las palabras, así que sobrevive la mayor parte del patrón
Reescritura sustancialSe descomponeNuevas palabras significan nuevas elecciones, no vinculadas al original
Traducción a otro idiomaSe descomponeLa secuencia de tokens se reconstruye desde cero
Extractos muy brevesNo es fiable en ningún sentidoUna medición estadística necesita un tramo de texto para concluir algo

El problema de atribución que esto crea para las personas que escribieron su propio trabajo

La respuesta más contundente al anuncio no vino de nadie que intentara disfrazar un trabajo escrito por una máquina. Vino de abogados, investigadores, académicos y editores que usan el modelo como usarían a un editor de copia, y que advirtieron lo que registra la marca.

Considere el caso ordinario. Usted escribe un párrafo. El argumento es suyo, la evidencia es suya, la estructura es suya. Pide a Claude que ajuste el ritmo y recorte doscientas palabras. Lo que vuelve es su párrafo, marcado, y la marca no puede decir que casi todo el pensamiento y la mayor parte de la formulación ya estaban allí antes de que el modelo lo viera. Si una institución, editorial o empleador trata un positivo como prueba concluyente de autoría de IA, lo cual es una lectura más fuerte de la que admite la propia formulación de Anthropic, el escritor queda obligado a discutir una señal que nunca fue diseñada para responder a la pregunta que se le plantea.

Esa es una cuestión genuina de atribución y no una cuestión de ocultación, y conviene decirlo con claridad porque ambas se confunden constantemente. Querer que tu propio argumento se te atribuya no es lo mismo que querer ocultar cómo se produjo un documento. Sea cual sea la política de divulgación que exija tu institución, sigue exigiéndola: eliminar una marca no cambia nada de lo que debes a un lector en una declaración de uso de IA.

Qué elimina la marca y qué solo parece hacerlo

Un principio lo abarca todo. Cualquier operación que deje tus palabras intactas conserva la marca. Cualquier operación que produzca de nuevo las palabras desde cero la rompe. Todo lo demás se sigue de ahí.

Copiar, reformatear, convertir tipos de archivo y eliminar caracteres invisibles dejan intactas las palabras, así que todas esas operaciones conservan la marca. La traducción y la reescritura sustancial producen de nuevo las palabras, así que ambas la rompen, y Anthropic ha reconocido que una edición intensa puede hacer desaparecer la marca. Reescribir a mano funciona perfectamente bien si tienes tiempo para ello, lo que en el caso de un capítulo completo la mayoría de las personas no tiene.

Este es el mecanismo en el que se basa nuestro free Claude watermark remover. Reconstruye un pasaje frase por frase mediante un modelo distinto, de modo que cada token se genera de nuevo y una señal vinculada al muestreo de Claude no tiene ya nada a lo que adherirse. Los comienzos cambian y el orden de las cláusulas se desplaza, mientras que las cifras, las fechas, los nombres, las cautelas y el vocabulario del campo se mantienen fijos, y el material citado y las referencias se copian exactamente en lugar de reformularse. Una consecuencia de esa última regla conviene conocerla de antemano: una cita larga extraída de Claude conserva la marca con la que llegó, porque reproducir una cita con exactitud es la más importante de las dos obligaciones.

Para documentos más largos, o para trabajos académicos en los que el registro y la gestión de citas tienen más peso que en la prosa general, el mismo enfoque de reconstrucción se aplica a un manuscrito completo en el humanizador de TextPulse, que fue creado específicamente para la escritura de investigación y trata las citas, los términos definidos y el vocabulario técnico como puntos fijos.

Si tu propia escritura ha sido marcada

Empieza por ser preciso acerca de lo que estás viendo. Una marca significa que Claude procesó el texto en algún momento. No clasifica cuánto del documento es tuyo, y la propia formulación de Anthropic te respaldará en eso si la conversación se vuelve formal.

Conserva cualquier evidencia de proceso que ya tengas. El historial de borradores, los archivos de versión, las notas y los esquemas hablan de autoría de una manera que una señal de procedencia no puede, y son considerablemente más persuasivos que un argumento sobre estadísticas. Si tu trabajo tiene que salir bajo tu propio nombre y la marca crea un problema real de atribución, reconstruir el pasaje con tus propias palabras lo resuelve, tanto si lo haces a mano como con una herramienta, y lo resuelve precisamente porque reconstruir es lo único que afecta a este tipo de marca.

Anthropic seguirá cambiando los detalles. La cobertura sigue ampliándose a modelos más antiguos, la detección sigue desarrollándose, y el panorama regulatorio que la rodea es más reciente que la tecnología. La parte que es poco probable que cambie es el mecanismo, y saber que la marca reside en la elección de palabras y no en un carácter oculto es lo que separa un paso que hace algo de un paso que solo parece hacerlo. Si quieres ver la misma cuestión desde el lado del clasificador en lugar del lado de la marca de agua, el vocabulario que delata la escritura de AI ante un lector humano es otra señal distinta, y una que ninguna clave puede medir.

XLinkedInFacebook

Preguntas frecuentes

Es una marca estadística que Anthropic incorpora en la salida de texto de Claude, aplicada desde el 11 de agosto de 2026 a todos los modelos lanzados a partir del 2 de agosto de 2026. En lugar de insertar algo en la página, sesga la elección del modelo entre palabras casi equivalentes según una clave que Anthropic posee, de modo que un pasaje lo bastante largo presenta un patrón medible. Anthropic la describe como una marca de agua imperceptible entretejida directamente en el texto que no altera el significado, la calidad ni la legibilidad.

Mark

Content strategist at TextPulse, here since the company started. Mark writes the product and technical coverage: how the humanizer works under the hood, what changes in each release, and what a specification actually means for your writing. His reviews of writing software come from using them on real documents rather than reading a feature list.

Mantente al día sobre la humanización con AI

Recibe en tu correo consejos sobre redacción académica, detección de AI y humanización.

Sin spam. Cancela la suscripción en cualquier momento.