17 de agosto de 2026
# Anthropic cuenta cómo marca sus textos, y dónde no los marca

El otro día publicábamos aquí [[Posts/2026.08/13-marca-de-agua-en-un-texto.md|Cómo se le pone una marca de agua a un texto]], y cerrábamos con una suposición: Anthropic no contaba cómo marca lo que escribe Claude, pero se parecería a los sistemas que sí están publicados. Pues han tardado poco. El 14 de agosto ha salido un artículo entero de preguntas y respuestas, y la suposición se quedaba corta: **es el mismo sistema**. El SynthID-Text de Google DeepMind, que en el post anterior iba de precedente ajeno, resulta ser lo que usan.
Así que **este post es la segunda parte** del otro, y hay alguna novedad mejor de lo que esperaba.
## Es SynthID-Text, el sistema de Google DeepMind

La frase que resume el asunto la dan ellos, y es exactamente lo que os conté en el otro post: *the watermark only changes the source of the randomness used to pick among words*. La marca solo cambia la fuente del azar con el que se elige entre palabras. No añade nada al texto, no mete caracteres escondidos entre las letras y no toca el significado.
El mecanismo, en corto: el modelo escribe palabra a palabra, en cada paso hay varias candidatas que encajan igual de bien, y esa elección normalmente la resuelve un número al azar. Con marca, ese número sale de una clave secreta y de las palabras anteriores. El resultado sigue pareciendo azar puro desde fuera, pero quien tiene la clave puede repasar la secuencia y ver si encaja.
Y ahora la genealogía, que viene de más atrás de lo que contamos. La marca de Claude es una versión de **SynthID-Text**, el sistema que Google DeepMind publicó en *Nature* en 2024. Ese sistema pertenece a una familia que arranca en una propuesta de Scott Aaronson de 2022, es decir un año antes del grupo de Maryland que poníamos como origen. Todas comparten el mismo principio de diseño.
De paso confirman la lista de cosas que no pasan: no hay caracteres ocultos, no se generan tokens extra, no cuesta más, no ralentiza el modelo de forma apreciable y no hay diferencia de calidad para quien lee. Y las pegas son las mismas: la marca nunca es concluyente, un texto corto no da para nada, y una reescritura completa elimina la marca de agua, obviamente. Sobre esto último añaden una línea que me ha gustado, porque es la respuesta franca: si has reescrito cada palabra, ya se puede discutir si eso sigue siendo un texto generado por IA.
Con todo, lo que decíamos en el post anterior sigue en pie a medias. Dicen "una versión de SynthID-Text", y ese *una versión* se queda sin desarrollar en ningún sitio: no publican la variante exacta, ni los parámetros, ni nada sobre la clave. Sigue sin haber documento técnico de Anthropic, y sin él no se puede comprobar nada.
## La partida de Monopoly con los dígitos de pi

La analogía la usan ellos y es la mejor parte del artículo, así que os la traigo con sus pasos.
Estáis jugando al Monopoly. Cada jugador avanza las casillas que le salgan en el dado, y ese dado es lo que pone el azar en la partida. Ahora cambiamos una cosa y solo una: en vez de tirar el dado, tenéis delante un libro con los dígitos de pi. Empezáis por un dígito cualquiera, pongamos el 1.012.845 después de la coma, que resulta ser un 6. A partir de ahí, cada jugador avanza lo que diga el siguiente dígito de la lista.
Para la partida no cambia nada. Los números salen igual de desordenados, nadie puede predecir el siguiente y quien mira la mesa no nota absolutamente nada. El juego es el mismo y el resultado es igual de imprevisible que con el dado.
Pero al acabar sí hay diferencia. Si alguien apunta la secuencia entera de movimientos y conoce pi, puede comparar y ver que esos números son justo los que van a partir del dígito 1.012.845. Con una tirada suelta no probaría nada, porque cualquier número está en pi en alguna parte. Con la partida entera delante, la coincidencia deja de ser casualidad y esa partida está marcada, aunque durante el juego nadie lo notara.
Con el texto pasa igual, y las palabras hacen de tiradas. Claude sigue eligiendo entre las candidatas que valen, como siempre, pero el azar con el que decide sale de la clave. Quien tenga la clave puede repasar el texto entero después y calcular la probabilidad de que salga de ahí.
## Dos matices que faltaban

Ya que hay documentación nueva, dos correcciones a lo mío.
La primera. Escribí que, cuando hay empate, el modelo tira siempre del grupo verde, y eso deja entender que la marca tiene palabras favoritas. No las tiene. Anthropic lo aclara con su ejemplo del tiempo: si la frase habla de un día nublado, en un sitio puede salir *overcast* y en el siguiente *grey*, según lo que venía antes. El reparto se recalcula en cada posición, así que la palabra premiada cambia todo el rato y no hay ningún sesgo fijo hacia una en concreto.
Va con un detalle que explica que la calidad no baje. La marca nunca empuja a Claude hacia una palabra que no habría considerado igualmente. Ellos ponen el ejemplo de *nubilous*, un sinónimo rarísimo de nublado que Claude no usaría jamás. La marca de agua solo elige entre candidatas que ya estaban bien.
La segunda corrección importa más, y es el hilo de todo lo que viene después. Escribíamos que la marca queda "repartida por todo el texto". Es bastante más **desigual** que eso. Hay pasajes donde apenas se aplica, y no por un fallo del sistema, sino por cómo está hecho: donde no hay elección no hay nada que marcar.
## Donde el texto tiene que ser exacto

Esta parte creo que es la más útil de todo el artículo, y es de la que menos se ha hablado.
Pongamos que Claude escribe "la obra más famosa de Isaac Newton se llama *Principia*...". ¿Cuál es la palabra siguiente? Solo hay una, que es ***Mathematica***. No hay dos candidatas que valgan igual, no hay empate y no hay libertad sobrante. Y no es que la marca se aplique mal: es que ahí no se aplica.
Lo mismo con "2 + 2 =". Después de eso, el mejor token siguiente es "4" y no hay ningún otro que compita. Anthropic mete aquí una broma interesante: salvo que estés hablando del *1984* de Orwell, donde el mejor siguiente token es "5".
Así que en los pasajes de datos casi no queda marca. Fechas, nombres propios, cifras, citas literales, definiciones, resultados. Cuanto más exacto tiene que ser el texto, menos sitio queda para meter nada.
## El código sale casi limpio

Si esto lo lleváis al código, sale una consecuencia práctica.
En programación, el texto tiene que ser exacto casi siempre. Un nombre de función es el que es, la llamada a una librería es la que es, y cambiar un término por otro que suena equivalente rompe el programa o le cambia el sentido. En todo eso la marca no se aplica, por la misma razón que en *Principia Mathematica*: no hay dos opciones que valgan igual.
¿Dónde queda entonces la marca? En los comentarios, y en los pocos sitios donde el nombre es arbitrario de verdad. Anthropic lo dice con todas las letras: sobre el código en sí el efecto es insignificante.
Traducido a vuestro día a día, lo que sale de Claude Code va **prácticamente sin marcar**. Si alguien contaba con esto para saber qué parte de un repositorio la ha escrito un modelo, no va a servir, y no por dejadez de nadie: el mecanismo no da para más. La trazabilidad del código habrá que buscarla donde siempre, que es en el control de versiones y en quien firma el commit.
## Corregir lo tuyo no deja marca, traducirlo sí

Estos dos casos son la misma regla vista desde los dos extremos, y hay que leerlos juntos para que no parezcan dos reglas distintas.
Si le das a Claude un texto tuyo y le pides que te arregle la gramática y las comas, casi todas las palabras que te devuelve siguen siendo tuyas. La marca solo tiene el puñado de correcciones que ha hecho, y con un puñado no hay nada que medir. Depende de la longitud del texto y de cuánto lo haya tocado, pero lo normal es que su participación no se detecte. Cuanto más escribe Claude, más decisiones toma, y más sitio hay para la marca. En el post anterior lo conté de otra manera y esta es más precisa.
Y ahora el otro extremo. Las **traducciones sí van marcadas**, y van marcadas a tope, porque en una traducción todas las palabras las elige Claude. Tú pones el significado y él pone cada palabra, una detrás de otra, así que hay miles de decisiones libres y el patrón se mete en todas.
Fijaos en lo que sale de ahí, que no es nada intuitivo. Un texto vuestro repasado por Claude pasa por humano sin problema, y el mismo texto traducido por Claude sale marcado de arriba abajo, aunque la idea sea vuestra en los dos casos.
## La marca no identifica a nadie, y lo que falta por llegar

Dos cosas que agradezco que digan tan claras. La marca **no identifica a nadie**: ni a la persona, ni a su empresa, ni al chat donde se generó el texto. No hay nada en la marca ni en la clave que permita recuperar eso, y no depende de la buena voluntad de nadie, porque el mecanismo no lleva ese dato dentro.
Tampoco cambia de quién es el texto. Ni la propiedad ni la responsabilidad legal se mueven un milímetro. La marca solo ayuda a comprobar si Claude ha estado por medio en algún momento, y ni siquiera distingue entre "esto lo ha escrito Claude" y "esto lo ha editado Claude a fondo".
Y quedan tres cosas pendientes. Van a ofrecer una API de detección, todavía sin detalles de implementación. Van a dar también una herramienta propia donde sueltas un fichero y compruebas sus credenciales C2PA, que es la otra pata del asunto y va por metadatos, no por palabras. Y los modelos anteriores al 2 de agosto de 2026 entran en el periodo transitorio que da la ley europea, así que les añadirán la marca en los próximos meses.
Queda una respuesta suya que me parece muy franca. La marca se aplica en todo el mundo, no solo en Europa, y explican por qué: todavía no tienen una forma duradera de limitarla por región. Dicen que van a seguir mirándolo y que contarán lo que salga.
Y por si alguien piensa que esto va de Claude, no va de Claude. En julio de 2026 se firmó el Código de Buenas Prácticas de la UE sobre transparencia en contenido generado con IA, y lo firmaron unos **190**. Ahí están varios de los grandes, y cada uno pondrá su propia marca con su propia clave. Tenéis [[El Abismo de Máquina/Ecos/2026.08/Eco-Como-Marca-Claude-Contenido-IA|el primer artículo de soporte con su resumen]] en el Eco del otro día.
## Los detectores de IA buscan otra cosa

La comparación con los detectores comerciales tipo Pangram la meten ellos, y aclara bastante en qué se diferencian dos cosas que la gente mete en el mismo saco.
Un detector comercial no tiene la clave de Anthropic, así que no puede hacer esta comprobación. Busca otra cosa distinta de raíz: los tics del lenguaje. Las construcciones que los modelos repiten sin darse cuenta y las palabras que usan mucho más de lo que las usaría una persona. Es estilo contra firma, y son dos preguntas diferentes.
Los dos ejemplos que dan son muy jugosos. Uno es la construcción "this isn't [X], it's [Y]", el molde de negar una cosa para afirmar la contraria. El otro es el adverbio "quietly", que según ellos sale muchísimo más de lo que cabría esperar.
El primero lo conozco bien. En el sistema con el que escribo esta web tengo una lista de fórmulas prohibidas desde hace meses, y una de ellas es "la pregunta no es...", que es ese mismo molde en español. La metí ahí leyendo borradores míos que sonaban a plantilla, no leyendo ningún estudio. Que Anthropic la ponga ahora como ejemplo de tic detectable me deja bastante tranquilo respecto al oído.
## Donde menos marca queda
El post del otro día acababa en algo que me pareció raro: la marca funciona mejor con lo que menos trabajo lleva, que es copiar y pegar tal cual, y desaparece en cuanto alguien reescribe el texto a su manera.
El artículo nuevo lo confirma y añade el otro lado. La marca también es más débil donde el texto es más exigente. En un dato exacto no se aplica, porque solo hay una palabra correcta. En el código casi no se aplica, por la misma razón. En un texto que ya era tuyo y solo se ha repasado tampoco, porque las palabras son tuyas.
Cuanto más apretado y verificable es lo que escribes, menos marca queda. Cuanto más suelta y sustituible es la prosa, más. No sé si eso dice algo de la marca o de la prosa, o un poco de las dos. Me quedo pensándolo.
---
Publicado el 17 de agosto de 2026, [LinkedIn](https://www.linkedin.com/pulse/anthropic-cuenta-c%25C3%25B3mo-marca-sus-textos-y-d%25C3%25B3nde-los-hurtado-tor%25C3%25A1n-0brfe), [Substack](https://davidhurtado.substack.com/p/anthropic-cuenta-como-marca-sus-textos?r=4uyjfg&utm_campaign=post&utm_medium=web&showWelcomeOnShare=true), [X](https://x.com/dhtoran/status/2089241115132063898?s=20)