Anthropic revela cómo marcará los textos de Claude

Anthropic marcará textos de Claude con una señal invisible para facilitar su detección, sin costo adicional ni datos personales.

Anthropic ha dado nuevos detalles sobre la marca de agua que incorporará en los textos generados por Claude a escala mundial, una medida que busca facilitar la identificación de contenido creado con inteligencia artificial. La tecnología estará presente en la aplicación y la web, pero también en la API, Claude Code, Claude Cowork y Claude Tag, por lo que afectará tanto a usuarios particulares como a organizaciones. El anuncio de Anthropic vuelve a colocar a la compañía en el centro del debate sobre transparencia.

La decisión llega después de que el laboratorio se sumara al Código de Buenas Prácticas sobre la Transparencia del Contenido Generado por IA, vinculado con la Ley de Inteligencia Artificial de la Unión Europea. Aunque la empresa presentó la medida como un mecanismo de transparencia, la reacción de algunos usuarios fue negativa y, según Business Insider, hubo clientes que incluso cancelaron sus suscripciones, lo que añadió una dimensión comercial a una decisión planteada inicialmente como una herramienta técnica.

¿Cómo funcionará la marca de agua?

El sistema elegido es una versión de SynthID-Text, una tecnología desarrollada por Google DeepMind que permite introducir una señal estadística sin modificar de manera visible el contenido. Anthropic explicó que el mecanismo aprovecha elecciones de bajo riesgo entre palabras igualmente válidas y cambia la fuente de aleatoriedad mediante una clave matemática, de modo que el patrón queda oculto para quien lee el texto; además, Anthropic señala que esa clave permite reconocer la señal posteriormente.

En términos prácticos, la herramienta utiliza las palabras previas y una clave para influir en la selección de la siguiente palabra cuando existen varias opciones adecuadas. El proceso permite construir una huella reconocible mediante un análisis estadístico, pero no altera el significado ni añade una etiqueta visible al documento, por lo que el lector no podrá identificar la marca simplemente revisando la respuesta, mientras que Anthropic busca que el sistema funcione de manera integrada y sin cambiar la experiencia habitual.

¿La marca de agua tendrá un costo para los usuarios?

Una de las principales dudas estaba relacionada con el posible costo técnico de esta medida, especialmente para quienes utilizan la API de forma intensiva. La compañía sostiene que la incorporación de la marca de agua no genera latencia adicional, no aumenta el consumo de tokens y tampoco implica un sobrecoste por las respuestas, mientras que Anthropic también afirma que no conserva datos personales del usuario o de la organización asociados al chat; la precisión técnica forma parte del argumento con el que Anthropic busca reducir las dudas.

El funcionamiento tampoco debe interpretarse como una prueba definitiva de autoría. La compañía ha precisado que el detector ofrecerá una probabilidad de que un texto haya pasado por Claude cuando encuentre una señal suficiente, pero la ausencia de esa señal no demuestra que el contenido haya sido escrito por una persona, una diferencia importante para evitar falsas conclusiones y para entender los límites de cualquier herramienta de detección de inteligencia artificial.

¿Habrá un detector universal para identificar textos de IA?

Otro punto relevante es que no existirá un detector universal capaz de reconocer cualquier texto generado por inteligencia artificial. Anthropic utilizará una clave propia, diferente de las empleadas por otros sistemas como ChatGPT o Gemini, por lo que cada tecnología de detección dependerá de la marca que haya sido incorporada por el modelo correspondiente y de las herramientas disponibles para identificarla; esto impide asumir que un detector diseñado para una plataforma servirá automáticamente para otra.

La longitud del contenido también será determinante para la fiabilidad del análisis. Mientras más palabras tenga un texto, más oportunidades existen para construir y reconocer el patrón estadístico, mientras que en respuestas muy cortas la señal será débil porque no hay suficiente material para establecer una coincidencia con un nivel de confianza elevado; por esa razón, una respuesta breve no debe interpretarse automáticamente como contenido sin marca ni como evidencia de que fue escrito por una persona.

¿Qué pasará con el código y las correcciones?

El sistema tendrá además limitaciones en determinados tipos de contenido. En el código y en tareas de corrección, por ejemplo, la marca no puede incrustarse de la misma manera porque no existe la misma libertad para elegir entre palabras equivalentes, una condición necesaria para modificar la aleatoriedad sin afectar el resultado que necesita el usuario; Anthropic considera esta diferencia relevante para explicar por qué no todos los contenidos tendrán la misma señal.

Las traducciones sí tendrán una característica distinta, porque la compañía confirmó que incorporarán la marca de agua. La razón es que en ese proceso cada palabra es seleccionada por el modelo, lo que permite aplicar el mecanismo estadístico con mayor facilidad que en una tarea donde el sistema debe conservar una estructura o una secuencia previamente determinada, por lo que el objetivo será mantener una señal identificable sin modificar de forma visible el resultado final.

¿Cuándo estará disponible la detección?

Para los usuarios, el cambio significa que los textos generados por Claude podrán incorporar una señal invisible que en el futuro será más fácil de consultar mediante herramientas específicas. Anthropic adelantó que lanzará próximamente una API de detección, una herramienta que podría ser utilizada por plataformas, empresas, investigadores y desarrolladores interesados en analizar el origen probable de determinados contenidos; esa futura herramienta será especialmente relevante para quienes necesitan verificar grandes volúmenes de texto.

El debate de fondo está relacionado con la transparencia y los límites de la detección de contenido generado por IA. Anthropic busca que la tecnología permita identificar patrones sin introducir marcas visibles ni recopilar información personal, pero sus propias explicaciones muestran que el sistema no será infalible, especialmente con textos breves, código, correcciones o materiales que hayan sido modificados después de su generación; el reto será utilizar la señal como indicio y no como una prueba absoluta de autoría.

Una medida como un cambio importante

La medida representa un cambio importante en la forma en que los textos producidos por modelos de inteligencia artificial podrán ser identificados, aunque no significa que cada respuesta vaya a quedar acompañada de una etiqueta visible. El sistema dependerá de una señal estadística, será más fiable cuanto mayor sea el contenido y tendrá restricciones en determinados formatos, mientras que la futura API podría ampliar las posibilidades de análisis para empresas, investigadores y plataformas digitales.

La decisión también refleja una tendencia más amplia de la industria hacia mecanismos que permitan distinguir contenido generado por modelos sin afectar directamente la experiencia del usuario. Anthropic apuesta por una tecnología que no incremente costos ni consuma información personal, pero la propia compañía reconoce que detectar una señal no equivale a demostrar quién escribió un texto; por ello, su utilidad estará principalmente en aportar una evidencia probabilística dentro de procesos de verificación más amplios.

VER MÁS
- Advertisment -

RELACIONADOS

TE PODRÍA INTERESAR