El 10 de agosto, debido a los nuevos requisitos de la Unión Europea, Anthropic actualizó las normas por las que Claude marca el contenido generado por IA. Se aplican a todos los modelos de IA que se lancen después del 2 de agosto. Ahora la compañía ha explicado cómo funciona exactamente la marca de agua en los textos de Claude.
La esencia del marcado de texto es crear un patrón determinado que es invisible para el usuario común, pero que puede reconocerse si se dispone de la clave.
«Los LLM generan una palabra cada vez. Cada vez que el modelo elige la siguiente palabra, selecciona de una lista de candidatos potenciales, decantándose finalmente por la opción más razonable o probable <...> [normalmente] la elección se determina mediante un número aleatorio. Las marcas de agua se utilizan [para] crear un patrón determinado en las respuestas de Claude»
Al elegir la siguiente palabra, Claude no se basará en el azar, sino en la información de la clave. Así se obtiene una secuencia de tokens con un patrón que puede reconocerse.
El sistema se basa en SynthID-Text, un método que Google utiliza desde 2024. La compañía probó si el marcado afecta a la calidad de las respuestas de la IA, dando a algunos usuarios de Gemini un modelo con marca de agua: según las estadísticas, la mayoría de los usuarios no notaron diferencias.
Anthropic señala que las marcas de agua no afectan a la calidad del trabajo de Claude. Para el lector, una respuesta con marca de agua es indistinguible de una sin ella. Tampoco hay caracteres ocultos, por lo que aplicar la marca no requiere tokens adicionales ni conlleva costes extra.
Además, la compañía destaca que las marcas de agua no contienen información identificativa y no permiten rastrear a una persona, organización o chat concretos.
Sin embargo, para trabajar con código, Claude tiene otras reglas: cuando la elección está entre dar la única respuesta correcta y crear un patrón, la IA opta por la primera opción.
«En los casos en los que se requiere un resultado exacto —cuando no hay elección y elegir otro término llevaría a un error factual o a romper el código—, no se aplica la marca de agua»
Por ahora, Anthropic no tiene modelos de IA que cumplan las nuevas normas. Todos los modelos existentes se lanzaron antes del 2 de agosto. La API para detectar marcas de agua sigue en desarrollo.