Anthropic explica cómo funcionan las marcas de agua invisibles en los textos de Claude

Por: Carmen Ruiz | hoy dia, 01:16

Anthropic ha detallado el funcionamiento de las marcas de agua que aplicará a los textos generados por Claude. La tecnología, basada en el método SynthID-Text publicado por Google DeepMind en la revista Nature en 2024, ya es una exigencia para los proveedores de IA en Europa: el Artículo 50 de la Ley de IA de la UE obliga a marcar el contenido generado por máquinas de forma detectable, con entrada en vigor el 2 de agosto de 2026 para los modelos nuevos y hasta el 2 de diciembre de 2026 para los sistemas ya existentes.

Cómo funciona la marca

El sistema no añade ningún símbolo visible al texto. En su lugar, la IA ajusta sutilmente la probabilidad con la que elige unas palabras frente a otras al generar una respuesta. Cuando varias opciones son igualmente válidas para describir algo, el modelo sigue un patrón predeterminado. Ese patrón es imperceptible para el lector, pero puede detectarse mediante una clave criptográfica. Anthropic también prevé publicar una API de detección, aunque de momento no hay fechas ni detalles sobre su coste.

La marca resiste ediciones menores: si alguien corrige levemente un texto de Claude, la huella suele mantenerse según la extensión del fragmento y el alcance de los cambios. Sin embargo, una reescritura completa —cambiar todas las palabras— elimina la marca. Esta limitación es relevante para medios como El País o RTVE, que podrían usar Claude en redacción asistida y necesitan saber con exactitud qué textos son verificables como generados por IA.

Dónde falla y qué implica en España

El sistema tiene dos puntos débiles claros. El primero afecta al código: como un programa debe funcionar de una manera concreta, el modelo tiene muy poco margen para elegir entre variantes de palabras. La marca solo puede aplicarse con cierta eficacia a comentarios y partes no funcionales del código. El segundo problema afecta a los textos muy cortos: cuanto menos texto genera el modelo, menos oportunidades tiene de insertar el patrón, lo que debilita la huella.

En España, la Agencia Española de Protección de Datos (AEPD) supervisa el cumplimiento del reglamento europeo. Para la prensa regional y las plataformas de reseñas de productos —donde los textos suelen ser breves—, la fiabilidad de esta marca de agua es limitada y puede dar una falsa sensación de seguridad.

Anthropic ha señalado que no será la única en adoptar este enfoque: otros grandes desarrolladores de modelos también han firmado el Código de Buenas Prácticas de IA de la UE y preparan sus propios sistemas de marcado, según Anthropic.

El paso siguiente

La marca de agua invisible es un avance real, pero no una solución definitiva. Su utilidad real dependerá de la API de detección que Anthropic aún no ha lanzado. Hasta que esa herramienta esté disponible —con un coste y unas condiciones de acceso claras—, medios, plataformas y empresas en España no podrán integrarla en sus flujos de trabajo de verificación de contenido.