Claude de Anthropic incorporará una marca de agua en textos generados por IA

La empresa Anthropic ha anunciado que todos los modelos de Claude lanzados a partir de este mes incorporarán una nueva funcionalidad. Esta permitirá que los textos generados incluyan una marca de agua imperceptible, lo que los identificará como productos de inteligencia artificial.

Además, se marcarán en los metadatos todos los archivos generados que formen parte de la respuesta. Este método es similar al que utilizan otros motores generativos para vídeos o fotografías.

Implementación de la Marca de Agua

La marca de agua se aplicará en todos los productos construidos sobre Claude, incluyendo la API y herramientas como «Claude Cowork». También funcionará cuando se acceda a sus modelos a través de servicios de terceros, como AWS o Google Cloud. Esta marca perdurará incluso si se copia y pega el texto o se realizan pequeñas ediciones.

La motivación detrás de esta iniciativa se basa en el artículo 50 del Reglamento Europeo de Inteligencia Artificial, que exige que el contenido sintético sea detectable automáticamente. Este reglamento también requiere que los deepfakes y ciertos textos sobre asuntos de interés público estén debidamente etiquetados.

Normativas y Estándares

Actualmente, no existe una técnica que cumpla completamente con los requisitos de la norma. Sin embargo, Anthropic confía en que la combinación de marca de agua e identificación con metadatos será suficiente para alinearse con el espíritu del acuerdo firmado por varias empresas tecnológicas en Bruselas. Los metadatos seguirán el estándar abierto C2PA, que permite también detectar si un archivo ha sido manipulado.

Por su parte, Google ha desarrollado un sistema alternativo llamado SynthID, que ha sido adoptado por otras compañías como Apple, ElevenLabs, Kakao, Nvidia y OpenAI.

Proyectos Futuros de Anthropic

Aún no se ha especificado el proceso exacto que seguirá Anthropic para asegurar que la marca de agua sobreviva a la manipulación. Sin embargo, se presume que utilizarán un patrón estadístico específico para identificar los tokens en las respuestas generadas.

Es importante destacar que una marca de agua visible no probará necesariamente que Claude haya creado un contenido específico. Muchas personas utilizan el modelo para corregir, traducir o resumir textos previamente generados. La ausencia de marca de agua tampoco implica que el contenido no sea de IA, ya que podría desaparecer con ciertas modificaciones.

Colaboración y Actualizaciones

A pesar de los retos, este avance representa un primer paso hacia la identificación del contenido generado por IA. Anthropic está trabajando para añadir la herramienta de marcas de agua a los modelos anteriores de Claude. Además, Bruselas ha dado un plazo de seis meses para que las empresas actualicen sus productos ya publicados.

En septiembre, comenzarán dos grupos de trabajo con ingenieros de todas las empresas que han acordado implementar sistemas de detección y compartir experiencias sobre su implementación.

Ilustración de un hombre mayor con auriculares y chaqueta