Anthropic incorpora marcas de agua para identificar contenidos generados por Claude
¿Cómo funcionará el sistema de etiquetado en Claude?
La empresa explica que la marcación se realizará de manera diferenciada según el formato del contenido generado. Las imágenes o gráficos creados con IA incluirán metadatos que evidencien su origen, basados en el estándar abierto de la Coalición para la Procedencia y Autenticidad del Contenido (C2PA).
Por otra parte, los materiales de texto se identificarán por marcas de agua invisibles que se mantendrán incluso al copiar y pegar el contenido en plataformas de terceros y podrían persistir después de ciertas ediciones.
“La marca de agua se aplicará a nivel de modelo, lo que significa que estará presente independientemente del producto Claude o de la superficie de origen del texto. No la verás y no altera el significado, la calidad ni la legibilidad de la respuesta de Claude”, precisa la empresa.
Anthropic adelantó que trabaja en un mecanismo para que usuarios y terceros puedan detectar las marcas de agua y los metadatos de procedencia que servirán para identificar los contenidos creados por Claude. La compañía afirmó que dará a conocer próximamente los detalles sobre este mecanismo.
Las marcas legibles por máquina se aplicarán globalmente a los modelos Claude compatibles, incluidos Claude Platform (API), Claude, Claude Code, Claude Cowork y Claude Tag. También estarán presentes cuando se acceda a los modelos Claude a través de AWS, Google Cloud o Microsoft Foundry.
Un sistema aún lejos de ser perfecto
El equipo de Anthropic reconoce que su sistema de etiquetado tiene ciertas limitaciones. Explica, por ejemplo, que si un sistema encuentra una marca de Claude, esto indica que el contenido pudo haber sido procesado por el modelo, pero no demuestra necesariamente que la IA haya creado originalmente las ideas, la información o el texto.
La empresa añade que también puede ocurrir que el sistema no incluya una marca detectable en contenido generado o procesado por Claude de forma automática en algunos casos concretos. Según lo publicado en la página de soporte, esto podría suceder si el material fue generado por un modelo lanzado antes del 2 de agosto; si el texto fue editado, parafraseado, traducido o mezclado considerablemente con otros contenidos; si el fragmento es demasiado corto para identificar una señal confiable, o si los metadatos de un archivo fueron eliminados al convertirlo, guardarlo nuevamente o tomar una captura de pantalla.
Por ello, Anthropic advierte que la presencia de una marca debe entenderse como una señal de procedencia y no como una prueba absoluta de autoría humana o artificial.
Con el anuncio, Anthropic se ha convertido en una de las primeras empresas en comunicar su compromiso de ajustar sus productos para cumplir con la Ley de IA vigente en la Unión Europea. No obstante, las medidas anunciadas solo abordan una parte de los requisitos estipulados por la normativa.
Por ejemplo, el marco regulatorio establece que los contenidos generados con IA deben combinar marcas invisibles y metadatos, así como iconos identificables a simple vista para informar sobre su procedencia. También exige que los sistemas interactivos de IA, como los chatbots, informen a los usuarios de manera explícita y desde el primer contacto que son asistentes artificiales.
No obstante, es posible que la empresa anuncie próximamente modificaciones al respecto, toda vez que también es uno de los firmantes del Código de Buenas Prácticas relacionado con la Ley de IA de la Unión Europea.
Fuente: Artículo original