Estos programadores ya tienen formas de eludir las marcas de agua de los textos de Claude
Otras formas de marcar el contenido de IA
El método de eliminación de Meyer usa un gran modelo de lenguaje (LLM) que no aplica marcas de agua para generar múltiples reescrituras, sustituyendo palabras por sinónimos y reorganizando ligeramente el contenido. Por supuesto, esto depende del uso de otros modelos de lenguaje a gran escala que no inserten marcas de agua, lo que quizá no sea una apuesta segura, ya que 190 organizaciones, entre ellas los proveedores OpenAI, Microsoft y Meta, han firmado el código de prácticas de transparencia de la UE. Queda por ver cuántos de estos laboratorios van a implementar sus marcas de agua, que deben incluirse en todos los nuevos modelos lanzados a partir de agosto y deben integrarse en los modelos existentes antes de diciembre.
Aunque no hay certeza de que esta herramienta funcione hasta que Anthropic publique el software que utiliza para detectar una marca de agua, comprender el enfoque básico de SynthID-text en el que se basa el sistema de marcas de agua de Claude los hace estar bastante seguros de que el método funciona, afirma Wayne Pan, director tecnológico y cofundador de Haimaker, una startup de IA con sede en Silicon Valley. Incorporó la herramienta de código abierto de Meyer a su plataforma porque, al igual que él, no le gustaba la idea de que Claude marcara con una marca de agua el contenido, incluso cuando solo se hubiera editado ligeramente, y no estaba de acuerdo con que la marca de agua fuera invisible para el usuario.
Otros programadores han desarrollado sus propias herramientas de eliminación: al ingeniero de software Erik Hughes le llevó 15 minutos crear una herramienta con Claude que elimina caracteres invisibles y similares, reordena las frases dentro de los párrafos y sustituye varias palabras por sinónimos. Leon Chlon, investigador visitante de la Universidad de Oxford, afirma que las marcas de agua pueden eliminarse condensando la respuesta de Claude, traduciéndola a un idioma como el árabe, que tiene una semántica muy diferente a la del inglés y, a continuación, volviendo a traducirla. La propia Anthropic reconoció que el contenido muy editado, parafraseado o traducido podría no llevar marca de agua.
En una declaración a WIRED, un portavoz de Anthropic afirmó: “Estamos añadiendo marcas a los resultados de Claude para cumplir con la Ley de IA de la UE, y otros laboratorios están tomando medidas similares”. Menciona que es difícil identificar el texto generado por IA, y esto proporciona a las personas mejores herramientas para su identificación.
“El texto de los modelos de Claude compatibles, incluida la salida de Claude Code, llevará una marca de agua invisible, y esto no altera el significado, la calidad ni la legibilidad de las respuestas de Claude”, añade el portavoz.
Anthropic está estudiando cómo implementar la detección de marcas de agua en el texto y planea lanzar una herramienta para ello; en ese momento, los desarrolladores podrán comprobar por fin si sus métodos son infalibles. Además, sigue trabajando para mejorar el sistema de marcas de agua. Pan concluye: “Querían demostrar que lo hacen de buena fe, pero no creo que se pueda tener nunca una marca de agua que resista todo”.
Artículo originalmente publicado en WIRED.com Adaptado por Alondra Flores.
Fuente: Artículo original