agosto 16, 2026

Razones por las que el sistema de etiquetado invisible de Claude es tan fácil de evadir

Anthropic ha anunciado la implementación de un sistema de etiquetado invisible que permitirá evidenciar la participación de Claude en la creación, edición y procesamiento de contenidos textuales. Sin embargo, expertos advierten que este mecanismo podría ser fácilmente eludido, dada la naturaleza técnica y el funcionamiento del sistema de inteligencia artificial (IA) en sí.

La compañía presentó este sistema como parte de su compromiso de cumplir con los requisitos establecidos en el artículo 50 (2) de la Ley de IA de la Unión Europea, que desde el 2 de agosto exige a las empresas tecnológicas etiquetar de manera clara los contenidos sobre temas de interés público que sean creados o manipulados mediante esta tecnología.

Implementación del sistema de etiquetado

Anthropic ha informado que, a partir de ahora, la marcación de los contenidos generados o alterados por sus productos se incluirá de forma predeterminada en sus próximos modelos de IA. La empresa aún trabaja en la compatibilidad con sus algoritmos y productos existentes, aprovechando el periodo de gracia de cuatro meses que ofrece la legislación para cumplir con estos requisitos.

La compañía ha detallado que la marcación variará según el formato del contenido generado. Las imágenes o gráficos creados con IA incluirán metadatos que evidencien su origen, basados en el estándar abierto de la Coalición para la Procedencia y Autenticidad del Contenido (C2PA).

Características de las marcas de agua invisibles

En cuanto a los materiales textuales, estos se identificarán mediante marcas de agua invisibles que permanecerán incluso al copiar y pegar el contenido en plataformas de terceros, y que podrían persistir tras ciertas ediciones. “La marca de agua se aplicará a nivel de modelo, lo que significa que estará presente independientemente del producto Claude o de la superficie de origen del texto. No la verás y no altera el significado, la calidad ni la legibilidad de la respuesta de Claude”, precisó la empresa.

Leer:  El uso de IA en Hollywood es generalizado, pero pocos lo reconocen: la advertencia de Matthew Belloni

Desafíos del etiquetado de texto de IA

Anthropic ha reconocido que, ante el uso generalizado de la IA, es fundamental proporcionar mayor información y transparencia sobre el uso de esta tecnología en la generación de materiales, con el fin de ofrecer a las audiencias un contexto útil sobre los contenidos que consumen. Sin embargo, la efectividad de este objetivo está en entredicho debido al funcionamiento de los sistemas de marcación, que hasta ahora se basan en las características inherentes de los modelos de lenguaje.

La generación de texto en herramientas como Claude, Gemini o ChatGPT se fundamenta en un principio de probabilidad. El algoritmo de IA selecciona, entre una vasta cantidad de fragmentos de palabras, signos o vocablos, aquellos que tienen mayores probabilidades de ser utilizados para ofrecer una respuesta en lenguaje natural, funcional y adaptada a las necesidades del usuario.

Los sistemas de etiquetado conocidos hasta el momento integran en este proceso un mecanismo predeterminado, diseñado para modificar las probabilidades de elección con el objetivo de generar un patrón de escritura que difícilmente surgiría de manera aleatoria. Este patrón constituye la marca o etiquetado invisible del texto y solo puede ser identificado mediante herramientas diseñadas para detectar esa distribución estadística específica, que ha sido incorporada al funcionamiento del modelo desde su inicio.

Noticias relacionadas