La era de la inteligencia artificial trae consigo nuevos desafíos en torno a la autenticidad del contenido. En respuesta a estas preocupaciones y a la creciente demanda de transparencia, Anthropic, la compañía detrás del popular modelo de lenguaje Claude, ha confirmado una medida significativa: sus sistemas comenzarán a marcar de forma imperceptible los textos y las imágenes generadas por su IA. Esta decisión, con alcance global, surge como una adaptación clave a la nueva normativa europea de transparencia en inteligencia artificial.
Según lo detallado en su plataforma de soporte, Anthropic ha suscrito el Código de Buenas Prácticas sobre Transparencia del Contenido Generado por IA. Este código está alineado con el Artículo 50 de la Ley de IA de la Unión Europea, una legislación que entró en vigor recientemente y que impone a los desarrolladores de inteligencia artificial la obligación de identificar los materiales sintéticos. El objetivo principal es claro: evitar que estos contenidos sean utilizados con propósitos de engaño o manipulación.
La implementación de esta funcionalidad no será inmediata para todos los usuarios. Anthropic ha especificado que los modelos de Claude que se lancen a partir del 2 de agosto de 2026 incorporarán una marca de agua en los textos generados. En el caso de los archivos visuales, se incluirán metadatos de procedencia. Esta característica se extenderá a todas las variantes de Claude, incluyendo Claude Code y Cowork, así como a aquellos que accedan al modelo mediante la API. Los modelos preexistentes a esa fecha recibirán la actualización de forma progresiva.
Aunque la iniciativa nace de una regulación europea, Anthropic aplicará las marcas a los contenidos generados por Claude en todas las regiones del mundo. Esto significa que no solo las aplicaciones oficiales y la web, sino también el acceso a los modelos a través de plataformas como AWS, Google Cloud y Microsoft Foundry, llevarán este distintivo. La compañía advirtió que algunas plataformas o funciones específicas podrían no incluir ciertos tipos de marcado, aunque no se detallaron cuáles serían esas excepciones.
Métodos de identificación digital
Anthropic empleará dos técnicas distintas para el marcado, dependiendo del tipo de contenido. Para el texto, Claude insertará una marca de agua que será imperceptible a simple vista, sin comprometer la calidad o coherencia de la respuesta. Esta marca se integrará directamente en la redacción, asegurando su persistencia incluso si el texto es copiado y pegado en otro lugar, o si se le aplican ediciones menores. Su diseño busca ser lo suficientemente robusto para permanecer inalterado ante manipulaciones básicas.
Aunque Anthropic no ha revelado los detalles técnicos exactos de su marca de agua textual, es probable que se base en la técnica conocida como “lista verde y lista roja”. Este método funciona mediante una clave secreta que clasifica el vocabulario del modelo en dos grupos antes de la generación de cada palabra. Durante la redacción, Claude aumenta sutilmente la probabilidad de seleccionar palabras del primer grupo, un sesgo que resulta indetectable para el ojo humano y que no afecta la fluidez o el sentido del texto final.
Para detectar la presencia de esta marca, se requiere un análisis computacional que determine la proporción de palabras que pertenecen al grupo preferencial. Esta distribución anómala serviría como indicador de que el texto fue generado por una IA, ya que en la escritura humana esta distribución es más equilibrada. La técnica de lista verde y lista roja, resultado de un estudio de 2023, es la base de otras herramientas de detección en el mercado, como SynthID de Google.
En el caso de las imágenes, específicamente en formatos como JPG, PNG y SVG, Anthropic aplicará metadatos de procedencia conforme al estándar C2PA. Este estándar es ampliamente reconocido y ya es utilizado por gigantes tecnológicos como Adobe, Google y OpenAI en sus propias herramientas. La adopción de C2PA facilitará la identificación de deepfakes y otras imágenes manipuladas, utilizando soluciones ya existentes en el mercado y promoviendo la interoperabilidad en la detección de contenido sintético.
Implicaciones y diferencias con la competencia
Para los usuarios de Claude, el proceso de marcado será completamente automático, por lo que no se requerirá ninguna acción adicional de su parte. Esta característica se activará en los futuros modelos del asistente de IA, lo que significa que las versiones actuales permanecerán sin esta funcionalidad durante algunos meses. Es importante recalcar que la marca de agua será obligatoria y no ofrecerá una opción para su desactivación.
A diferencia de competidores como Google, Anthropic no ha anunciado, por el momento, un sistema público que permita a cualquier persona verificar si un texto ha sido generado por su IA. Otro aspecto relevante es que la marca de agua solo certifica que el texto ha pasado por Claude, pero no necesariamente que fue creado desde cero por el modelo. Anthropic ha señalado que una gran cantidad de usuarios emplean sus modelos para tareas como traducir, resumir o revisar textos que originalmente fueron escritos por humanos, haciendo que la transparencia sobre la intervención de la IA sea aún más crucial.