
Anthropic comenzó a implementar una tecnología de marcado invisible en los textos generados por Claude, una medida que permitirá identificar mediante herramientas específicas si un contenido pudo haber sido producido por sus modelos de inteligencia artificial.
lapatilla.com
La marca se incorpora a nivel del modelo, por lo que acompaña las respuestas generadas a través de distintas vías, incluidas las aplicaciones de Claude, Claude Code y sus servicios empresariales. Anthropic también prevé ofrecer herramientas para que usuarios y terceros puedan detectar esas señales.
El sistema no funciona como una marca visible para el lector. Una de las técnicas estudiadas para este propósito consiste en modificar estadísticamente la selección de palabras, de manera que el texto conserve una apariencia normal, pero deje un patrón que pueda ser identificado posteriormente mediante un detector. Sin embargo, las técnicas de este tipo tienen limitaciones: los textos muy cortos ofrecen menos información para realizar una detección confiable y una paráfrasis puede alterar o eliminar la señal.
La medida llega en un momento en que la Unión Europea comenzó a aplicar las obligaciones de transparencia del AI Act. Desde el 2 de agosto de 2026, las reglas contemplan que los proveedores de IA incorporen mecanismos que permitan detectar contenido generado o manipulado artificialmente. Para determinados textos sobre asuntos de interés público también existen obligaciones de etiquetado cuando no hubo revisión o control editorial humano.
En el caso de los sistemas que ya estaban en el mercado antes de esa fecha, la normativa europea contempla un período de transición hasta el 2 de diciembre de 2026 para las obligaciones de marcado y detección. Los contenidos generados antes del 2 de agosto no deben ser etiquetados de manera retroactiva.
El marcado no significa que un detector pueda determinar automáticamente que una persona hizo trampa. Un texto identificado como generado por Claude podría corresponder, por ejemplo, a un contenido que posteriormente fue editado, traducido o resumido por una persona. Por eso, una detección positiva no constituye por sí sola una prueba de uso indebido.
La misma estrategia de procedencia se extiende a otros contenidos generados por IA. En el caso de imágenes, Anthropic utiliza metadatos de procedencia asociados con el estándar C2PA, que permite conservar información sobre el origen y posibles modificaciones del archivo.
El cambio plantea además una nueva carrera tecnológica entre quienes desarrollan sistemas generativos y quienes intentan identificar sus resultados. La Unión Europea busca precisamente que estas señales sean interoperables, robustas y confiables, aunque reconoce que su eficacia depende de las características del contenido y de las limitaciones técnicas disponibles.
